スレッド概要
「Step-3.5-Flash (196b/A11b)がGLM-4.7とDeepSeek v3.2を上回る性能?ローカルLLMの最新動向」についてのスレッドです。:。 実際の使用感や比較の公平性、ローカル実行の可能性など、さまざまな意見が飛び交っています。 23件の返信で意見交換されています。
- このトピックには23件の返信、7人の参加者があり、最後に名無しさんにより3年前に更新されました。
23件の返信を表示中(うち親返信10件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで話題になっているStep-3.5-Flash (196b/A11b)がGLM-4.7やDeepSeek v3.2を上回るベンチマーク結果を出したというスレッドを紹介します。:。実際の使用感や比較の公平性、ローカル実行の可能性など、さまざまな意見が飛び交っています。皆さんはこのモデルを試しましたか?
-
名無しさんすごい性能だけど、今のローカル環境で動かせるのかな?
-
名無しさん196Bパラメータはさすがにきつい。A11bのMoEならVRAM節約できそうだが。
-
名無しさん4bit量子化でどうにかならない?llama.cpp対応してたら試したい。
-
名無しさんまだllama.cpp未対応みたい。でもすぐ対応されるんじゃない?
-
-
-
-
名無しさんベンチマークだけじゃ判断できないよね。実際のコーディングタスクでDeepSeek v3.2の方がいいって報告もある。
-
名無しさんそうそう。GLM-4.7も日本語性能は高いし一概に比較できない。
-
-
名無しさんStepって中国のモデルだよね。データセット汚染とかないの?
-
名無しさんそこは気になる。でも最近の中国モデルは結構クリーンだって話も。
-
-
名無しさん自分はDeepSeek v3.2で満足してるから乗り換える理由ないかな。
-
名無しさんv3.2はコーディング特化なら優秀だよね。Stepは汎用性能が売りらしい。
-
-
名無しさんHuggingFaceでモデル公開されてる?探したけど見つからなかった。
-
名無しさんまだ一部のテスターしかアクセスできないみたい。オープン化は未定らしい。
-
-
名無しさんAPIの値段が気になる。ローカルで動かせないならクラウド版の価格次第だな。
-
名無しさんStepのAPIは今のところ公開されてないっぽい。今後に期待。
-
-
名無しさんQwenと比較してどうなんだろう?最近Qwenも強いし。
-
名無しさんQwen2.5は良モデルだけど、Stepはパラメータ数で勝ってるからベンチマーク上は有利かな。
-
-
名無しさん日本語性能が気になる。GLM-4.7は日本語に強いって評判だけど。
-
名無しさんStepも中国語モデルベースなら日本語もそこそこ使えるのでは?ただ英語は苦手かも。
-
-
名無しさんまた新モデルか…追いかけるの疲れるわ。v3.2で十分。
-
名無しさん進化が速すぎてどれ使えばいいか迷うよね。
-
-
名無しさんベンチマーク操作の疑いもあるから、第三者検証待ちかな。
-
名無しさんそういう意味ではオープンじゃないと信用できない部分ある。
-
名無しさんとりあえず試せる環境が整ったらまた議論しよう。今は様子見。
-
-
-
-
投稿者投稿
23件の返信を表示中(うち親返信10件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53