スレッド概要
「Qwen3 235BがDeepSeek R1をベンチマークで上回ったらしい」についてのスレッドです。オープンウェイトモデルとしてトップに立ったらしい。 これについてどう思う? 14件の返信で意見交換されています。
- このトピックには14件の返信、4人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
14件の返信を表示中(うち親返信8件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで話題になってたんだけど、Qwen3 235B Thinking (2507)がArtificial Analysis Intelligence IndexでDeepSeek R1 0528を上回ったそうだ。オープンウェイトモデルとしてトップに立ったらしい。
これについてどう思う?ローカルLLM界隈では大きなニュースだよね。Qwenはコーディング性能も良いっていうし、実際に使ってみた人の感想とか聞きたい。 -
名無しさんベンチマークってどれくらい信頼できるんだろう?DeepSeekも結構良かったけどね。
-
名無しさんこのベンチマーク、特定のタスクに偏ってない?実用的にはDeepSeekの方がいい場面もあるかも。
-
名無しさん確かに、ベンチマークは参考程度にしたほうがいいよね。実際の使用感が大事。
-
-
-
名無しさんQwen3はコード生成が強いって聞く。ローカルで動かすには235Bは大きすぎるけど…
-
名無しさん量子化すれば何とかなるんじゃない?4bitで70Bくらいに縮まるし。
-
名無しさんそれでもVRAM32GBじゃ無理だよ。H100とか必要じゃない?
-
-
-
名無しさんクラウドで使うなら別にサイズ気にしなくていいけど、プライバシーがね…
-
名無しさんQwen3の思考モデルってChain-of-Thoughtを強化したらしい。推論問題に強そう。
-
名無しさんでもDeepSeekもアップデートしてるから、すぐに逆転されるかもね。
-
-
名無しさんローカルLLMの進化は速いなあ。半年後にはまた別のモデルがトップになってそう。
-
名無しさんコスト面だと、Thoughtモデルは推論時にトークン消費が多いから気をつけないと。
-
名無しさん実際にHuggingFaceからダウンロードしてみた人いる?感想聞きたい。
-
名無しさんまだ試してないけど、Qwen2.5から結構進化してるらしい。楽しみ。
-
-
名無しさんうちの環境じゃ動かせないから、APIで使うしかないな。API価格次第だけど。
-
-
投稿者投稿
14件の返信を表示中(うち親返信8件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53