Qwen3 235BがDeepSeek R1をベンチマークで上回ったらしい

掲示板 フォーラム AI Qwen3 235BがDeepSeek R1をベンチマークで上回ったらしい

スレッド概要

「Qwen3 235BがDeepSeek R1をベンチマークで上回ったらしい」についてのスレッドです。オープンウェイトモデルとしてトップに立ったらしい。 これについてどう思う? 14件の返信で意見交換されています。

  • このトピックには14件の返信、4人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
14件の返信を表示中(うち親返信8件)
  • 投稿者
    投稿
    • #79025 返信
      名無しさん
      Redditのr/LocalLLaMAで話題になってたんだけど、Qwen3 235B Thinking (2507)がArtificial Analysis Intelligence IndexでDeepSeek R1 0528を上回ったそうだ。オープンウェイトモデルとしてトップに立ったらしい。
      これについてどう思う?ローカルLLM界隈では大きなニュースだよね。Qwenはコーディング性能も良いっていうし、実際に使ってみた人の感想とか聞きたい。

    • #79026 返信
      名無しさん
      ベンチマークってどれくらい信頼できるんだろう?DeepSeekも結構良かったけどね。

      • #79031 返信
        名無しさん
        このベンチマーク、特定のタスクに偏ってない?実用的にはDeepSeekの方がいい場面もあるかも。

        • #79032 返信
          名無しさん
          確かに、ベンチマークは参考程度にしたほうがいいよね。実際の使用感が大事。

    • #79027 返信
      名無しさん
      Qwen3はコード生成が強いって聞く。ローカルで動かすには235Bは大きすぎるけど…

      • #79028 返信
        名無しさん
        量子化すれば何とかなるんじゃない?4bitで70Bくらいに縮まるし。

        • #79029 返信
          名無しさん
          それでもVRAM32GBじゃ無理だよ。H100とか必要じゃない?

    • #79030 返信
      名無しさん
      クラウドで使うなら別にサイズ気にしなくていいけど、プライバシーがね…

    • #79033 返信
      名無しさん
      Qwen3の思考モデルってChain-of-Thoughtを強化したらしい。推論問題に強そう。

      • #79034 返信
        名無しさん
        でもDeepSeekもアップデートしてるから、すぐに逆転されるかもね。

    • #79035 返信
      名無しさん
      ローカルLLMの進化は速いなあ。半年後にはまた別のモデルがトップになってそう。

    • #79036 返信
      名無しさん
      コスト面だと、Thoughtモデルは推論時にトークン消費が多いから気をつけないと。

    • #79037 返信
      名無しさん
      実際にHuggingFaceからダウンロードしてみた人いる?感想聞きたい。

      • #79038 返信
        名無しさん
        まだ試してないけど、Qwen2.5から結構進化してるらしい。楽しみ。

    • #79039 返信
      名無しさん
      うちの環境じゃ動かせないから、APIで使うしかないな。API価格次第だけど。

14件の返信を表示中(うち親返信8件)
返信先: Qwen3 235BがDeepSeek R1をベンチマークで上回ったらしいで#79037に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました