DeepSeek V3.1(Thinking)のベンチマーク集計:GPT-OSS-120bとの比較

掲示板 フォーラム AI DeepSeek V3.1(Thinking)のベンチマーク集計:GPT-OSS-120bとの比較

スレッド概要

「DeepSeek V3.1(Thinking)のベンチマーク集計:GPT-OSS-120bとの比較」についてのスレッドです。スコア197、コメント63件と盛り上がっています。 実際の数値やローカルLLMとしての使い勝手、コストやプライバシー面での議論が行われています。 22件の返信で意見交換されています。

  • このトピックには22件の返信、7人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
22件の返信を表示中(うち親返信11件)
  • 投稿者
    投稿
    • #77442 返信
      名無しさん
      Redditのr/LocalLLaMAから、DeepSeek V3.1(Thinking)の集計ベンチマークとGPT-OSS-120bとの比較スレッドです。スコア197、コメント63件と盛り上がっています。実際の数値やローカルLLMとしての使い勝手、コストやプライバシー面での議論が行われています。詳細は以下のを参照。

    • #77443 返信
      名無しさん
      ベンチマーク見たけど、DeepSeek結構いいね。特にコーディングのスコアが高いのが気になる。

      • #77444 返信
        名無しさん
        そう?でもGPT-OSS-120bにはまだ負けてる分野もあるみたい。日本語の性能はどうなんだろう。

    • #77445 返信
      名無しさん
      DeepSeekはオープンだからローカルで動かせるのがいいよね。このV3.1は8Bくらいだっけ?

      • #77446 返信
        名無しさん
        いや、もっと大きいモデルだと思う。推論時思考するタイプだからサイズは大きいよ。32Bとか?

    • #77447 返信
      名無しさん
      プライバシーの面でローカル推論は魅力だけど、やっぱり性能はクラウドに劣るから使い分けかな。

      • #77448 返信
        名無しさん
        でも最近のローカルモデルは進化してて、日常使いなら十分だよ。コストも安いし。

    • #77449 返信
      名無しさん
      このベンチマークってどこかの第三者機関の結果?それともCommLmみたいなサイトのまとめ?

      • #77450 返信
        名無しさん
        多分Redditorが集めたデータだと思う。コメント欄に詳細あるかも。

    • #77451 返信
      名無しさん
      GPT-OSS-120bって何?オープンGPTって聞いたことないけど。

      • #77452 返信
        名無しさん
        たぶんOpenAIのGPT-4のオープン版みたいなもの?名前だけ借りてる別モデルだと思う。詳細は知らん。

    • #77453 返信
      名無しさん
      こういう比較スレ見ると、どのモデル使えばいいか迷う。DeepSeekはR1の時に嫌な噂あったけどV3は大丈夫なのか?

      • #77454 返信
        名無しさん
        R1の安全性問題は改善されたらしいよ。このV3.1もちゃんとガードレール入ってるとか。

      • #77455 返信
        名無しさん
        そういう噂って本当かどうかわからないから、自分で試すのが一番。ベンチはあくまで参考値。

    • #77456 返信
      名無しさん
      個人的にはコスパでDeepSeekに軍配。API安いし、ローカルも可能。GPT-OSSはライセンスが曖昧で使いにくい。

      • #77457 返信
        名無しさん
        でもDeepSeekって中国企業だろ?データどうなるか不安。ローカルで動かすなら問題ないけど。

        • #77458 返信
          名無しさん
          それはどのモデルでも同じでは?OpenAIだってアメリカだし。結局自分の信頼できる環境で使うしかない。

    • #77459 返信
      名無しさん
      ベンチマークの数字だけ見るとかなりいいけど、実際の会話だとまだ微妙って話も聞く。思考時間が長いとか。

      • #77460 返信
        名無しさん
        それは思考型モデルの特徴だから仕方ないね。応答が早いのにこだわるなら通常のV3使えばいい。

    • #77461 返信
      名無しさん
      とりあえずhuggingfaceでモデル落として試してみるわ。このスレで興味湧いた。

      • #77462 返信
        名無しさん
        おすすめはggufフォーマット。llama.cppで動かすと簡単。

    • #77463 返信
      名無しさん
      こういう議論は楽しいね。新しいモデル出るたびにワクワクする。次はどんなの来るかな。

    • #77464 返信
      名無しさん
      まとめると、DeepSeek V3.1はコスパとローカル実行で人気だが、思考速度と信頼性に注意。GPT-OSSは比較対象として微妙。自分の用途に合わせて選べってことか。

22件の返信を表示中(うち親返信11件)
返信先: DeepSeek V3.1(Thinking)のベンチマーク集計:GPT-OSS-120bとの比較で#77459に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました