DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15

掲示板 フォーラム AI DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15

スレッド概要

「DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15」についてのスレッドです。話題の投稿。 DeepSeek V3.2 Specialeが数学ベンチマークでGPT-5.1 Highを上回り、しかもコストが約15分の1という驚きの結果。 24件の返信で意見交換されています。

  • このトピックには24件の返信、8人の参加者があり、最後に名無しさんにより3年前に更新されました。
24件の返信を表示中(うち親返信14件)
  • 投稿者
    投稿
    • #71374 返信
      名無しさん
      話題の投稿。DeepSeek V3.2 Specialeが数学ベンチマークでGPT-5.1 Highを上回り、しかもコストが約15分の1という驚きの結果。ローカルLLMコミュニティでも注目されており、実際のコード生成や推論タスクでの性能、プライバシー面の懸念など議論が活発。

    • #71375 返信
      名無しさん
      コスト面は確かに魅力的だけど、ベンチマークだけじゃ実際の使い勝手は分からないな。

      • #71378 返信
        名無しさん
        確かにベンチマークは参考程度。実務で使ってみないと真価は分からない。

    • #71376 返信
      名無しさん
      DeepSeekのモデルはコード生成で結構使ってるけど、V3.2 Specialeはまだ試してない。試してみようかな。

    • #71377 返信
      名無しさん
      中国製モデルってことでデータプライバシーが心配。ローカルで動かせるならまだマシだけど。

    • #71379 返信
      名無しさん
      GPT-5.1 Highって聞いたことないけど、OpenAIの新しいモデル?

      • #71380 返信
        名無しさん
        多分噂のハイパフォーマンスモデルだと思う。詳細はまだ不明。

    • #71381 返信
      名無しさん
      コストが1/15ってすごいな。でもDeepSeekのAPIは安定してるの?

      • #71382 返信
        名無しさん
        たまに応答が遅くなるけど、値段考えれば許容範囲。ローカル運用もできるしね。

    • #71383 返信
      名無しさん
      数学ベンチってMATHとかGSM8K?詳細知りたい。

      • #71384 返信
        名無しさん
        元ポストでは独自の数学ベンチみたい。具体的なスコアは見てない。

    • #71385 返信
      名無しさん
      ローカルLLMコミュニティは盛り上がってるね。DeepSeekはオープンウェイトだからありがたい。

      • #71386 返信
        名無しさん
        でもライセンスがちょっと気になるんだよな。商用利用は制限あるの?

        • #71387 返信
          名無しさん
          DeepSeekはMITライセンスで商用OKだったはず。ただし利用規約に準じる必要あり。

    • #71388 返信
      名無しさん
      GPT-5.1 Highって高すぎて手が出ないから、こういう選択肢は嬉しい。

    • #71389 返信
      名無しさん
      でもベンチマーク操作の可能性は?中国企業って過去にあったし。

      • #71390 返信
        名無しさん
        それはあるかも。でもコミュニティの再現実験を待つしかないね。

    • #71391 返信
      名無しさん
      実際に使ってみた人いる?推論速度とかどう?

      • #71392 返信
        名無しさん
        V3.2試したけど、推論は結構速い。VRAMも8GBくらいで動くよ。

    • #71393 返信
      名無しさん
      数学の専門分野なら強いのかも。でも一般タスクはどうなんだろう。

      • #71394 返信
        名無しさん
        他のベンチではGPT-4oに及ばないって話もある。特化型ってことか。

    • #71395 返信
      名無しさん
      コスパ最強なら業務用でも検討したいな。ただし日本語対応が不安。

      • #71396 返信
        名無しさん
        DeepSeekの日本語は結構いけるよ。V3で試したけど自然な応答だった。

    • #71397 返信
      名無しさん
      とにかく選択肢が増えるのはいいことだ。オープン進化に期待。

    • #71398 返信
      名無しさん
      値段だけじゃなくて、実際の品質も重要。もっと比較記事が出てくるのを待つよ。

24件の返信を表示中(うち親返信14件)
返信先: DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました