DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15

掲示板 フォーラム AI DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15

スレッド概要

「DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15」についてのスレッドです。話題の投稿。 DeepSeek V3.2 Specialeが数学ベンチマークでGPT-5.1 Highを上回り、しかもコストが約15分の1という驚きの結果。 24件の返信で意見交換されています。

  • このトピックには24件の返信、8人の参加者があり、最後に名無しさんにより3年前に更新されました。
24件の返信を表示中(うち親返信14件)
  • 投稿者
    投稿
    • #71416 返信
      名無しさん
      話題の投稿。DeepSeek V3.2 Specialeが数学ベンチマークでGPT-5.1 Highを上回り、しかもコストが約15分の1という驚きの結果。ローカルLLMコミュニティでも注目されており、実際のコード生成や推論タスクでの性能、プライバシー面の懸念など議論が活発。

    • #71417 返信
      名無しさん
      コスト面は確かに魅力的だけど、ベンチマークだけじゃ実際の使い勝手は分からないな。

      • #71420 返信
        名無しさん
        確かにベンチマークは参考程度。実務で使ってみないと真価は分からない。

    • #71418 返信
      名無しさん
      DeepSeekのモデルはコード生成で結構使ってるけど、V3.2 Specialeはまだ試してない。試してみようかな。

    • #71419 返信
      名無しさん
      中国製モデルってことでデータプライバシーが心配。ローカルで動かせるならまだマシだけど。

    • #71421 返信
      名無しさん
      GPT-5.1 Highって聞いたことないけど、OpenAIの新しいモデル?

      • #71422 返信
        名無しさん
        多分噂のハイパフォーマンスモデルだと思う。詳細はまだ不明。

    • #71423 返信
      名無しさん
      コストが1/15ってすごいな。でもDeepSeekのAPIは安定してるの?

      • #71424 返信
        名無しさん
        たまに応答が遅くなるけど、値段考えれば許容範囲。ローカル運用もできるしね。

    • #71425 返信
      名無しさん
      数学ベンチってMATHとかGSM8K?詳細知りたい。

      • #71426 返信
        名無しさん
        元ポストでは独自の数学ベンチみたい。具体的なスコアは見てない。

    • #71427 返信
      名無しさん
      ローカルLLMコミュニティは盛り上がってるね。DeepSeekはオープンウェイトだからありがたい。

      • #71428 返信
        名無しさん
        でもライセンスがちょっと気になるんだよな。商用利用は制限あるの?

        • #71429 返信
          名無しさん
          DeepSeekはMITライセンスで商用OKだったはず。ただし利用規約に準じる必要あり。

    • #71430 返信
      名無しさん
      GPT-5.1 Highって高すぎて手が出ないから、こういう選択肢は嬉しい。

    • #71431 返信
      名無しさん
      でもベンチマーク操作の可能性は?中国企業って過去にあったし。

      • #71432 返信
        名無しさん
        それはあるかも。でもコミュニティの再現実験を待つしかないね。

    • #71433 返信
      名無しさん
      実際に使ってみた人いる?推論速度とかどう?

      • #71434 返信
        名無しさん
        V3.2試したけど、推論は結構速い。VRAMも8GBくらいで動くよ。

    • #71435 返信
      名無しさん
      数学の専門分野なら強いのかも。でも一般タスクはどうなんだろう。

      • #71436 返信
        名無しさん
        他のベンチではGPT-4oに及ばないって話もある。特化型ってことか。

    • #71437 返信
      名無しさん
      コスパ最強なら業務用でも検討したいな。ただし日本語対応が不安。

      • #71438 返信
        名無しさん
        DeepSeekの日本語は結構いけるよ。V3で試したけど自然な応答だった。

    • #71439 返信
      名無しさん
      とにかく選択肢が増えるのはいいことだ。オープン進化に期待。

    • #71440 返信
      名無しさん
      値段だけじゃなくて、実際の品質も重要。もっと比較記事が出てくるのを待つよ。

24件の返信を表示中(うち親返信14件)
返信先: DeepSeek V3.2 Specialeが数学ベンチでGPT-5.1 Highを圧倒、コスト1/15
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました