DeepSeek V3.2 Technical Report の考察

掲示板 フォーラム AI DeepSeek V3.2 Technical Report の考察

スレッド概要

「DeepSeek V3.2 Technical Report の考察」についてのスレッドです。DeepSeek V3.2 のテクニカルレポートが話題になっています。 ベンチマークやコーディング性能、ローカルで動かす際の要件、プライバシー面などについて議論されています。 18件の返信で意見交換されています。

  • このトピックには18件の返信、6人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
18件の返信を表示中(うち親返信9件)
  • 投稿者
    投稿
    • #73630 返信
      名無しさん
      DeepSeek V3.2 のテクニカルレポートが話題になっています。ベンチマークやコーディング性能、ローカルで動かす際の要件、プライバシー面などについて議論されています。ッド:

    • #73631 返信
      名無しさん
      V3.2って結構性能上がってるの?

    • #73632 返信
      名無しさん
      コーディングタスクでかなり改善してるらしい。GPT-4oに迫るって話もある。

      • #73633 返信
        名無しさん
        でもローカルで動かすにはやっぱりGPU必要だよね。

    • #73634 返信
      名無しさん
      中国のモデルだからプライバシーが心配って意見もあるけど、オープンウェイトなら自分でチェックできるしな。

      • #73635 返信
        名無しさん
        確かに。ただAPI使うならデータが中国経由になるのが嫌だという人もいる。

    • #73636 返信
      名無しさん
      ベンチマークの数字は信用できるのかね?選び抜かれたテストかもしれない。

      • #73637 返信
        名無しさん
        そういう疑いは常にあるけど、実際に使ってみた人のレポートもあるし、悪くないらしい。

    • #73638 返信
      名無しさん
      コスト面ではかなり安いみたいだね。個人で使うには良い選択肢かもしれない。

      • #73639 返信
        名無しさん
        ただ、V3.1→V3.2の進化が微妙っていう声もあった。大きな差は感じないと。

        • #73640 返信
          名無しさん
          ベンチマークだけじゃなく実用面での違いが知りたいな。

    • #73641 返信
      名無しさん
      DeepSeekってコード生成が得意って聞いたけど、日本語のサポートはどうなんだろ。

      • #73642 返信
        名無しさん
        英語メインで学習されてるから日本語はイマイチかも。でも最近のモデルは結構マルチリンガルになってる。

    • #73643 返信
      名無しさん
      技術レポート読んだけど、アーキテクチャの改良点がいくつか書いてあった。MoE周りが変わったのかな。

      • #73644 返信
        名無しさん
        MoEモデルだと推論速度が速いけど、メモリ使用量が増えるって欠点もあるね。

    • #73645 返信
      名無しさん
      結局、どのモデルが一番コスパいいんだろう。QwenやLLaMAと比較してどうか。

      • #73646 返信
        名無しさん
        用途によるけど、コードメインならDeepSeek、汎用ならLLaMAっていう印象。

    • #73647 返信
      名無しさん
      オープンウェイトでここまでの性能なら十分だと思う。商用利用も可能だし。

      • #73648 返信
        名無しさん
        ただライセンスが緩いのはいいけど、サポートがないのが不安要素。

18件の返信を表示中(うち親返信9件)
返信先: DeepSeek V3.2 Technical Report の考察で#73641に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました