DeepSeek v3.2 baseとSpeciale、ローカルLLMの最前線

掲示板 フォーラム AI DeepSeek v3.2 baseとSpeciale、ローカルLLMの最前線

スレッド概要

「DeepSeek v3.2 baseとSpeciale、ローカルLLMの最前線」についてのスレッドです。現在のオープンモデルで最高はどれか、という話題です。 : 以下、感想や意見をどうぞ。 15件の返信で意見交換されています。

  • このトピックには15件の返信、5人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
15件の返信を表示中(うち親返信6件)
  • 投稿者
    投稿
    • #73343 返信
      名無しさん
      Redditのr/LocalLLaMAでDeepSeek v3.2 baseとSpecialeについての議論がありました。現在のオープンモデルで最高はどれか、という話題です。: 以下、感想や意見をどうぞ。

    • #73344 返信
      名無しさん
      DeepSeekはコーディング性能が高いって聞くけど、実際どうなんだろう。

      • #73346 返信
        名無しさん
        自分で試した感じだと、コード生成は確かに優秀。でも日本語対応が微妙な気がする。

        • #73349 返信
          名無しさん
          日本語はQLoRAでファインチューンすれば改善できるって聞いたよ。

      • #73347 返信
        名無しさん
        ベンチマークではLlama 3.1より上ってデータもあるけど、実用では差を感じない。

    • #73345 返信
      名無しさん
      Specialeってモデル初めて知った。baseとの違いは何?

      • #73348 返信
        名無しさん
        SpecialeはMoEモデルで、baseより効率的らしい。ただしメモリ使用量が増える。

        • #73350 返信
          名無しさん
          MoEって推論速度が遅くなりそうだけど、実際どうなんだ?

          • #73352 返信
            名無しさん
            Specialeはbaseより若干遅いけど、品質が高いからトレードオフかな。

    • #73351 返信
      名無しさん
      Pr ivacy重視ならローカルで動かせるDeepSeekはいい選択だよね。

      • #73354 返信
        名無しさん
        同意。API経由だとデータがどう使われるか心配になるしね。

    • #73353 返信
      名無しさん
      個人的にはQwen2.5の方が使いやすい。DeepSeekは出力が冗長なことがある。

      • #73355 返信
        名無しさん
        Qwen2.5は確かにバランスが良い。でもDeepSeekのコーディング特化は魅力。

    • #73356 返信
      名無しさん
      そもそも「最高のモデル」って用途によるだろ。

      • #73357 返信
        名無しさん
        そうそう。チャットならClaude、コードならDeepSeek、って感じ。

    • #73358 返信
      名無しさん
      オープンLLMの進化が速すぎて追いつけない…

15件の返信を表示中(うち親返信6件)
返信先: DeepSeek v3.2 baseとSpeciale、ローカルLLMの最前線で#73352に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました