DeepSeekの数学性能って実際どう?ローカルLLMで試した人の感想

掲示板 フォーラム AI DeepSeekの数学性能って実際どう?ローカルLLMで試した人の感想

スレッド概要

「DeepSeekの数学性能って実際どう?ローカルLLMで試した人の感想」についてのスレッドです。DeepSeekモデルの数学能力についての議論で、コーディングやコスト、プライバシー、ベンチマーク比較などが話題になっていました。 URL: このフォーラムでもDeepSeekをローカルで使っている人はいますか? 23件の返信で意見交換されています。

  • このトピックには23件の返信、7人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
23件の返信を表示中(うち親返信13件)
  • 投稿者
    投稿
    • #74642 返信
      名無しさん
      Redditのr/LocalLLaMAで「Deepseek on maths」というスレッドが立っていました。DeepSeekモデルの数学能力についての議論で、コーディングやコスト、プライバシー、ベンチマーク比較などが話題になっていました。URL: このフォーラムでもDeepSeekをローカルで使っている人はいますか?数学問題での精度や、他のモデルとの比較を教えてください。

    • #74643 返信
      名無しさん
      DeepSeekの数学性能は結構話題になってるよね。自分はCoderモデルを使ってるけど、コード生成はかなり優秀。

      • #74645 返信
        名無しさん
        >>2 それ量子化した状態?自分は4bitで使ってるけど精度落ちが気になる。

    • #74644 返信
      名無しさん
      ベンチマークではMATHで高いスコア出してるけど、実際の問題で試すと微妙なこともある。

      • #74647 返信
        名無しさん
        >>3 具体的にどんな問題でダメだった?参考までに教えて。

    • #74646 返信
      名無しさん
      コストパフォーマンスならDeepSeekが一番だと思う。APIも安いし。

      • #74649 返信
        名無しさん
        >>5 APIの応答速度も速いし、コスパは確かに良い。ただ、日本語の精度はどうなんだろう。

    • #74648 返信
      名無しさん
      プライバシー重視ならローカルで動かせるのは大きい。でも数学専門なら別モデルのがいいかも。

      • #74651 返信
        名無しさん
        >>7 プライバシーはローカルの強みだよね。でもセットアップが面倒くさい。

    • #74650 返信
      名無しさん
      DeepSeek-R1が出たけど、数学特化モデルとしてかなり優秀らしい。

      • #74655 返信
        名無しさん
        >>9 R1はまだ使ったことない。V3との差は大きいの?

    • #74652 返信
      名無しさん
      最近のベンチマークでDeepSeekがLlamaより上回ってる分野があるけど、ホントにそんな差あるのか疑ってる。

      • #74653 返信
        名無しさん
        >>11 ベンチマークの偏りもあるからね。実際のタスクで比較しないとわからない。

    • #74654 返信
      名無しさん
      自分は数学の証明問題で試したけど、論理の飛躍が目立った。他のモデルと比べるとまだ改善の余地あり。

      • #74657 返信
        名無しさん
        >>13 具体的な問題例ある?自分も試してみたい。

    • #74656 返信
      名無しさん
      シリコンバレーでもDeepSeek使ってるスタートアップ増えてるって聞いた。コスト面で有利だからね。

      • #74659 返信
        名無しさん
        >>15 でもAPI叩くのはローカルと違って制限あるから注意が必要。

    • #74658 返信
      名無しさん
      オープンなのが良いよね。コミュニティも活発だし。

    • #74660 返信
      名無しさん
      DeepSeekの数学はまだ発展途上って感じ。でも進化は速い。

    • #74661 返信
      名無しさん
      競合のQwenと比べてどうなんだろう?日本語対応ならQwenの方が良いって聞くけど。

      • #74662 返信
        名無しさん
        >>20 確かにQwenは日本語強いね。でもDeepSeekのコスパには敵わない。

    • #74663 返信
      名無しさん
      教育用途で使えるか試してるけど、中学生レベルの数学は問題なし。高校以上は怪しい。

      • #74664 返信
        名無しさん
        >>22 うちの子の宿題チェックに使ってるけど、簡単な問題は合ってるよ。

    • #74665 返信
      名無しさん
      まとめると、DeepSeekはコスパとプライバシーが魅力だけど、数学精度はモデル次第ってとこか。今後に期待。

23件の返信を表示中(うち親返信13件)
返信先: DeepSeekの数学性能って実際どう?ローカルLLMで試した人の感想
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました