スレッド概要
「DeepSeekの数学性能って実際どう?ローカルLLMで試した人の感想」についてのスレッドです。DeepSeekモデルの数学能力についての議論で、コーディングやコスト、プライバシー、ベンチマーク比較などが話題になっていました。 URL: このフォーラムでもDeepSeekをローカルで使っている人はいますか? 23件の返信で意見交換されています。
- このトピックには23件の返信、7人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
23件の返信を表示中(うち親返信13件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで「Deepseek on maths」というスレッドが立っていました。DeepSeekモデルの数学能力についての議論で、コーディングやコスト、プライバシー、ベンチマーク比較などが話題になっていました。URL: このフォーラムでもDeepSeekをローカルで使っている人はいますか?数学問題での精度や、他のモデルとの比較を教えてください。
-
名無しさんDeepSeekの数学性能は結構話題になってるよね。自分はCoderモデルを使ってるけど、コード生成はかなり優秀。
-
名無しさん>>2 それ量子化した状態?自分は4bitで使ってるけど精度落ちが気になる。
-
-
名無しさんベンチマークではMATHで高いスコア出してるけど、実際の問題で試すと微妙なこともある。
-
名無しさん>>3 具体的にどんな問題でダメだった?参考までに教えて。
-
-
名無しさんコストパフォーマンスならDeepSeekが一番だと思う。APIも安いし。
-
名無しさん>>5 APIの応答速度も速いし、コスパは確かに良い。ただ、日本語の精度はどうなんだろう。
-
-
名無しさんプライバシー重視ならローカルで動かせるのは大きい。でも数学専門なら別モデルのがいいかも。
-
名無しさん>>7 プライバシーはローカルの強みだよね。でもセットアップが面倒くさい。
-
-
名無しさんDeepSeek-R1が出たけど、数学特化モデルとしてかなり優秀らしい。
-
名無しさん>>9 R1はまだ使ったことない。V3との差は大きいの?
-
-
名無しさん最近のベンチマークでDeepSeekがLlamaより上回ってる分野があるけど、ホントにそんな差あるのか疑ってる。
-
名無しさん>>11 ベンチマークの偏りもあるからね。実際のタスクで比較しないとわからない。
-
-
名無しさん自分は数学の証明問題で試したけど、論理の飛躍が目立った。他のモデルと比べるとまだ改善の余地あり。
-
名無しさん>>13 具体的な問題例ある?自分も試してみたい。
-
-
名無しさんシリコンバレーでもDeepSeek使ってるスタートアップ増えてるって聞いた。コスト面で有利だからね。
-
名無しさん>>15 でもAPI叩くのはローカルと違って制限あるから注意が必要。
-
-
名無しさんオープンなのが良いよね。コミュニティも活発だし。
-
名無しさんDeepSeekの数学はまだ発展途上って感じ。でも進化は速い。
-
名無しさん競合のQwenと比べてどうなんだろう?日本語対応ならQwenの方が良いって聞くけど。
-
名無しさん>>20 確かにQwenは日本語強いね。でもDeepSeekのコスパには敵わない。
-
-
名無しさん教育用途で使えるか試してるけど、中学生レベルの数学は問題なし。高校以上は怪しい。
-
名無しさん>>22 うちの子の宿題チェックに使ってるけど、簡単な問題は合ってるよ。
-
-
名無しさんまとめると、DeepSeekはコスパとプライバシーが魅力だけど、数学精度はモデル次第ってとこか。今後に期待。
-
-
投稿者投稿
23件の返信を表示中(うち親返信13件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53