スレッド概要
「DeepSeekの品質が悪いって話」についてのスレッドです。スコア4、コメント2件と小規模ですが、DeepSeekモデルを使っている人には気になる話題です。 精度の問題、コード生成、コスト、プライバシー、ベンチマーク比較など、様々な観点で議論が行われています。 27件の返信で意見交換されています。
- このトピックには27件の返信、9人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
27件の返信を表示中(うち親返信11件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで「DeepSeekがフレーズを正しくしない」という投稿がありました。スコア4、コメント2件と小規模ですが、DeepSeekモデルを使っている人には気になる話題です。精度の問題、コード生成、コスト、プライバシー、ベンチマーク比較など、様々な観点で議論が行われています。皆さんの経験や意見を聞かせてください。
-
名無しさん確かにDeepSeekの、たまに変な訳出るよ。特に日本語→英語が怪しい。
-
名無しさん自分は英語→日本語で使ってるけど、そもそも日本語コーパスが少ないんじゃない?
-
-
名無しさんだけじゃなくて、コード生成もたまに変なの出る。でもコスパはいいよね。
-
名無しさんそうそう、API価格が安いからトレードオフって感じ。GPT-4oと比べるのは酷かも。
-
-
名無しさんローカルで動かしてるけど、量子化モデルだと特にが微妙。
-
名無しさんどの量子化レベル?Q4_K_Mとか?自分はQ8で試したらまあまあだったよ。
-
名無しさんQ4_K_Mで試した。やっぱり精度落ちるんだな。
-
-
-
名無しさんRedditのスレでも言われてたけど、プロンプトを工夫すると改善するらしい。
-
名無しさん具体的には?「正確にして」って付け加えるだけで変わる?
-
名無しさん俺は言語とターゲット言語を明示するとマシになる気がする。
-
-
-
名無しさんDeepSeekは中国語には強いけど、日本語はあまり得意じゃないのかな。
-
名無しさんでもベンチマークでは結構いいスコア出してるよ。実際の使用感とのギャップか。
-
名無しさんベンチマークは英語中心だからね。非英語は評価が難しい。
-
-
-
名無しさんプライバシー考えるとローカルで動かせるDeepSeekは魅力的だけど、品質がネック。
-
名無しさんそうそう、クラウドに送りたくないデータだけど、品質悪いと使えないジレンマ。
-
-
名無しさん他のモデルと比較して、DeepSeekのは独特のくせがある。
-
名無しさんどんなくせ?俺はNLLBとか使ってたけど、DeepSeekは自然な感じがする時もある。
-
名無しさんたまに原文にない単語を勝手に追加するんだよ。ハルシネーションって感じ。
-
名無しさん確かに、なのに創作入るのは困るな。
-
-
-
-
名無しさん現時点では、目的ならGPT-4oやClaudeの方が安定してる。
-
名無しさんでもコストが全然違うから、用途によるかも。大量のならDeepSeekでもいいかも。
-
名無しさん品質よりも量を優先するならありか。後で人間がチェックするなら。
-
-
-
名無しさんRedditスレ見返すと、結構多言語対応に苦戦してる人多いね。
-
名無しさん日本語コミュニティでも似たような話題出てるよ。改善に期待。
-
-
名無しさんとりあえず、以外のタスクでは満足してる。コード生成とか。
-
名無しさんコードは英語だから問題ないってのもあるかも。非英語タスクの性能向上に期待したい。
-
-
名無しさんまとめると、DeepSeekのはまだまだ改善の余地あり。でもコスパとプライバシー面で価値はあるという意見が多数って感じかな。
-
-
投稿者投稿
27件の返信を表示中(うち親返信11件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53