スレッド概要
「DeepSeekの挙動がおかしい?」についてのスレッドです。「Why is my DeepSeek like this? 投稿者はDeepSeekモデルが期待通りに動作しないと悩んでいる様子。 23件の返信で意見交換されています。
- このトピックには23件の返信、7人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
23件の返信を表示中(うち親返信12件)
-
投稿者投稿
-
-
名無しさん「Why is my DeepSeek like this?」というスレッドが立っていました。投稿者はDeepSeekモデルが期待通りに動作しないと悩んでいる様子。コメント欄では、量子化の問題やプロンプトの設定、他のモデルとの比較など様々な意見が交わされています。ローカルLLMの扱い方やDeepSeekの特性について議論が行われていました。
-
名無しさん自分もDeepSeekで変な出力が出たことある。量子化のせいかも。
-
名無しさんQ4_K_Mで試したら結構マシになったよ。
-
名無しさん量子化の設定次第で結構変わるから、いろいろ試すといいよ。
-
-
名無しさんどんなモデル使ってる?サイズや設定を教えてほしい。
-
名無しさん7Bモデルをllama.cppで動かしてる。CPUオンリーだから遅い。
-
名無しさんCPUだけだとやっぱり遅いよね。GPU欲しい。
-
-
-
名無しさんDeepSeekはコーディングタスクでよく使うけど、時々変な応答するよね。
-
名無しさんコード生成ならDeepSeekよりCodeLlamaのが安定してる気がする。
-
-
名無しさんベンチマークでは悪くないけど、実用だと微妙なんだよな。
-
名無しさん確かにMistralの方が日本語は得意かも。
-
-
名無しさんプロンプトを変えたら改善しない?
-
名無しさんシステムプロンプトで専門家ロールを与えたら出力が変わった。
-
-
名無しさんDeepSeekってコスト面ではいいけど、品質にばらつきがある。
-
名無しさんその通り。プライバシー重視でローカル動かすならありだけど。
-
-
名無しさん最新バージョンは改善されてるって聞いたけど、まだ話題になってるね。
-
名無しさん同感。Llama 3.1の方が安定してる。
-
名無しさん紅茶を淹れる方法を聞いたら変なレシピ返してきた(笑)
-
名無しさんそれ、データセットに謎のレシピが混ざってるんじゃない?
-
-
名無しさん自分はfine-tune版を試したらマシになった。
-
名無しさんfine-tuneする時間がないんだよな…
-
-
名無しさん結局、用途に合わせてモデル選ぶのが一番だと思う。
-
名無しさんそうそう。DeepSeekは軽量でいいけど、品質重視なら他を検討すべき。
-
-
名無しさんRedditのスレでも同じような意見多かったね。初心者にはちょっと難しいかも。
-
-
投稿者投稿
23件の返信を表示中(うち親返信12件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53