スレッド概要
「Deepseek-R1-0528-Qwen3-8Bを使った方いますか?」についてのスレッドです。」というスレッドがありました。 スコア8、コメント17件。 21件の返信で意見交換されています。
- このトピックには21件の返信、7人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
21件の返信を表示中(うち親返信10件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで「Deepseek-R1-0528-Qwen3-8Bの経験がある人いますか?」というスレッドがありました。スコア8、コメント17件。主にローカルLLMとしての使われ方、コーディング性能、コスト、プライバシー、ベンチマーク比較などが議論されています。ッド:
-
名無しさん自分も気になってる。Qwen3-8Bベースならそこそこ軽そうだし、DeepSeekの蒸留ってどうなんだろう。
-
名無しさん使ってみたけど、コーディングは意外と使える。ただし日本語は微妙かも。ベンチマークではLlama 3.1 8Bより若干上って感じ。
-
名無しさん>>3 日本語の品質ってどのくらい?やっぱり中国語モデルだから日本語は弱いのかな。
-
名無しさん>>4 簡単な会話は通じるけど、複雑な指示だとよく間違える。やっぱりバイリンガルモデルには敵わない。
-
-
-
名無しさんプライバシー重視ならローカルで動くのはいいね。でも8Bじゃちょっと力不足かも。
-
名無しさん>>6 確かに。でも最近の蒸留モデルは結構賢くなってるから、用途次第ではありかも。
-
-
名無しさんコストパフォーマンスで言うなら、Mistral Small 3.1 8Bのほうがいいんじゃない?
-
名無しさん>>8 それも一理ある。ただDeepSeekの蒸留はコード特化って話もあるし、一概には言えない。
-
名無しさん>>9 コードならCodeLlamaとかのほうが安定してる気がするけど、どうだろう。
-
-
-
名無しさんベンチマークスコアだけ見ると悪くない。ただ実用的には細かいバグが多い印象。
-
名無しさん>>11 確かに出力がたまに変になる。特に長い文章だと途切れたり。
-
-
名無しさんGGUFで動かしてる人いる?Q4_K_Mだとどこまで使えるんだろう。
-
名無しさん>>13 自分はQ4_K_Mで動かしてる。メモリは8GBくらいでいけるけど、速度はまあまあ。コーディング補完なら実用的。
-
名無しさん>>14 その情報助かる。試してみようかな。
-
-
-
名無しさんRedditのスレでも言われてたけど、このモデルは中国語に最適化されてそう。英語と中国語以外はあんまり期待しないほうがいいかも。
-
名無しさん>>16 日本語で使うなら素直に日本語特化モデル選んだほうが早いよね。
-
-
名無しさんライセンス的にどうなんだろう?DeepSeekのモデルって商用利用は大丈夫?
-
名無しさん>>18 多分大丈夫だと思うけど、確認したほうがいい。最近の中国モデルは緩いことが多い。
-
-
名無しさん正直、自分は試す気になれない。Qwen2.5で十分満足してる。
-
名無しさん>>20 それもわかる。新しいモデル追うより安定してるの使いたいよね。
-
-
名無しさん結局、自分のタスクに合うかどうかでしょ。軽く試すだけなら損はないと思う。
-
-
投稿者投稿
21件の返信を表示中(うち親返信10件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53