スレッド概要
「DeepSeek-R1-0528-Qwen3-8B が Hugging Face に来たってよ」についてのスレッドです。8Bパラメータでローカル実行しやすそう。 コメント欄では性能やコスト、プライバシーの話が出てて、Qwen3-8Bとの比較やコード生成の評価も。 22件の返信で意見交換されています。
- このトピックには22件の返信、7人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
22件の返信を表示中(うち親返信11件)
-
投稿者投稿
-
-
名無しさんRedditの 話題になってた DeepSeek の新しいモデル DeepSeek-R1-0528-Qwen3-8B が Hugging Face に公開されたみたい。8Bパラメータでローカル実行しやすそう。コメント欄では性能やコスト、プライバシーの話が出てて、Qwen3-8Bとの比較やコード生成の評価も。やっぱり地元で動かせるLLMは安心感あるよね。
-
名無しさん8Bならローカルでも動かせるから嬉しいわ
-
名無しさんでもQwen3-8Bとどっちがいいんだろう?
-
名無しさんベンチマーク見るとDeepSeekのが若干上っぽいけど、日本語はQwenのが強いって話もある
-
-
名無しさんコード生成の性能が気になるな
-
名無しさんHumanEvalで結構いいスコア出てたよ。実用レベル
-
-
名無しさんこういう小さいモデルが増えると嬉しい。コストも下がるし
-
名無しさん電気代はバカにならんけどな
-
-
名無しさんプライバシー的にローカルで動くのは安心
-
名無しさんでもDeepSeekって中国の企業だろ?大丈夫か?
-
名無しさんオープンだからコード見ればわかるし、ローカルで動かせば問題ないんじゃね
-
名無しさんまあ信頼できるかは別として、使う分にはいいと思う
-
-
名無しさんLlama 3.2 8Bと比べてどうなん?
-
名無しさん若干DeepSeekの方が賢い印象。特に推論タスクで
-
-
名無しさんとりあえずHugging Faceからダウンロードして試してみるわ
-
名無しさん自分も。gguf形式で出てるの?
-
名無しさんいや、まだggufはなさそう。自分で変換する必要あるかも
-
-
-
名無しさんこういうモデルがもっと出てくるとエコシステムが発展するな
-
名無しさんそうそう。競争が大事
-
-
名無しさんRedditのコメントだと、このモデルはR1の蒸留らしいね
-
名無しさんなるほど。だから小さいのに高性能なのか
-
-
名無しさん日本語のファインチューン版が出れば嬉しい
-
名無しさんそのうち出るよ。コミュニティ活性化してるし
-
-
-
投稿者投稿
22件の返信を表示中(うち親返信11件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53