スレッド概要
「DeepSeek V3.1 BaseがHugging Faceに来たぞ」についてのスレッドです。話題のDeepSeek V3.1 BaseがHugging Faceにアップロードされたみたいだ。 ローカルLLM界隈ではコストパフォーマンスやベンチマークが注目されている。 22件の返信で意見交換されています。
- このトピックには22件の返信、7人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
22件の返信を表示中(うち親返信11件)
-
投稿者投稿
-
-
名無しさん話題のDeepSeek V3.1 BaseがHugging Faceにアップロードされたみたいだ。ローカルLLM界隈ではコストパフォーマンスやベンチマークが注目されている。
-
名無しさんついに来たか。VRAM食うけどコード生成はかなり良いらしいね。
-
名無しさん実際使った?ベンチマーク見たら結構強そうだけど、日本語はどうなんだろ。
-
-
名無しさんDeepSeekって中国製だよね。プライバシー的に大丈夫か?
-
名無しさんローカルで動かすなら問題ないでしょ。API使わなきゃいいだけ。
-
-
名無しさんV3.1ってV3からの改善点は何?情報が錯綜してるけど。
-
名無しさん主にマルチモーダル対応と指示追従の強化らしい。ベンチも上がってる。
-
-
名無しさんllamaと比べてどうなんだ?コスパで勝ってる気がする。
-
名無しさんコード生成はDeepSeekの方が得意って話がある。ただし日本語はLlamaにまだ負けるかも。
-
-
名無しさんHugging Faceでダウンロードしようとしたらでかいな。70Bくらいあるのか。
-
名無しさん量子化版を待つしかないね。4bitでも良ければ動くかも。
-
-
名無しさんRedditのコメント見てると、結構バグ報告もあるみたい。安定性はまだ微妙?
-
名無しさん初期リリースだからな。アップデート待ちだ。
-
名無しさんうちの環境では動いたよ。メモリ32GBでとりあえず動いてる。
-
-
名無しさん商用利用はどうなんだろう。ライセンス確認しないと。
-
名無しさんMITライセンスだったはず。商用OKだよ。ただし公開義務なし。
-
-
名無しさん前にV2.5使ってたけど、V3.1はかなり良くなってる気がする。
-
名無しさん具体的にどこが?推論速度とか?
-
名無しさん文章の自然さが増した。指示通りに動く率も高い。
-
-
名無しさんこれでローカルLLMの選択肢がまた増えたな。嬉しい。
-
名無しさんでもモデルサイズがネック。一般ユーザーにはまだ敷居高い。
-
名無しさんそのうち小さい版も出るだろう。それまではAPI使うか。
-
-
名無しさんとにかく一度試してみる価値はあるよ。ベンチでだけ評価するのは勿体ない。
-
-
投稿者投稿
22件の返信を表示中(うち親返信11件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53