スレッド概要
「DeepSeek-R1-0528のUnsloth動的1bit~4bit GGUFがきたぞ」についてのスレッドです。これローカルで動かせるし、コストも下がるし、プライバシー面でも良いですね。 実際の性能やベンチマーク結果など、情報交換しましょう。 24件の返信で意見交換されています。
- このトピックには24件の返信、8人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
24件の返信を表示中(うち親返信11件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで話題のDeepSeek-R1-0528、Unslothによる動的量子化で1bit〜4bitのGGUFが公開されたみたいです。これローカルで動かせるし、コストも下がるし、プライバシー面でも良いですね。実際の性能やベンチマーク結果など、情報交換しましょう。
-
名無しさんお、これは待ってたやつだ。さっそくダウンロードしてみる。
-
名無しさんでも1bitってどんな品質なんだろ?試した人いる?
-
名無しさん自分は4bitで試したけど、Mistralより賢い感じ。2bitでもそこそこ使えたよ。
-
名無しさん1bitはさすがに会話が崩れる。でもタスクによっては問題ないかも。
-
-
名無しさんUnslothの最適化がすごいな。前より量子化の速度が上がった気がする。
-
名無しさんこれってDeepSeekの公式リリースとは別物?Unslothの独自実装?
-
名無しさんUnslothが動的量子化をかけたものだよ。元のモデルはDeepSeek公式のR1-0528。
-
-
名無しさんVRAMが8GBでも動くの?4bitならいけそう?
-
名無しさん4bitで6GBくらいあれば動くっぽい。うちのRTX 3060でなんとか。
-
-
名無しさんでもDeepSeekって中国製だから監視とか心配じゃない?
-
名無しさんローカルで動かす限りは問題ないでしょ。そこがGGUFの利点。
-
名無しさんモデル自体はオープンだし、コミュニティの検証も進んでる。
-
-
名無しさんベンチマーク見たけど、4bitでもほぼ元の精度維持してるな。
-
名無しさんそうなんだ?MMLUとかどう?
-
名無しさんMMLUで数%落ちるくらい。実用上は問題なし。
-
-
-
名無しさんてかUnslothってOllamaでも使えるの?
-
名無しさんGGUFだからOllamaでロードできるよ。
-
-
名無しさん日本語性能はどう?DeepSeekは英語強いけど日本語は微妙って聞いた。
-
名無しさん試した感じ、日本語の指示も結構通じる。タスクなら問題なし。
-
名無しさんやっぱりLlama系よりは落ちるけど、十分使えるよ。
-
-
名無しさんこれでローカルAIサーバー立てたら課金不要になるな。
-
名無しさんでも電気代と初期投資はかかるけどね。
-
-
名無しさん量子化の設定ファイルとか公開されてる?カスタムしたい。
-
名無しさんUnslothのGitHubに手順あるよ。自分で量子化もできるみたい。
-
-
-
投稿者投稿
24件の返信を表示中(うち親返信11件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53