スレッド概要
「DeepSeek R1-0528の非推論モード実行は可能?」についてのスレッドです。」というスレッドが立ってました。 :。 15件の返信で意見交換されています。
- このトピックには15件の返信、5人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
15件の返信を表示中(うち親返信6件)
-
投稿者投稿
-
-
名無しさんRedditの 「DeepSeek R1-0528を推論モードなしで動かせるか?」というスレッドが立ってました。:。コメントでは、モデルの改造や量子化、API経由の方法など様々な意見が交わされていました。ローカルLLM界隈では定番の話題ですが、実際に試した人の声を聞きたいです。
-
名無しさん自分も試してみたけど、普通に推論モード切ってロードできたよ。configのtemperatureとか調整すればいける。
-
名無しさん詳細教えてくれ。具体的にどうやった?
-
名無しさんHuggingFaceのコードでtrust_remote_code=Falseにするだけ。ただしchain-of-thoughtは出なくなる。
-
名無しさんマニュアルの改変が必要そうだな。ローカルでやるならGGUF版を試すのが早い。
-
-
-
-
名無しさんモデル自体が推論用に最適化されてるから、非推論だと性能落ちない?
-
名無しさんベンチマークでは数%低下って話。コスト削減にはなるかも。
-
-
名無しさん意味あるの?推論モードが売りなのに。
-
名無しさんRedditのスレでも議論あったけど、API使うならプロンプトで抑制できるらしいよ。
-
名無しさんそれって結局推論は走ってるんじゃないの?
-
名無しさん表面だけ隠してる可能性ある。実質無駄かも。
-
-
-
名無しさん個人的には推論ありで使ってるけど、非推論版が公式から出れば需要あると思う。
-
名無しさんDeepSeekは中国企業だし、公式のサポートはあてにならん。オープンコミュニティ頼み。
-
-
名無しさんVLLMとかでデプロイするときに推論切るフラグあるらしい。試す価値あり。
-
名無しさんミスリードしないでほしい。実際のベンチの数字見てから言え。
-
名無しさんまあ落ち着け。両方試して比べるのが吉。
-
-
-
-
投稿者投稿
15件の返信を表示中(うち親返信6件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53