スレッド概要
「QwenやDeepSeekの思考部分を非表示にする方法」についてのスレッドです。」という投稿がありました。 QwenやDeepSeekのモデルを使っていると、回答の前に「Thinking...」という思考過程が出力されることがあります。 17件の返信で意見交換されています。
- このトピックには17件の返信、5人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
17件の返信を表示中(うち親返信9件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで「How to not print the Thinking part of Qwen, deepseek?」という投稿がありました。QwenやDeepSeekのモデルを使っていると、回答の前に「Thinking…」という思考過程が出力されることがあります。これを非表示にする方法についての質問です。いくつかのコメントでは、`–no-think`オプションやプロンプトに「思考を出力しないで」と追加する方法が提案されていました。皆さんはどうやって対処していますか?
-
名無しさん自分も気になってた。llama.cpp使ってるけど、-no-think的なオプションある?
-
名無しさんllama.cppだと今のところ標準ではなさそう。プロンプトで「出力は答えだけ」って指定するのが簡単かな。
-
-
名無しさんDeepSeekのAPI使うときはパラメータに`thinking=false`みたいなのがあるよ。ただローカルだと自分でコード書かないといけないかも。
-
名無しさんAPIの場合は楽だけど、ローカルでも同じ方法が使えるなら教えてほしい。
-
-
名無しさん正直思考過程が見えるの好きだけどな。デバッグに役立つし。
-
名無しさんOllamaで使ってるけど、デフォルトでは思考部分が出ないモデルもあるよ。設定次第かも。
-
名無しさんOllamaのModelfileでTEMPLATEいじれば制御できるって聞いた。まだ試してないけど。
-
-
名無しさんVLLM使ってる人いる?あれだとストリーミングの時に思考部分が混ざるんだよね。
-
名無しさんvLLMだと`–disable-thinking`みたいなフラグがあるってドキュメントに書いてあったよ。確認してみて。
-
-
名無しさんそもそも思考部分を出したくない理由って何?単に表示が邪魔なだけ?
-
名無しさんAPI経由で他のアプリに渡すときに、余計な文字列が入ると処理が面倒だからだと思う。
-
-
名無しさんHugging Faceのtransformersだと、`model.generate()`の引数に`output_thinking=False`を追加すれば消えるって情報を見た。試した人いる?
-
名無しさん試したけど、モデルによっては無視されることもあるみたい。やっぱりプロンプトで強制するのが確実かも。
-
-
名無しさんこのスレ、役立つ情報多いね。自分はプロンプトに「答えだけを返してください」って入れるようにしたらうまくいった。
-
名無しさんそれってモデルによって効果が違わない?Qwenだとたまに無視されることある。
-
-
名無しさん将来的には標準でオプションが増えるといいね。特にローカル環境では細かい制御がまだまだ難しい。
-
名無しさんそうそう、コミュニティがスクリプトやパッチを作ってくれるのを期待してる。
-
-
-
投稿者投稿
17件の返信を表示中(うち親返信9件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53