スレッド概要
「DeepSeekをOllamaで無限ループさせた話」についてのスレッドです。ローカルLLM運用での注意点や、モデルの挙動、コスト、プライバシーなどについて議論が行われています。 24件の返信で意見交換されています。
- このトピックには24件の返信、8人の参加者があり、最後に名無しさんにより3年前に更新されました。
24件の返信を表示中(うち親返信13件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで「DeepSeekをOllamaでループさせた」という投稿がありました。ローカルLLM運用での注意点や、モデルの挙動、コスト、プライバシーなどについて議論が行われています。
-
名無しさんループって無限生成のこと?Ollamaだとたまに止まらなくなることあるよね。
-
名無しさんそう、プロンプトによっては応答が繰り返されるらしい。パラメータ調整で直ることもあるけど。
-
-
名無しさんDeepSeekは結構優秀だけど、やっぱりバグがあるんだな。
-
名無しさんローカルで動かすならコストは抑えられるけど、トラブルシューティングが面倒。
-
名無しさんDeepSeekのコード生成はかなり使えるって聞くけど、実際どう?
-
名無しさん自分はPythonのスクリプト書かせたら結構正確だったよ。ただ長いとループしやすいかも。
-
-
名無しさんプライバシー重視ならローカルLLM一択だけど、性能はクラウドに劣るね。
-
名無しさんでもDeepSeekならオープンそこそこ性能高いからバランス良い。
-
-
名無しさんOllamaのバージョンアップで直ったりしないのかな。
-
名無しさん最新のOllamaで試したけど、やっぱりループしたって投稿あったよ。
-
-
名無しさん自分はvLLM使ってるけど、Ollamaより安定してる気がする。
-
名無しさんvLLMはセットアップがちょっと大変だけどね。
-
-
名無しさんベンチマーク比較だとDeepSeekはLlamaに勝ってる部分もあるらしい。
-
名無しさんでも数学とかコーディング特化で、汎用性はLlamaの方が上って話も。
-
-
名無しさんループ回避のプロンプトテクニックとかないの?
-
名無しさん`max_tokens`設定で強制停止するのが一番簡単。
-
名無しさんそれでも再帰的なプロンプトだと無限ループになることあるよ。
-
-
-
名無しさんDeepSeekのライセンスって商用利用OKなんだっけ?
-
名無しさんMITライセンスだから大丈夫だけど、派生モデルは要注意。
-
-
名無しさんこのスレ、結構参考になる。自分もループ経験あるから共感。
-
名無しさんやっぱりローカルLLMはまだ発展途上ってことか。
-
-
名無しさんRedditのは賛否両論あったみたいだけど、深掘りすると面白い。
-
名無しさんもっと実験データ共有してほしいな。
-
-
名無しさんとりあえずOllamaのissueに報告しとくわ。
-
-
投稿者投稿
24件の返信を表示中(うち親返信13件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53