スレッド概要
「OpenRouterのDeepSeek R1-0528で誤字が発生する件について」についてのスレッドです。元の投稿はこちらです: モデル自体の問題か、OpenRouterのホスティングの問題か、気になるところですね。 皆さんはどう思いますか? 26件の返信で意見交換されています。
- このトピックには26件の返信、8人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
26件の返信を表示中(うち親返信18件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで、OpenRouter経由のDeepSeek R1-0528が時々誤字を生成するという報告が上がっていました。元の投稿はこちらです: モデル自体の問題か、OpenRouterのホスティングの問題か、気になるところですね。皆さんはどう思いますか?
-
名無しさん私も気づいた。やっぱりOpenRouter経由だと精度落ちるのかな。
-
名無しさんOpenRouterの負荷分散でキャッシュが古いままとか?
-
-
名無しさんローカルで動かせば誤字は出ないけど、VRAMが足りないんだよな……
-
名無しさんDeepSeek R1は結構良いモデルだと思うけど、このバグは気になる。
-
名無しさん自分はあまり誤字に遭遇しないけど、使うプロンプト次第かも。
-
名無しさんDeepSeekって中国製だけど、プライバシーとか大丈夫?
-
名無しさんローカルなら問題ないし、API経由でも機密情報は送らなきゃいい。
-
-
名無しさん代替案としてはLlama 3とか使うのも手だね。
-
名無しさん誤字の原因って、トークナイザーのミスとか?
-
名無しさん多分、量子化の影響じゃない?
-
-
名無しさんOpenRouterに問い合わせた人いる?
-
名無しさん自分はcodingに使ってるけど、誤字はほとんどないな。
-
名無しさんコスト面ではOpenRouterは安いから便利だけどね。
-
名無しさんでも安定性に欠けるなら、他を検討した方がいいかも。
-
-
名無しさんローカルLLMの進化が楽しみ。
-
名無しさんDeepSeek R1-0528ってどういうモデル?
-
名無しさんDeepSeekの最新版で、性能はGPT-4クラスらしいよ。
-
-
名無しさん誤字だけなら許容範囲だけど、コード生成で誤字られたら困る。
-
名無しさん確かに、変数名とか間違えられると厄介。
-
-
名無しさん他のホスティングサービスでも同じ問題あるのかな。
-
名無しさん自分はTogether AI使ってるけど、特に問題ない。
-
-
名無しさんやっぱりキャッシュの不具合じゃない?
-
名無しさんDeepSeekの開発チームに報告したら直るかも。
-
名無しさんこういうバグ報告大事だよね。
-
名無しさんとりあえず、自分はローカルで動かす方向で。
-
名無しさんVRAM増設しようかな……
-
-
-
投稿者投稿
26件の返信を表示中(うち親返信18件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53