スレッド概要
「DeepSeek-TNG-R1T2-Chimera、R1より200%高速って本当?」についてのスレッドです。R1-0528比200%高速、R1比20%高速と主張されていますが、実際のところどうなんでしょう? 26件の返信で意見交換されています。
- このトピックには26件の返信、8人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
26件の返信を表示中(うち親返信11件)
-
投稿者投稿
-
-
名無しさんRedditのLocalLLaMAで話題のDeepSeek-TNG-R1T2-Chimeraモデルについて。R1-0528比200%高速、R1比20%高速と主張されていますが、実際のところどうなんでしょう?
-
名無しさん200%速いって、倍以上の速度ってこと?さすがに誇大広告じゃね?
-
名無しさん実際に試した人いる?ローカルで動かせるなら興味ある。
-
名無しさん自分はLlama.cppで試したけど、確かにR1よりトークン生成速度は上がってた。でも200%は盛りすぎ。
-
名無しさん具体的な数字教えてくれ。うちの環境だとR1で50t/sくらい出てる。
-
名無しさんうちの環境(RTX4090)で70t/sくらい出たよ。でもR1でも似たようなもんだった。
-
名無しさん精度はR1と同等って話だけど、自分で試した限りでは微妙な気がする。
-
-
-
-
-
名無しさんベンチマークの内容次第だよね。コード生成とか特定タスクだけ早いパターン。
-
名無しさんDeepSeekのモデルは結構リーズナブルなコストで動くから、試す価値はありそう。
-
-
名無しさんR1-0528って以前のバージョンだっけ?比較対象が古いと速く見えるだけかも。
-
名無しさんChimeraってモデルアーキテクチャ?それとも単なるファインチューン?
-
名無しさん多分マージモデルか何かだと思う。見る限りだと新しい蒸留技術使ってるらしい。
-
-
名無しさん精度はどうなの?速さだけじゃ意味ないぞ。
-
名無しさんベンチマークスコアも見たいな。MMLUとかHumanEvalでどう違うのか。
-
名無しさんRedditのスレッドではコード生成の品質が向上したって意見もあるよ。
-
名無しさんコード生成はR1よりもバグが少ないって検証結果が出てたよ。
-
-
-
-
名無しさんコスト重視ならDeepSeekはいい選択肢だと思う。APIも安いし。
-
名無しさんAPIの応答速度も速いなら業務用にも使えそう。
-
-
名無しさんプライバシー面でもローカルで動かせるのは嬉しい。
-
名無しさんとりあえず自分で試すのが一番だな。量子化バージョン出てる?
-
名無しさんGGUF形式のがHuggingFaceに上がってるよ。4bit量子化で8GBVRAMでも動くらしい。
-
-
名無しさん200%速いって数字だけ見ると胡散臭いけど、実際に使ってみたら結構良かった。
-
名無しさんでもR1と比較して体感できる差は10%くらいだったよ。
-
名無しさんそれでもコスパは良いから、新しいモデルが出たら試す価値はある。
-
-
-
名無しさんマーケティング用の誇張だと思う。DeepSeekは最近そういうの多い。
-
名無しさん結局、自分の使い方次第だよね。大量にバッチ処理するなら速度差は大きいかも。
-
名無しさん同意。リアルタイム対話には速度より応答品質が大事。このモデルはそこそこバランス良いと思う。
-
-
-
投稿者投稿
26件の返信を表示中(うち親返信11件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53