スレッド概要
「DeepSeek推論:DDR5+PCIe5 vs DDR4+PCIe4 どっちが速い?」についてのスレッドです。DDR5 + PCIe 5.0とDDR4 + PCIe 4.0の組み合わせで、実際どのくらい差が出るのかという話題です。 まだコメントはありませんが、気になる内容なのでここで議論してみませんか? 21件の返信で意見交換されています。
- このトピックには21件の返信、7人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
21件の返信を表示中(うち親返信10件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで、DeepSeekモデルの推論速度に関するハードウェア比較のスレッドが立っていました。
DDR5 + PCIe 5.0とDDR4 + PCIe 4.0の組み合わせで、実際どのくらい差が出るのかという話題です。まだコメントはありませんが、気になる内容なのでここで議論してみませんか? -
名無しさんメモリ帯域が重要ってよく言うけど、PCIeの世代はそこまで影響しないんじゃない?
-
名無しさんモデルが大きいとVRAMに乗り切らないから、システムメモリ経由で推論する場合、PCIe帯域が効いてくるらしいよ。
-
-
名無しさんDDR5の方がレイテンシ悪いって話もあるけど、帯域は確実に上がってるから総合的にはDDR5有利かな。
-
名無しさんでもDDR5のレイテンシがネックになって、推論速度が逆転するケースもあるって聞いた。実際どうなんだろう。
-
-
名無しさん自分はDDR4+PCIe4で7Bモデル動かしてるけど、速度は満足してる。費用対効果ならDDR4で十分かも。
-
名無しさん確かに、13B以上になると違うかもしれないけど、7BならDDR4でも余裕だよね。
-
-
名無しさんDeepSeekの量子化モデル使うなら、むしろCPUの性能の方がボトルネックになりそう。
-
名無しさんその通り。推論エンジンにもよるけど、llama.cppだとCPU演算も重いからね。
-
-
名無しさんPCIe5対応のマザーってまだ高いし、現実的にはDDR4で組むのがコスパ良さそう。
-
名無しさんでも数年使うことを考えると、DDR5+PCIe5に投資してもいいかも。将来性考えて。
-
名無しさんAI用途に限れば、今DDR5にしても数年でまたメモリ規格変わる可能性あるからなあ…
-
-
-
名無しさんベンチマーク見たいな。実際の数値がないとどっちがいいか判断できない。
-
名無しさんRedditのスレ主さんがベンチ取ってくれるのを待つしかないね。でもコメント0だと情報少なすぎる。
-
-
名無しさんDeepSeekってコード生成に強いらしいから、ローカルで動かす意味は大きいよね。
-
名無しさんそうそう、プライバシー面でもローカル推論は安心。コストもAPI呼ぶより安く済むし。
-
-
名無しさんDDR4でもDDR5でも、メモリをたくさん積める方が重要だと思う。32GBじゃ足りない。
-
名無しさんその点、DDR4は大容量が安いから魅力。DDR5はまだ32GBx2でも高い。
-
-
名無しさんPCIe4でも転送速度は十分だと思うけど、どうしても速さを求めるならPCIe5一択かな。
-
名無しさん実際のところ、体感できる差が出るかどうかが疑問。ベンチマークでしか差がわからない可能性も。
-
-
名無しさんこのスレ、Redditの方にも書き込もうかと思ったけど、コメント数0だと躊躇するね。
-
名無しさんここで議論が盛り上がったら、向こうにも書き込めるかも。とりあえず情報共有ありがとう。
-
-
-
投稿者投稿
21件の返信を表示中(うち親返信10件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53