スレッド概要
「Apple M3 Ultra 256GBでDeepseek-R1を動かした結果」についてのスレッドです。多くのコメントがそのパフォーマンスに驚いており、特にメモリ帯域幅やMacでのローカルLLMの可能性について議論が交わされています。 価格やNVIDIAとの比較、実際の推論速度なども話題に。 22件の返信で意見交換されています。
- このトピックには22件の返信、7人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
22件の返信を表示中(うち親返信10件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで、Apple M3 Ultra(28コアCPU、60コアGPU、256GB RAM)を使ってDeepseek-R1-UD-IQ1_S(140.23GB)を実行したというスレッドがありました。多くのコメントがそのパフォーマンスに驚いており、特にメモリ帯域幅やMacでのローカルLLMの可能性について議論が交わされています。価格やNVIDIAとの比較、実際の推論速度なども話題に。
-
名無しさんこれすごいな。256GBのユニファイドメモリで140GBモデルが動くのは理想的。
-
名無しさん確かにコスパは微妙だけど、仕事で使うならありかも。推論速度はどのくらい?
-
-
名無しさんでも値段がなあ…M3 Ultra自体が高いし、256GB構成だと100万超えるだろ。
-
名無しさんNVIDIAのRTX 4090を複数枚買うよりは安い場合もあるぞ。特にメモリ容量重視なら。
-
-
名無しさんDeepseek-R1って結構良いモデルだよね。ローカルで動かせるのは魅力的。
-
名無しさんでもIQ1_Sって量子化レベルだよな。品質落ちてない?
-
名無しさん1ビット量子化だとさすがに精度は落ちるけど、140GBを収めるには仕方ない。
-
名無しさん実際の速度結果は?Redditでは何トークン/秒とか載ってた?
-
名無しさんスレ主によると、プロンプト処理が約8トークン/秒、生成が3トークン/秒くらいらしい。
-
名無しさん思ったより遅くないな。実用的な速度だ。
-
-
-
-
-
名無しさんM3 Ultraの帯域幅が800GB/sだから、大きなモデルでもメモリがボトルネックにならないのが強み。
-
名無しさんでもGPUコア数は60コアしかないから、小さなモデルではNVIDIAに負ける。
-
名無しさん使い分けだね。大規模モデル専用マシンとしてならアリ。
-
-
-
名無しさんこういうの見ると、MacでLLMやるのもいいなと思う。でも自分は予算不足。
-
名無しさんクラウドのAPI使った方が安上がりかも。でもプライバシー重視ならローカル一択。
-
-
名無しさん誰かM4 Ultraの噂は?M3 Ultraよりさらにメモリ帯域増えるなら期待。
-
名無しさんM4はまだUltraが発表されてないから、M3 Ultra買うか待つか悩む。
-
-
名無しさん個人的にはApple SiliconでCUDA相当のライブラリが充実してきたら乗り換えたい。
-
名無しさんMacで動くLLMサーバーとして使うなら悪くなさそう。静かだし。
-
名無しさん冷却はどうなんだろう?高負荷でサーマルスロットリング起きない?
-
名無しさんRedditでも言われてたけど、Mac Studioの冷却は優秀だし、問題ないらしい。
-
-
-
名無しさんそれにしてもDeepseek-R1、結構使えるモデルだから選択肢が広がるね。
-
-
投稿者投稿
22件の返信を表示中(うち親返信10件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53