スレッド概要
「DeepSeekスタイルのエングラムでVRAM90%削減?Intel Arcデュアル構成のGSIアーキテクチャ」についてのスレッドです。DeepSeekモデルをローカルで動かす際のVRAM削減手法に関する内容です。 正確性や実用性について意見を聞かせてください。 21件の返信で意見交換されています。
- このトピックには21件の返信、7人の参加者があり、最後に名無しさんにより3年前に更新されました。
21件の返信を表示中(うち親返信9件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで話題の投稿「90% VRAM reduction for DeepSeek-style Engrams: Running GSI-Architecture on Dual Intel Arc (B50)」について議論しましょう。DeepSeekモデルをローカルで動かす際のVRAM削減手法に関する内容です。正確性や実用性について意見を聞かせてください。元
-
名無しさんこれ本当?90%削減とか夢みたいな数字だな。検証動画とかあるの?
-
名無しさんIntel Arc B50デュアル構成って聞いたことないけど、メモリ帯域はどうなんだろう。
-
名無しさん>>3 たぶん2枚挿しで分散させるんだと思う。でもDeepSeekのモデルってパラメータ多いから本当に動くのか疑問。
-
名無しさん>>4 エングラムって何?GSIアーキテクチャ初めて聞いた。
-
名無しさん>>5 おそらく新しい圧縮手法だと思う。量子化より効率的らしい。
-
-
-
-
名無しさんこのスレ、Redditのやつだよね。コメント見ると実際に試した人いるのかな?
-
名無しさん>>7 数人試してて、確かにVRAMは減ったけど速度は落ちたって書いてあった。
-
名無しさん速度が落ちるなら実用的じゃないかも。ローカルLLMは応答速度が命だから。
-
名無しさん>>9 でもコスト面ではIntel Arcは安いから、実験的には面白いと思う。
-
-
-
-
名無しさんVRAM削減よりも、モデルの精度が気になる。90%減らして品質保てるの?
-
名無しさん>>11 おそらくトレードオフがあるんだろうね。ベンチマーク結果が出てるといいけど。
-
-
名無しさんこの手法、一般的なNVIDIA GPUでも使えるの?
-
名無しさん>>13 多分Intel Arc専用だと思う。CUDAには対応してないんじゃないかな。
-
名無しさんそうなると普及は難しいかも。でも選択肢が増えるのは良いことだ。
-
-
-
名無しさん実際に動かしたいけど、Intel Arc買うか迷う。今はRTX4060持ってるから…
-
名無しさん>>16 4060でも試してみれば?もしかしたら流用できるかも。
-
-
名無しさんRedditの元ポストにもっと詳細な説明が欲しい。情報が少なすぎる。
-
名無しさん>>18 確かに。コード公開されてるなら自分で試せるけど、リンクがなかった。
-
-
名無しさんDeepSeek自体がまだ発展途上だから、こういう実験は面白いね。
-
名無しさん>>20 でも検証不足だとガセネタになりかねない。ちゃんとしたレビューが欲しい。
-
-
名無しさんとりあえずRedditのスレをウォッチしておくわ。何か進展あったら教えて。
-
-
投稿者投稿
21件の返信を表示中(うち親返信9件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53