スレッド概要
「deepseek-ocr.rsに量子化を追加したって話」についてのスレッドです。DeepSeekモデルを使ったOCRツールに量子化を実装したとのこと。 ローカルLLMの実用性、コスト削減、プライバシー面など、興味深い話題です。 27件の返信で意見交換されています。
- このトピックには27件の返信、9人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
27件の返信を表示中(うち親返信14件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで「We just added quantization to deepseek-ocr.rs」という投稿がありました。DeepSeekモデルを使ったOCRツールに量子化を実装したとのこと。ローカルLLMの実用性、コスト削減、プライバシー面など、興味深い話題です。
-
名無しさん量子化って精度落ちるんじゃないの?OCRだと文字認識が怪しくなりそう。
-
名無しさんDeepSeekの量子化は比較的精度落ちが少ないって聞いた。int8とかでやってるのかな。
-
-
名無しさんでも速度とメモリ節約になるからトレードオフだよね。実用レベルなら十分かも。
-
名無しさんローカルでOCR動かせるのはいいね。クラウドAPIだとコストかかるし、プライバシーも気になる。
-
名無しさんそうそう、社内文書とか外部に出せないからローカルOCRは需要ありそう。
-
-
名無しさんdeepseek-ocr.rsってRust製なんだ。Rustは速いけど開発大変じゃね?
-
名無しさんRustのOCRライブラリは増えてきてる。Pythonより実行速度出るから選択肢としてあり。
-
-
名無しさん量子化の手法は何使ってるんだろう?GGUFとかGPTQとか。
-
名無しさんRedditの投稿見る限り、独自の量子化みたい。詳細はコード読まないと。
-
-
名無しさんベンチマーク結果とかあると嬉しいけど、まだないっぽい。
-
名無しさん自分で試すしかないね。量子化なしと比較してどれくらい差が出るか。
-
-
名無しさんDeepSeekモデル自体が中国製で気になる人もいるかも。
-
名無しさん使うデータに注意すれば問題ないと思うけど、セキュリティポリシーによるね。
-
-
名無しさんOCRって結構LLMの認識能力高いから、小さいモデルでもいけるんだよね。
-
名無しさんむしろ専用OCRより柔軟でいいかも。フォントやレイアウトに強い。
-
-
名無しさん量子化すると推論速度どれくらい上がるんだろ?体感でいいから知りたい。
-
名無しさんRedditのコメントで2倍速くなったって書いてあった気がする。メモリ使用量も半減。
-
-
名無しさんRust製ってことはCUDAとか使わなくても動くのかな?
-
名無しさんたぶんwgpuとか使ってクロスプラットフォーム対応してる。CPUでも動くはず。
-
-
名無しさんこのプロジェクト、前から見てたけど量子化来たか。使いやすくなったね。
-
名無しさんまだ日本語対応はどうなんだろ?試した人いる?
-
名無しさんDeepSeek自体は日本語もそこそこできるから、OCRもいけると思う。
-
-
-
名無しさん量子化のコード、GitHubで公開されてるから誰でも試せるのがいいね。
-
名無しさんオープン積極的に開発進んでるのは好感持てる。
-
-
名無しさんでも量子化って結局ハルシネーション起きやすくなったりしない?
-
名無しさんOCRの場合はテキスト抽出だから、ハルシネーションより文字化けのほうが問題かも。
-
-
名無しさんとりあえず一度試してみる価値ありそう。量子化なしと比較してみよう。
-
-
投稿者投稿
27件の返信を表示中(うち親返信14件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53