スレッド概要
「DeepSeek-OCRの圧縮率と精度に関する観察」についてのスレッドです。元のURL:。 DeepSeekモデルを使ったOCRで、圧縮率と精度のトレードオフについて議論されています。 21件の返信で意見交換されています。
- このトピックには21件の返信、7人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
21件の返信を表示中(うち親返信8件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAに「DeepSeek-OCR: Observations on Compression Ratio and Accuracy」というスレッドがありました。元のURL:。DeepSeekモデルを使ったOCRで、圧縮率と精度のトレードオフについて議論されています。ローカルLLMユーザーにとってはコストやプライバシーの面でも重要ですね。皆さんの実際の使用感や工夫があれば教えてください。
-
名無しさん自分も試したけど、圧縮率を上げると確かに精度が落ちるね。でも実用的な範囲では結構使える。
-
名無しさん具体的にどのくらいの圧縮率で使ってる?自分は50%くらいでやってるけど、文字の欠けがたまに出る。
-
名無しさん70%くらいまでなら大丈夫だったよ。ただ文書の種類によるかも。手書きだと厳しい。
-
-
-
名無しさんコスト削減にはなるけど、OCR専用のモデルじゃないから限界があるんじゃない?
-
名無しさん確かにDeepSeekはマルチモーダルだけど、OCR特化のモデルよりは劣るかも。でもローカルで動くのがいい。
-
名無しさんプライバシー重視ならローカル一択だよね。クラウドに送りたくないし。
-
-
-
名無しさんこのスレッドの元になったRedditの議論、結構参考になった。特に圧縮率と精度のグラフがあればいいのに。
-
名無しさん自分でプロットしてみたら?Pythonで簡単にできるよ。
-
名無しさんお、やってみようかな。データ取るのが面倒だけど。
-
-
-
名無しさんDeepSeekって他のモデルと比べてどうなの?LLaMAとかと。
-
名無しさんベンチマークではDeepSeekの方がOCRスコア高いって見たことある。でも使うリも多い。
-
名無しさんRTX 4090でも余裕だけど、それ以下のGPUだと厳しいかも。
-
-
-
名無しさん個人的には圧縮率低めでやった方が安心。ストレージも安くなったし。
-
名無しさんそうそう、圧縮しすぎて文字化けするくらいなら無圧縮でいい。
-
名無しさんでも大量の文書を扱うなら圧縮したくなるよね。トレードオフだ。
-
-
-
名無しさんDeepSeek-OCRって日本語対応してるの?
-
名無しさんしてるはず。自分は日本語のPDFで試したらちゃんと読めたよ。
-
名無しさんありがとう。じゃあ試してみるわ。
-
-
-
名無しさん議論が盛り上がってるね。自分ももっと試してみよう。
-
名無しさん結果をまた共有してほしい。
-
-
名無しさんとりあえずDeepSeek使ってみる価値はありそうだ。
-
-
投稿者投稿
21件の返信を表示中(うち親返信8件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53