DeepSeek-OCRの使い方について

掲示板 フォーラム AI DeepSeek-OCRの使い方について

スレッド概要

「DeepSeek-OCRの使い方について」についてのスレッドです。DeepSeekモデルを使ったOCRの運用方法や、ローカルLLMとの連携について議論が行われています。 ッドはこちら: 26件の返信で意見交換されています。

  • このトピックには26件の返信、8人の参加者があり、最後に名無しさんにより2年、 12ヶ月前に更新されました。
26件の返信を表示中(うち親返信10件)
  • 投稿者
    投稿
    • #72501 返信
      名無しさん
      Redditのr/LocalLLaMAで「How do I use DeepSeek-OCR?」というスレッドが立っていました。DeepSeekモデルを使ったOCRの運用方法や、ローカルLLMとの連携について議論が行われています。ッドはこちら:

    • #72502 返信
      名無しさん
      DeepSeek-OCRって初めて聞いた。普通にOCRするならTesseractで十分だと思ってた。

      • #72504 返信
        名無しさん
        Tesseractと比べて精度はどうなんだろう?日本語対応してるのかな。

    • #72503 返信
      名無しさん
      ローカルで動かせるなら試してみたい。インストール方法はどこかにまとまってる?

      • #72505 返信
        名無しさん
        GitHubのREADME見ると、pipでインストールできるっぽいよ。huggingfaceからモデル落とせば動く。

        • #72507 返信
          名無しさん
          GPU必須?CPUでも動くなら試したい。

          • #72508 返信
            名無しさん
            公式にはCUDA推奨って書いてある。CPUだとめちゃくちゃ遅いと思う。

    • #72506 返信
      名無しさん
      使ったことあるけど、手書き文字の認識はイマイチだった。精度を求めるなら商用OCRの方がいいかも。

    • #72509 返信
      名無しさん
      DeepSeekのモデルって中国製だよね。データが中国に送られないか心配。

      • #72510 返信
        名無しさん
        ローカルで動かせば問題ないでしょ。ネットワーク切って使えばOk。

    • #72511 返信
      名無しさん
      実際に使ってみた感想:pdfのテキスト抽出には使えるけど、画像内のレイアウト認識は弱い。

      • #72512 返信
        名無しさん
        それって元のRedditでも指摘されてたよ。表形式のデータは別のツールが必要って。

        • #72513 返信
          名無しさん
          やっぱりLLMベースのOCRはまだ発展途上か。でも無料で使えるのは嬉しい。

    • #72514 返信
      名無しさん
      DeepSeek-V3と組み合わせると何か面白いことできるのかな?

      • #72515 返信
        名無しさん
        OCR結果を直接LLMで処理するパイプラインは結構使えるよ。ドキュメント分析に便利。

        • #72516 返信
          名無しさん
          それやってみたい!具体的なコード例ない?

          • #72517 返信
            名無しさん
            Redditのスレッドにもサンプルコード載ってた気がする。探してみて。

    • #72518 返信
      名無しさん
      API経由でも使えるの?それともローカル専用?

      • #72519 返信
        名無しさん
        Hugging FaceのTransformersベースだから、APIラッパー作ればいけると思う。

        • #72520 返信
          名無しさん
          自分はFastAPIで簡単なサーバー立てて使ってる。ローカルならレスポンス速いよ。

    • #72521 返信
      名無しさん
      他のOCRモデル(PaddleOCRとか)と比較した人いる?

      • #72522 返信
        名無しさん
        PaddleOCRの方が日本語精度高いって噂。DeepSeek-OCRは多言語対応らしいけど。

        • #72523 返信
          名無しさん
          実際に両方試したけど、日本語ならPaddleOCRの方が上かな。DeepSeekはコード認識が強い感じ。

    • #72524 返信
      名無しさん
      趣味の範囲なら十分使える。仕事で使うには精度が不安。

      • #72525 返信
        名無しさん
        同意。でも、大量の文書を処理するならコスト的にメリットあるかも。

        • #72526 返信
          名無しさん
          そうそう。クラウドOCRは従量課金が怖いから、ローカルで済ませられるのは大きい。

    • #72527 返信
      名無しさん
      スレ主がどういう用途で使いたいのか気になる。元Redditでも具体的な質問があまりなかったけど。

26件の返信を表示中(うち親返信10件)
返信先: DeepSeek-OCRの使い方についてで#72510に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました