DeepSeekベースのユニバーサルOCR v2:CPU/MPS/CUDA対応らしい

掲示板 フォーラム AI DeepSeekベースのユニバーサルOCR v2:CPU/MPS/CUDA対応らしい

スレッド概要

「DeepSeekベースのユニバーサルOCR v2:CPU/MPS/CUDA対応らしい」についてのスレッドです。「Universal DeepSeek OCR 2: CPU, MPS, CUDA Support」という話題が出ていました。 DeepSeekモデルを使ったローカルOCRツールで、CPU・MPS・CUDAをサポートしているとのこと。 19件の返信で意見交換されています。

  • このトピックには19件の返信、6人の参加者があり、最後に名無しさんにより3年前に更新されました。
19件の返信を表示中(うち親返信7件)
  • 投稿者
    投稿
    • #71849 返信
      名無しさん
      「Universal DeepSeek OCR 2: CPU, MPS, CUDA Support」という話題が出ていました。DeepSeekモデルを使ったローカルOCRツールで、CPU・MPS・CUDAをサポートしているとのこと。完全にローカルで動くのでプライバシー面でも安心。実際の精度や速度はどうなのか、Tesseractや他のOCRと比べてどうなのか、気になります。

    • #71850 返信
      名無しさん
      お、DeepSeek使ったOCRか。ローカルで動くなら試してみたいな。

      • #71851 返信
        名無しさん
        MPS対応ってMacでも動くのか?GPU使えるなら速そう。

        • #71852 返信
          名無しさん
          MacBook Air M1で動かしてみたけど、CPUでも意外と速かったよ。ただし日本語認識はちょっと怪しいかも。

    • #71853 返信
      名無しさん
      これってDeepSeekのどのモデル使ってるんだろ?R1じゃなくてV2系?

      • #71854 返信
        名無しさん
        README見た感じだと、軽量モデル使ってるっぽい。OCR特化だから大きいモデルは必要ないんだろうな。

    • #71855 返信
      名無しさん
      Tesseractより精度いいのかな?漢字混じりの文書だと結構差が出る。

      • #71856 返信
        名無しさん
        試しに論文のPDF突っ込んだら、数式はダメだったけど本文はそこそこ読めた。Tesseractよりはマシかも。

        • #71857 返信
          名無しさん
          数式はやっぱり専用のやつじゃないと無理だろ。それは期待しすぎ。

    • #71858 返信
      名無しさん
      CUDA対応って書いてあるけど、VRAMどのくらい食うんだ?8GBじゃキツい?

      • #71859 返信
        名無しさん
        RTX3060 12GBで動かしたけど、メモリ使用量は4~5GBくらい。8GBでも何とかなると思う。

        • #71860 返信
          名無しさん
          それなら気軽に試せそうだな。インストールもpipで一発?

          • #71861 返信
            名無しさん
            GitHubのREADME通りやればすぐ動いたよ。依存関係も少なくて楽。

    • #71862 返信
      名無しさん
      これって商用利用できるんだっけ?DeepSeekのライセンス的に。

      • #71863 返信
        名無しさん
        モデルがMITライセンスなら大丈夫だけど、DeepSeekのライセンスは要確認。多分Apache2.0だったはず。

        • #71864 返信
          名無しさん
          念のため調べたけど、DeepSeekのモデルはMITライセンスだよ。商用もOK。

    • #71865 返信
      名無しさん
      この手のツールってどんどん増えてるけど、シンプルで使いやすいのが一番だな。

      • #71866 返信
        名無しさん
        そうそう、OCRって前処理が面倒だから、コマンド一発で動くのはありがたい。

    • #71867 返信
      名無しさん
      海外のツールって日本語対応が微妙なことが多いんだけど、これはどうなんだろ。

      • #71868 返信
        名無しさん
        日本語の文書で試した人いたら教えてほしい。縦書きとか対応してる?

19件の返信を表示中(うち親返信7件)
返信先: DeepSeekベースのユニバーサルOCR v2:CPU/MPS/CUDA対応らしいで#71858に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました