baidu/Unlimited-OCR:README に基づく導入ガイド
README、メタデータ、ライセンスに基づく baidu/Unlimited-OCR の導入と確認ガイドです。
プロジェクトの範囲
baidu/Unlimited-OCR の README はプロジェクトを「Unlimited OCR Works: Welcome the Era of One-shot Long-horizon Parsing.」と説明しています。ここではリポジトリで確認できる事実だけを整理します。star 数やバッジは注目度の手掛かりであり、品質の証明ではありません。「Transformers」には次の説明があります。Inference using Huggingface transformers on NVIDIA GPUs. Requirements tested on python 3.12.3 + CUDA12.9:。これは範囲の説明であり、本番検証の結果ではありません。
向いている用途
README の「Release」にある内容から、用途が合うかを先に判断できます。[2026/07/03] 🤝 Thanks to the Baidu Cloud team for their support. Our model is now available on Baidu Cloud.。目的が違うなら、人気だけで採用する理由にはなりません。プロジェクト名やコマンドは原文のまま残し、一次資料へ戻って用語を確認できるようにしています。 README には次の確認可能な項目もあります。[2026/07/21] 🤝 Thanks to the ms-swift community.。初回テストの材料にはなりますが、実際の環境での確認を省略する理由にはなりません。
動作の考え方
動作の説明は「vLLM」など複数の箇所に分かれています。確認できる情報は次の通りです。##### Docker Images Use the following Docker images depending on your GPU platform:。書かれていない構成、性能、セキュリティを推測で補いません。導入時はディレクトリ、設定ファイル、release 履歴を確認してください。
インストールと初回起動
初回導入は README の入口から始めます。確認できるコマンドは次の通りです。 docker pull vllm/vllm-openai:unlimited-ocr 実行可能なコマンドがない場合は手順を作らず、「Inference」で依存関係、待受ポート、初回設定を確認します。
設定と日常運用
日常運用は公式文書の範囲に限ります。「SGLang」にはSet up the environment (uv-managed virtualenv). Install the local SGLang wheel first, then pin kernels==0.9.0 and install PyMuPDF for PDF-to-image conversion:とあります。設定、環境変数、権限、データ保存先は明記されたものだけを扱います。未記載の既定値は隔離環境で確認し、戻せる設定を保存してください。 同じ資料には[2026/06/28] 🤝 Thanks to the vLLM community for their support, our model now supports vLLM inference.ともあります。
README で確認できる制約
制約も確認が必要です。現在の資料からは、baidu/Unlimited-OCR の互換表、性能基準、サービス保証、長期サポートを確認できません。README の記載は「Send streaming requests to the OpenAI-compatible API:」です。不明点は採用記録の検証項目として残し、断定に変えないでください。