Ultralytics YOLO-OCR
高速で正確なテキスト認識がUltralyticsロードマップで発表されました。YOLO-OCRは、文書、ラベル、標識、ディスプレイのリアルタイム読み取りを、あらゆるUltralytics YOLOタスクと同じワークフローに統合します。今すぐYOLO26で構築し、リリースに備えてください。
世界をリードする組織に信頼されています
私たちのモデルがもたらす影響
最先端のビジョン AI モデルで、業界をまたいだプロセスを効率化します。Ultralytics が提供する、スピード、精度、そして使いやすさをご体験ください。
Ultralytics YOLOモデルの進化
Ultralytics YOLOが実践的なYOLOv5ワークフローからエッジ対応のYOLO26推論へとどのように進化したかをご覧ください。
最適な GPU で低コストのトレーニングを実現
Ampere から Blackwell まで、26種類の NVIDIA GPU を 1 時間あたり $0.24 から提供します。マージンなし、最低利用料金なし、コミットメント不要です。
業界別ソリューションを見る
チームが本番環境で Ultralytics のコンピュータビジョンをどのように活用しているかご覧ください。

農業

自動車

ヘルスケア

物流

製造

小売

ロボティクス

農業

自動車

ヘルスケア

物流

製造

小売

ロボティクス

農業

自動車

ヘルスケア

物流

製造

小売

ロボティクス
よくある質問
YOLO-OCRは、画像や動画内のテキストを検出して読み取る光学文字認識のための新しいUltralyticsモデルです。公式のUltralytics roadmapで高速で正確なテキスト認識として発表されており、検出、セグメンテーション、ポーズ推定に使用されているリアルタイムのYOLOワークフローにOCRを取り入れます。
ほとんどのOCRパイプラインはスキャンされた文書向けに構築されており、ライブ動画に対しては動作が遅すぎます。リアルタイムOCRにより、物理世界での読み取りが可能になります。物流におけるナンバープレートやコンテナ、生産ライン上のシリアル番号やラベル、小売店における棚のラベル、ロボット工学における標識やディスプレイなど、すべてカメラのフレームレートで処理されます。
Ultralyticsは、公式のroadmapでリリース時期を発表しています。これは、どの機能がいつリリースされるかに関する信頼できる情報源です。ロードマップとUltralytics on GitHubをフォローして、リリースの発表を確認してください。
現在、実用的なパターンとして、Ultralytics YOLO26をトレーニングしてテキスト領域、ラベル、またはプレートを検出し、その切り抜き画像をOCRエンジンに渡す方法があります。ロードマップではYOLO-OCRを高速で正確なテキスト認識として説明しており、現在のUltralyticsワークフローに基づいて構築することで、リリース時にそれを評価できるようにパイプラインを準備できます。
Ultralytics roadmapを確認し、GitHub repositoryにスターを付け、無料のUltralytics Platformアカウントを作成してください。新しいモデルはリリースされると、トレーニングとデプロイのためにそこに登場します。
YOLO-OCRに備えましょう
今すぐUltralytics YOLO26でビジョンパイプラインを構築し、リリース当日にテキスト認識を追加しましょう。