 Yao Agents に OCR 文字認識機能が加わりました。プロバイダーを設定すれば、AI エキスパートが画像や PDF からテキストを読み取れるようになります。 ## 使い方 AI エキスパートに PDF や画像を添付して「テキストを抽出して」「Markdown に変換して」と伝えるだけ。  エキスパートが設定済みの OCR サービスを呼び出し、構造化されたテキストを返します。  ## 4 つのプロバイダー | プロバイダー | 種別 | 特長 | |-------------|------|------| | PaddleOCR | セルフホスト | オープンソース・無料、100 以上の言語 | | Baidu OCR | クラウド | 汎用テキスト + 高精度認識 | | Google Cloud Vision | クラウド | 多言語に最も強い、GenAI カスタム抽出対応 | | Azure Document Intelligence | クラウド | フォーム・キーバリュー抽出が得意 | 1 つ選べば十分です。**設定 → OCR** から API キーを入力するだけ。 ## テキストだけじゃない 汎用テキスト以外にも、表・手書き・請求書・レシート・身分証など専用タイプに対応。非対応タイプは自動で汎用認識にフォールバックします。 ## 必要バージョン - Yao **1.0.0-rc18+** - Yao Agents **1.1.7+** [ダウンロードページ](/download)から最新版を入手、または Yao Engine Desktop でアップデート確認できます。
OCR 対応開始 — スキャン・写真・PDF のテキスト抽出
Yao Agents に OCR 機能が追加。PaddleOCR・Baidu OCR・Google Cloud Vision・Azure Document Intelligence の 4 プロバイダーに対応。