ウルドゥー語画像文字認識ツール
ウルドゥー語の文書を扱う研究者や翻訳者にとって、複雑なナスタアリーク書体のデジタル化は大きな課題です。ocr.adは、ウルドゥー語特有の連字や合字を認識し、画像からテキストを抽出する専門的なオンラインツールを提供します。手書き風のフォントや書籍のスキャンデータも、手軽にテキストデータとして活用可能です。
ファイルをここにドロップ · またはクリックして選択
最大10ファイル · JPG, PNG, WebP, PDF, BMP, TIFF · 最大15MB
- 自動検出
- EN English
- ZH 中文
- HI हिन्दी
- ES Español
- FR Français
- AR العربية
- BN বাংলা
- PT Português
- RU Русский
- UR اردو
- ID Indonesian
- SW Kiswahili
- PA ਪੰਜਾਬੀ
- DE Deutsch
- JA 日本語
- TE తెలుగు
- TR Türkçe
- VI Tiếng Việt
- JV Basa Jawa
- MR मराठी
- KO 한국어
- TL Tagalog
- TA தமிழ்
- FA فارسی
- TH ไทย
- HA Hausa
- IT Italiano
- MS Bahasa Melayu
- GU ગુજરાતી
- YO Yorùbá
- LN Lingála
- OR ଓଡ଼ିଆ
- KN ಕನ್ನಡ
- SU Basa Sunda
- UK Українська
- PL Polski
- PS پښتو
- ML മലയാളം
- SD سنڌي
- OM Afaan Oromoo
- UZ Oʻzbekcha
- MY မြန်မာ
- NE नेपाली
- AM አማርኛ
- AZ Azərbaycanca
- KU Kurdî
- NL Nederlands
- IG Igbo
- RO Română
- MG Malagasy
- DA Dansk
- SO Soomaali
- XH isiXhosa
- KM ខ្មែរ
- TW Twi
- AF Afrikaans
- SI සිංහල
- AS অসমীয়া
- SN ChiShona
- NY ChiCheŵa
- KK Қазақша
- UG ئۇيغۇرچە
- EL Ελληνικά
- HU Magyar
- SV Svenska
- ZU isiZulu
- HT Kreyòl Ayisyen
- RW Ikinyarwanda
- CS Čeština
- AK Akan
- QU Runa Simi
- CA Català
- BG Български
- SR Српски
- TI ትግርኛ
- HE עברית
- RN Ikirundi
- TN Setswana
- TG Тоҷикӣ
- LU Kiluba
- LO ລາວ
- HY Հայերեն
- KS कश्मीरी
- HR Hrvatski
- GN Avañe'ẽ
- EE Eʋegbe
- WO Wolof
- TT Татарча
- SQ Shqip
- ST Sesotho
- KI Gĩkũyũ
- FF Fulfulde
- KG Kongo
- TS Xitsonga
- SK Slovenčina
- NO Norsk
- NB Norsk Bokmål
- MN Монгол
- LG Luganda
- FI Suomi
- KY Кыргызча
- TK Türkmen
- SS SiSwati
- KR Kanuri
- KA ქართული
- BM Bamanankan
- LT Lietuvių
- AY Aymar aru
- SL Slovenščina
- MK Македонски
- GL Galego
- BE Беларуская
- NR isiNdebele
- ND isiNdebele
- CE Нохчийн
- EO Esperanto
- ZA Cuengh
- BS Bosanski
- LV Latviešu
- BH भोजपुरी
- BO བོད་ཡིག
- BA Башҡортса
- VE Tshivenḓa
- SG Sängö
- NG Oshiwambo
- II ꆈꌠꉙ
- EU Euskara
- ET Eesti
- CY Cymraeg
- CV Чӑвашла
- AV Авар
- AA Afar
- WA Walon
- OS Ирон
- FJ Vosa Vakaviti
- SC Sardu
- SM Gagana fa'a Samoa
- NN Norsk Nynorsk
- MT Malti
- LB Lëtzebuergesch
- KJ Kuanyama
- KW Kernewek
- FY Frysk
- IS Íslenska
- CO Corsu
- LI Limburgs
- YI ייִדיש
- DV ދިވެހި
- HZ Otjiherero
- TO Lea Faka-Tonga
- OC Occitan
- NV Diné Bizaad
- GA Gaeilge
- KV Коми
- DZ རྫོང་ཁ
- BR Brezhoneg
- AB Аҧсуа
- MI Māori
- LA Latina
- GD Gàidhlig
- FO Føroyskt
- CR ᓀᐦᐃᔭᐍᐏᐣ
- HO Hiri Motu
- TY Reo Tahiti
- RM Rumantsch
- MH Ebon
- KL Kalaallisut
- CH Chamoru
- IU ᐃᓄᒃᑎᑐᑦ
- SE Davvisámegiella
- BI Bislama
- AN Aragonés
- VO Volapük
- IK Iñupiatun
- CU Словѣньскъ
- SA संस्कृतम्
- OJ ᐊᓂᔑᓈᐯᒧᐎᓐ
- NA Dorerin Naoero
- GV Gaelg
- PI पालि
- IO Ido
- IE Interlingue
- IA Interlingua
- AE Avestan
画像を貼り付け
画像(スクリーンショット、切り取り、または任意の画像)をクリップボードにコピーして、次を押します:
ヒント: macOSでは ⌘ + V を使用してください。画像がアップロード領域に表示されます。
スピードと精度のために設計
ナスタアリーク体への最適化
ウルドゥー語特有の流麗なナスタアリーク書体を解析し、複雑な合字や重なり合う文字を正確に分離してテキスト化します。
変音符号の正確な認識
ウルドゥー語の読みを補助するTashkeelやその他の変音符号を正確に検出し、文脈を損なうことなくテキストデータへ変換します。
処理後の即時データ消去
アップロードされた画像ファイルは処理完了後に自動でサーバーから削除され、第三者への流出を防ぐ仕組みを構築しています。
多種多様な入力フォーマット
スキャンした書籍の画像やスマートフォンのスクリーンショットなど、様々な形式の画像ファイルから文字情報を抽出可能です。
右から左への書字方向対応
ウルドゥー語のRTL(右から左)の書字方向を正しく認識し、段落や文章の順序を崩さずにテキストを出力します。
テキストの再編集サポート
抽出されたテキストはコピー&ペーストが容易な形式で提供され、翻訳ツールやワープロソフトでの二次利用がスムーズに行えます。
使い方
画像をアップロード
ウルドゥー語の文書画像を選択してツールにアップロードします。ドラッグ&ドロップで簡単に操作可能です。
文字認識の実行
システムがウルドゥー語の合字やナスタアリーク書体を解析し、画像内の文字をテキストデータへと変換します。
書字方向の自動調整
RTLの特性に基づき、文章の並び順を正しく整えることで、読みやすいテキストとして再構成を行います。
結果のダウンロード
変換されたテキストを確認し、必要な形式でダウンロードして、翻訳や資料作成に活用することができます。
役立つ場面
歴史的文献のデジタル化
歴史学者が所蔵する古いウルドゥー語の写本「Diwan-e-Ghalib」をデジタル化し、検索可能なテキストデータとして保存・分析する際に活用します。
公的機関の文書処理
パキスタン国内の公的機関で発行される「CNIC」カードや行政通知文を読み取り、データベース登録のためのテキスト情報を抽出します。
教育教材の作成
ウルドゥー語の文学教材「Urdu Adab」の授業で使用するテキストを作成するため、書籍のページをスキャンしてデジタル化します。
海外旅行の看板翻訳
旅行者が現地のウルドゥー語で書かれた案内板やメニューを撮影し、内容を即座に翻訳して理解するために利用します。
ビジネス契約書の管理
日本企業がウルドゥー語圏のパートナーと交わした契約書をスキャンし、内容を確認・整理するためにテキスト化します。
研究者の論文引用
ウルドゥー語で書かれた専門誌の記事を引用したい研究者が、画像からテキストを抽出し、論文執筆の資料として利用します。
よくある質問
手書きのウルドゥー語も認識できますか?
手書き文字はフォントの種類や筆跡に大きく依存しますが、ある程度整った筆跡であれば、本ツールでテキスト化が可能です。
アップロードした画像はどこに保存されますか?
アップロードされた画像は処理のために一時的に暗号化サーバーへ送られますが、処理完了後は即座に自動削除されます。
どのようなファイル形式に対応していますか?
一般的な画像形式であるJPG、PNG、BMPなどに対応しており、高解像度の画像ほど文字認識の精度が向上します。
認識結果のテキストは編集可能ですか?
はい、抽出されたテキストはプレーンテキストとして提供されるため、Wordやメモ帳などで自由に編集や修正が可能です。
画像が傾いている場合はどうすればよいですか?
ツールが自動的に傾きを補正しますが、認識率を高めるために、できるだけ水平に撮影またはスキャンすることをお勧めします。
大量のページを一括で処理できますか?
本ツールは現在、1ファイルずつの処理に最適化されています。複数ページある場合は、個別にアップロードして処理してください。
ウルドゥー語の連字が正しく認識されません。
ナスタアリーク体は非常に複雑なため、解像度が低いと連字が分離されることがあります。鮮明な画像を使用することで改善されます。
アラビア語と混同されることはありますか?
ウルドゥー語特有の文字(ے, ڈ, ٹなど)を識別するように調整されていますが、画像が不明瞭な場合は誤認識が発生する可能性があります。
ファイルはプライベートに保たれます
画像は可能な限りブラウザ内で処理されます。保存されず、記録もされません。