サンスクリット語画像文字認識ツール
サンスクリット語の研究者や学生にとって、膨大な文献をデジタル化する作業は非常に時間がかかるものです。特にデーヴァナーガリー文字特有の複雑な合字や、Matraと呼ばれる母音記号の重なりは、一般的なツールでは読み取りが困難です。ocr.adは、こうした古典言語の特性を考慮した専用の処理エンジンにより、手書きや印刷されたサンスクリット語の文書を効率的にテキスト化します。
ファイルをここにドロップ · またはクリックして選択
最大10ファイル · JPG, PNG, WebP, PDF, BMP, TIFF · 最大15MB
- 自動検出
- EN English
- ZH 中文
- HI हिन्दी
- ES Español
- FR Français
- AR العربية
- BN বাংলা
- PT Português
- RU Русский
- UR اردو
- ID Indonesian
- SW Kiswahili
- PA ਪੰਜਾਬੀ
- DE Deutsch
- JA 日本語
- TE తెలుగు
- TR Türkçe
- VI Tiếng Việt
- JV Basa Jawa
- MR मराठी
- KO 한국어
- TL Tagalog
- TA தமிழ்
- FA فارسی
- TH ไทย
- HA Hausa
- IT Italiano
- MS Bahasa Melayu
- GU ગુજરાતી
- YO Yorùbá
- LN Lingála
- OR ଓଡ଼ିଆ
- KN ಕನ್ನಡ
- SU Basa Sunda
- UK Українська
- PL Polski
- PS پښتو
- ML മലയാളം
- SD سنڌي
- OM Afaan Oromoo
- UZ Oʻzbekcha
- MY မြန်မာ
- NE नेपाली
- AM አማርኛ
- AZ Azərbaycanca
- KU Kurdî
- NL Nederlands
- IG Igbo
- RO Română
- MG Malagasy
- DA Dansk
- SO Soomaali
- XH isiXhosa
- KM ខ្មែរ
- TW Twi
- AF Afrikaans
- SI සිංහල
- AS অসমীয়া
- SN ChiShona
- NY ChiCheŵa
- KK Қазақша
- UG ئۇيغۇرچە
- EL Ελληνικά
- HU Magyar
- SV Svenska
- ZU isiZulu
- HT Kreyòl Ayisyen
- RW Ikinyarwanda
- CS Čeština
- AK Akan
- QU Runa Simi
- CA Català
- BG Български
- SR Српски
- TI ትግርኛ
- HE עברית
- RN Ikirundi
- TN Setswana
- TG Тоҷикӣ
- LU Kiluba
- LO ລາວ
- HY Հայերեն
- KS कश्मीरी
- HR Hrvatski
- GN Avañe'ẽ
- EE Eʋegbe
- WO Wolof
- TT Татарча
- SQ Shqip
- ST Sesotho
- KI Gĩkũyũ
- FF Fulfulde
- KG Kongo
- TS Xitsonga
- SK Slovenčina
- NO Norsk
- NB Norsk Bokmål
- MN Монгол
- LG Luganda
- FI Suomi
- KY Кыргызча
- TK Türkmen
- SS SiSwati
- KR Kanuri
- KA ქართული
- BM Bamanankan
- LT Lietuvių
- AY Aymar aru
- SL Slovenščina
- MK Македонски
- GL Galego
- BE Беларуская
- NR isiNdebele
- ND isiNdebele
- CE Нохчийн
- EO Esperanto
- ZA Cuengh
- BS Bosanski
- LV Latviešu
- BH भोजपुरी
- BO བོད་ཡིག
- BA Башҡортса
- VE Tshivenḓa
- SG Sängö
- NG Oshiwambo
- II ꆈꌠꉙ
- EU Euskara
- ET Eesti
- CY Cymraeg
- CV Чӑвашла
- AV Авар
- AA Afar
- WA Walon
- OS Ирон
- FJ Vosa Vakaviti
- SC Sardu
- SM Gagana fa'a Samoa
- NN Norsk Nynorsk
- MT Malti
- LB Lëtzebuergesch
- KJ Kuanyama
- KW Kernewek
- FY Frysk
- IS Íslenska
- CO Corsu
- LI Limburgs
- YI ייִדיש
- DV ދިވެހި
- HZ Otjiherero
- TO Lea Faka-Tonga
- OC Occitan
- NV Diné Bizaad
- GA Gaeilge
- KV Коми
- DZ རྫོང་ཁ
- BR Brezhoneg
- AB Аҧсуа
- MI Māori
- LA Latina
- GD Gàidhlig
- FO Føroyskt
- CR ᓀᐦᐃᔭᐍᐏᐣ
- HO Hiri Motu
- TY Reo Tahiti
- RM Rumantsch
- MH Ebon
- KL Kalaallisut
- CH Chamoru
- IU ᐃᓄᒃᑎᑐᑦ
- SE Davvisámegiella
- BI Bislama
- AN Aragonés
- VO Volapük
- IK Iñupiatun
- CU Словѣньскъ
- SA संस्कृतम्
- OJ ᐊᓂᔑᓈᐯᒧᐎᓐ
- NA Dorerin Naoero
- GV Gaelg
- PI पालि
- IO Ido
- IE Interlingue
- IA Interlingua
- AE Avestan
画像を貼り付け
画像(スクリーンショット、切り取り、または任意の画像)をクリップボードにコピーして、次を押します:
ヒント: macOSでは ⌘ + V を使用してください。画像がアップロード領域に表示されます。
スピードと精度のために設計
デーヴァナーガリー合字の最適化
サンスクリット語特有の複雑な文字の組み合わせや合字を識別し、文字化けを防いで正確なテキストを生成します。
Matra母音記号の正確な配置
子音の上下左右に付随するMatra記号を正しく認識し、文法的な整合性を保った状態でテキストを抽出します。
処理後の自動データ消去
アップロードされた全てのファイルは処理完了後に自動的に削除されるため、貴重な文献の機密性を維持できます。
多様な入力フォーマット対応
スキャンされた古文書画像やPDFファイルなど、様々な形式の入力からサンスクリット語のテキストを抽出可能です。
研究資料のデジタル化支援
手書きの写本や古い印刷物からテキストを生成し、検索可能なデジタルアーカイブ作成を強力にサポートします。
直感的な操作フロー
複雑な設定を必要とせず、ファイルをアップロードするだけでサンスクリット語の解析が即座に開始されます。
使い方
文献画像のアップロード
デジタル化したいサンスクリット語の文書画像やPDFファイルをドラッグ&ドロップでアップロードします。
言語設定の確認
認識対象としてサンスクリット語(デーヴァナーガリー文字)が正しく選択されていることを確認します。
合字解析の実行
システムがデーヴァナーガリー文字の合字やMatra記号を解析し、テキストデータへの変換を自動で行います。
テキストのダウンロード
抽出されたテキストを確認し、必要に応じて編集可能な形式でダウンロードして研究に活用します。
役立つ場面
ヴェーダ文献のデジタル化
研究者が『リグ・ヴェーダ』の古い写本をデジタル化し、合字の多いデーヴァナーガリー文字を検索可能なテキストデータに変換して分析を効率化します。
サンスクリット語教育資料作成
大学の教員が古典文法の教材を作成する際、手書きの練習プリントをスキャンして、学生がデジタルで確認できるテキスト形式に変換します。
歴史的碑文の記録保存
歴史学者が寺院の碑文を撮影した画像からテキストを抽出し、劣化しやすい石碑の記録をデジタルアーカイブとして安全に保管します。
図書館の蔵書整理
図書館員が古いサンスクリット語の書籍をスキャンし、目録作成のためにタイトルや著者名をテキストデータとして抽出します。
翻訳プロジェクトの準備
翻訳者がサンスクリット語の物語を現代語に訳す際、元の文章をテキスト化して、辞書検索や比較作業をスムーズに進めます。
個人の学習ノートの整理
サンスクリット語を学ぶ学生が、手書きの学習ノートをデジタル化し、後からキーワード検索できるように整理して知識を蓄積します。
よくある質問
手書きのサンスクリット語も認識できますか?
はい、鮮明に書かれた手書きのサンスクリット語であれば認識可能です。ただし、文字の崩れが激しい場合は精度が低下することがあります。
ファイルは安全に処理されますか?
はい、アップロードされたすべてのファイルは、処理が完了した直後にサーバーから完全に削除され、第三者と共有されることはありません。
どのようなファイル形式に対応していますか?
一般的な画像形式であるJPG、PNG、およびPDFファイルに対応しており、スキャンした文書をそのままアップロードできます。
縦書きの文書は認識できますか?
はい、サンスクリット語の伝統的なレイアウトや縦書きの文書にも対応しており、文字の並びを正しく解析します。
抽出されたテキストの精度はどの程度ですか?
文書の画質や文字の鮮明さに依存しますが、標準的な印刷物であれば高い精度でテキストを抽出することが可能です。
複数のページを一度に処理できますか?
はい、複数ページのPDFファイルをアップロードすることで、ページごとに順次解析を行い、テキスト化することが可能です。
デーヴァナーガリー文字の合字は正しく表示されますか?
はい、複雑な合字や結合文字をUnicode形式で正しく出力するように最適化されており、テキストエディタでそのまま編集可能です。
Matra記号が正しく認識されない場合はどうすればよいですか?
画像の解像度が低いと認識が難しくなるため、300dpi以上の解像度でスキャンした画像を使用することで精度が大幅に向上します。
ファイルはプライベートに保たれます
画像は可能な限りブラウザ内で処理されます。保存されず、記録もされません。