zh

图片转文字 (OCR)

从照片或扫描件中识别文字,在浏览器中本地OCR处理,无需上传。

正在你的设备上本地处理 ...

文档语言
  • Deutsch
  • English
  • Français
  • Español
  • Italiano
  • Português
  • Nederlands
  • Polski
  • Русский
  • Українська
  • Čeština
  • Slovenčina
  • Română
  • Magyar
  • Ελληνικά
  • Türkçe
  • Svenska
  • Dansk
  • Norsk
  • Suomi
  • Català
  • Hrvatski
  • Српски
  • Български
  • العربية
  • עברית
  • فارسی
  • اردو
  • हिन्दी
  • বাংলা
  • 日本語
  • 한국어
  • 简体中文
  • 繁體中文
  • ไทย
  • Tiếng Việt
  • Bahasa Indonesia
  • Bahasa Melayu
  • Afrikaans
  • አማርኛ
  • অসমীয়া
  • Azərbaycanca
  • Азәрбајҹанҹа (Кирил)
  • Беларуская
  • བོད་སྐད་
  • Bosanski
  • Brezhoneg
  • Cebuano
  • ᏣᎳᎩ
  • Corsu
  • Cymraeg
  • ދިވެހި
  • རྫོང་ཁ
  • Esperanto
  • Eesti
  • Euskara
  • Føroyskt
  • Filipino
  • Frysk
  • Gàidhlig
  • Gaeilge
  • Galego
  • Ἀρχαία Ἑλληνικά
  • ગુજરાતી
  • Kreyòl ayisyen
  • Հայերեն
  • ᐃᓄᒃᑎᑐᑦ
  • Íslenska
  • Basa Jawa
  • ಕನ್ನಡ
  • ქართული
  • Қазақша
  • ខ្មែរ
  • Кыргызча
  • Kurmancî
  • ລາວ
  • Latina
  • Latviešu
  • Lietuvių
  • Lëtzebuergesch
  • മലയാളം
  • मराठी
  • Македонски
  • Malti
  • Монгол
  • Māori
  • မြန်မာ
  • नेपाली
  • Occitan
  • ଓଡ଼ିଆ
  • ਪੰਜਾਬੀ
  • پښتو
  • Runa Simi
  • संस्कृतम्
  • සිංහල
  • Slovenščina
  • سنڌي
  • Shqip
  • Srpski (latinica)
  • Basa Sunda
  • Kiswahili
  • ܠܫܢܐ ܣܘܪܝܝܐ
  • தமிழ்
  • Татарча
  • తెలుగు
  • Тоҷикӣ
  • ትግርኛ
  • Lea faka-Tonga
  • ئۇيغۇرچە
  • Oʻzbekcha
  • Ўзбекча (Кирил)
  • ייִדיש
  • Yorùbá

你的文件

    正在你的设备上本地处理 ...

    0%

    我的文件会被上传吗?

    不会。一切都在你的浏览器中运行,你的文件永不离开你的设备。这一点如何验证

    无需上传100% 本地处理
    内容只属于你第三方无法访问
    Hosted in GermanyGlobal Content Delivery
    经独立审计TLS A+ · 标头 A+

    OCR(光学字符识别)将图片中的文字转换为可选取、可编辑的真实文本。拍摄或扫描发票、信件或书页,即可获得可搜索、可复制、可进一步处理的TXT文件。识别引擎采用开源的Tesseract,与其他工具一样,完全以WebAssembly在浏览器中运行。

    从列表中选择文档语言,支持100多种语言,涵盖德语、英语及欧洲语言,以及俄语、阿拉伯语、希伯来语、印地语、日语、韩语和中文等。每种语言均以其自身名称显示,方便快速定位。选择正确的语言,能确保该文字体系的字母、音调符号和特殊字符被准确识别。首次使用时,浏览器会从本站一次性下载识别引擎和所选语言模型(几MB,同源,无外部服务器);此后即可离线使用。可一次拖入多张图片,每张均生成独立的TXT文件。

    识别质量几乎完全取决于原始图片质量:清晰、端正、高对比度的印刷文字图片识别效果极佳;倾斜、模糊或昏暗的图片效果明显较差。印刷文字识别可靠,手写文字不支持。分栏、表格和复杂排版将以连续文本输出,顺序通常正确,但视觉结构会丢失。请务必核查结果,尤其是数字部分。

    技术规格

    技术规格
    输入格式JPG, JPEG, PNG, WEBP, BMP
    自动转换GIF, TIFF, ICO, SVG, HEIC, PDF, DOCX, DDS, HDR, PCX, WBMP
    输出格式TXT
    批量处理支持
    处理方式在浏览器中本地处理 (WebAssembly)
    文件上传

    三步完成

    1. 拖入图片或扫描件。
    2. 从列表中选择文档语言(支持100多种语言)。
    3. 将识别出的文字下载为TXT。

    限制: 可从清晰的图片(JPG, PNG, WebP, BMP)中识别印刷文字并输出为TXT;手写文字无法可靠识别。支持100多种语言及多种文字体系(拉丁、西里尔、希腊、阿拉伯、希伯来、印度系文字、CJK等),请选择与文档匹配的语言。分栏/表格/排版结构不保留,仅输出连续文本。识别并非完全准确,请特别核查数字和专有名词。首次使用时下载引擎和语言模型(几MB,同源),此后离线可用。扫描PDF请使用专属的「PDF OCR」工具(可搜索PDF或纯文本)。

    常见问题

    我的图片会被上传吗?

    不会。文字识别完全在浏览器本地运行(WebAssembly),图片不会离开你的设备。这对处理敏感文件尤为重要。

    支持哪些语言?

    支持100多种语言及多种文字体系,除德语和英语外,还包括法语、西班牙语、俄语、阿拉伯语、希伯来语、印地语、日语、韩语、中文等。请从列表中选择正确语言,确保特殊字符和字母被准确识别。

    能识别手写文字吗?

    不能,只能可靠识别印刷文字。该引擎无法准确识别手写文字。

    为什么识别结果有时会出错?

    OCR质量取决于图片质量:清晰、端正、高对比度的图片识别效果好;倾斜/模糊/昏暗的图片效果较差。请务必核查数字和专有名词。

    可以识别扫描PDF吗?

    可以,请使用专属的「PDF OCR」工具:它可以直接将扫描PDF变为可搜索文件或输出纯文本,无需转换为单张图片。

    相关工具

    图片压缩 · EPUB 转 TXT · 证件照 35x45 · PDF OCR 可搜索化 · PDF 转 JPG