ImgIngImgIng · A DataDance product中文EN日本語한국어DEESPTFRAbrir OCR de imágenes
ImgIng / OCR de imágenes
PP-OCRv6 · LOCAL OCR

Reconocer texto chino, japonés y latino en imágenes de forma local

La imagen y el texto reconocido no se suben. Los modelos unificados cubren chino simplificado y tradicional, inglés y los principales alfabetos latinos; Profesional y Máximo también incluyen japonés.

Chino · japonés · alfabetos latinosTres niveles PP-OCRv6TXT / Markdown con disposiciónSin subir la imagen

Datos breves sobre la capacidad

Estos hechos describen el producto actual, no el trabajo de la hoja de ruta no enviado.

Procesamiento
Worker local dedicado; la imagen y el texto nunca se suben
Languages
Rápido: chino y alfabetos latinos · Profesional / Máximo: añade japonés · sin coreano
Tiers
PP-OCRv6 tiny / small / medium
Salidas
Copia con disposición, TXT con tabulaciones, tablas Markdown y JSON con geometría

Revisado por el equipo de ingeniería y productos de DataDance · Publicado · Actualizado

Termina en tres pasos

Confirme las configuraciones importantes antes de exportar; el lugar de procesamiento siempre se divulga.

01

Elegir una imagen

Importa una captura, escaneo, imagen de producto o foto; gira o aplica una mejora suave solo cuando haga falta.

02

Elegir nivel de reconocimiento

Rápido es para móvil; Profesional es el predeterminado en escritorio y añade japonés; Máximo se orienta a texto pequeño difícil.

03

Corregir y guardar la disposición

Pulsa un polígono para localizar su línea. Copiar y TXT conservan las filas visuales y separan columnas con tabulaciones; las estructuras estables se convierten en tablas Markdown.

¿Por qué tres niveles PP-OCRv6?

Rápido reduce descarga y memoria para imágenes nítidas y móviles y admite chino, inglés, alemán, español, portugués, francés y otros alfabetos latinos. Profesional equilibra fotos y escaneos y añade japonés. Máximo es solo para escritorio y texto pequeño difícil. Cada nivel fija nombre, tamaño y SHA-256 del modelo.

¿Qué añade ImgIng alrededor del modelo?

Conserva la imagen original, con giro y mejora suave opcional, sin binarización forzada. Después agrupa por geometría las líneas visuales, reconstruye el orden y detecta columnas estables. Copiar y TXT usan tabulaciones, Markdown crea tablas y JSON conserva texto, polígonos, confianza y filas. Cambiar de nivel, borrar o salir termina el Worker.

¿Qué idiomas del sitio reconocen los modelos actuales?

Rápido admite chino simplificado y tradicional, inglés, alemán, español, portugués y francés. Profesional y Máximo añaden japonés. El PP-OCRv6 unificado actual no reconoce coreano.

¿Qué queda fuera de la promesa?

El objetivo son textos impresos claros, capturas, escaneos, etiquetas y diseños mixtos. No se promete escritura manuscrita, semántica de fórmulas ni tablas arbitrarias con celdas combinadas. Los resultados de baja confianza quedan visibles para corregirlos.

El entorno y los modelos se descargan al navegador, pero la imagen y el texto reconocido nunca se suben. En móvil solo aparece Rápido y se limitan entradas muy grandes para evitar cierres de WeChat o Safari.

Updated 2026-08-25 · Live capability detection inside the tool is authoritative

Preguntas frecuentes

Estas respuestas visibles coinciden con el comportamiento actual del producto y los datos estructurados.

¿El OCR sube mi imagen?

No. Decodificación, detección, reconocimiento, reconstrucción y corrección se ejecutan en el navegador actual.

¿Qué nivel debo elegir?

Rápido en móvil, Profesional por defecto en escritorio o para japonés, y Máximo solo para texto pequeño difícil o muchas líneas de baja confianza.

¿Admite todos los idiomas mostrados por el sitio?

Rápido cubre chino, inglés, alemán, español, portugués y francés. Profesional y Máximo añaden japonés. El modelo unificado actual no reconoce coreano.

¿Cómo se copian las tablas?

ImgIng reconstruye filas visuales por geometría. Copiar y TXT insertan tabulaciones entre columnas, Markdown crea tablas cuando el número de columnas es estable y JSON conserva la geometría.

Explorar imágenes

Cada página de tareas documenta configuraciones, límites y consejos de formato reales, no duplicados de palabras clave intercambiadas.