Elegir una imagen
Importa una captura, escaneo, imagen de producto o foto; gira o aplica una mejora suave solo cuando haga falta.
La imagen y el texto reconocido no se suben. Los modelos unificados cubren chino simplificado y tradicional, inglés y los principales alfabetos latinos; Profesional y Máximo también incluyen japonés.
Estos hechos describen el producto actual, no el trabajo de la hoja de ruta no enviado.
Revisado por el equipo de ingeniería y productos de DataDance · Publicado · Actualizado
Confirme las configuraciones importantes antes de exportar; el lugar de procesamiento siempre se divulga.
Importa una captura, escaneo, imagen de producto o foto; gira o aplica una mejora suave solo cuando haga falta.
Rápido es para móvil; Profesional es el predeterminado en escritorio y añade japonés; Máximo se orienta a texto pequeño difícil.
Pulsa un polígono para localizar su línea. Copiar y TXT conservan las filas visuales y separan columnas con tabulaciones; las estructuras estables se convierten en tablas Markdown.
Rápido reduce descarga y memoria para imágenes nítidas y móviles y admite chino, inglés, alemán, español, portugués, francés y otros alfabetos latinos. Profesional equilibra fotos y escaneos y añade japonés. Máximo es solo para escritorio y texto pequeño difícil. Cada nivel fija nombre, tamaño y SHA-256 del modelo.
Conserva la imagen original, con giro y mejora suave opcional, sin binarización forzada. Después agrupa por geometría las líneas visuales, reconstruye el orden y detecta columnas estables. Copiar y TXT usan tabulaciones, Markdown crea tablas y JSON conserva texto, polígonos, confianza y filas. Cambiar de nivel, borrar o salir termina el Worker.
Rápido admite chino simplificado y tradicional, inglés, alemán, español, portugués y francés. Profesional y Máximo añaden japonés. El PP-OCRv6 unificado actual no reconoce coreano.
El objetivo son textos impresos claros, capturas, escaneos, etiquetas y diseños mixtos. No se promete escritura manuscrita, semántica de fórmulas ni tablas arbitrarias con celdas combinadas. Los resultados de baja confianza quedan visibles para corregirlos.
El entorno y los modelos se descargan al navegador, pero la imagen y el texto reconocido nunca se suben. En móvil solo aparece Rápido y se limitan entradas muy grandes para evitar cierres de WeChat o Safari.
Updated 2026-08-25 · Live capability detection inside the tool is authoritative
Estas respuestas visibles coinciden con el comportamiento actual del producto y los datos estructurados.
No. Decodificación, detección, reconocimiento, reconstrucción y corrección se ejecutan en el navegador actual.
Rápido en móvil, Profesional por defecto en escritorio o para japonés, y Máximo solo para texto pequeño difícil o muchas líneas de baja confianza.
Rápido cubre chino, inglés, alemán, español, portugués y francés. Profesional y Máximo añaden japonés. El modelo unificado actual no reconoce coreano.
ImgIng reconstruye filas visuales por geometría. Copiar y TXT insertan tabulaciones entre columnas, Markdown crea tablas cuando el número de columnas es estable y JSON conserva la geometría.
Cada página de tareas documenta configuraciones, límites y consejos de formato reales, no duplicados de palabras clave intercambiadas.