OCR y Reconocimiento de Documentos
Salidas de reconocimiento óptico, ALTO XML y PDF con capacidad de búsqueda.
Tus archivos se procesan íntegramente en tu navegador web mediante HTML5 Canvas y WebAssembly. Cero datos abandonan tu dispositivo.
Omite las colas de subida y descarga. Las conversiones ocurren localmente a la máxima velocidad del hardware de tu máquina sin límites de servidor.
Cumple con las especificaciones oficiales de la ISO, W3C e IETF para garantizar la compatibilidad de salida en los sistemas operativos modernos.
Comparativa de formatos y especificaciones técnicas
| Formato de salida | Tipo MIME | Especificación | Tipo |
|---|---|---|---|
| PDF escaneado | application/pdf | ISO-32000-2 | PDF escaneado basado en mapas de bits |
| IMG Imagen escaneada | image/jpeg | W3C-PNG | Imagen de documento escaneado |
| TXT Texto plano | text/plain | RFC-4180-CSV | Texto plano sin formato |
| DOCX Documento de Word | application/vnd.openxmlformats-officedocument.wordprocessingml.document | ISO-IEC-29500 | Documento OpenXML de Microsoft Word |
| HOCR HTML | text/html | HOCR-SPEC-12 | Marcado espacial hOCR |
| PNG Imagen | image/png | W3C-PNG | Gráficos de red portátiles |
| JPG Imagen JPEG | image/jpeg | W3C-PNG | Joint Photographic Experts Group |
| PDF Documento | application/pdf | ISO-32000-2 | Portable Document Format |
Especificaciones técnicas y desglose de códecs
Extracción de Texto OCR y Disposición Espacial
La conversión OCR asigna glifos reconocidos, niveles de confianza y coordenadas de cajas delimitadoras en documentos estructurados con texto indexable.
0 bytes subidos a servidores externos. Todo el procesamiento se realizó de forma local en el entorno seguro de tu navegador.