Librerías que funcionan en tu navegador
Se descargan solo cuando hacen falta, casi todas desde esta misma web. Las dos excepciones se indican en la tabla: vienen de jsDelivr, un servicio público de distribución de librerías de código abierto. En todos los casos son descargas hacia tu navegador; tus archivos no se envían a ningún sitio.
| Librería | Versión | Para qué | Licencia |
|---|---|---|---|
| pdf.js | 6.1.200 | Abrir y leer PDF | Apache-2.0 |
| pdf-lib | 1.17.1 | Crear los PDF que descargas | MIT |
| mammoth.js | 1.12.3 | Leer el texto de los archivos de Word en el comparador | BSD-2-Clause |
| diff-match-patch | 2019 (la última de Google) | Encontrar las diferencias entre dos documentos | Apache-2.0 |
| jsPDF y jsPDF-AutoTable | 4.2.1 y 5.0.8 | Crear el informe de cambios del comparador | MIT |
| OpenCV.js | 4.7.0 | Encontrar los bordes del DNI en la foto y enderezarlo | Apache-2.0 |
| tesseract.js | 7.0.0 | Leer el texto de documentos escaneados y de las matrículas (el núcleo y el idioma español, desde jsDelivr) | Apache-2.0 |
| heic-to | 1.5.2 | Convertir fotos HEIC de iPhone | LGPL-3.0 |
| JSZip | 3.10.1 | Empaquetar varias imágenes en un ZIP | MIT |
| MediaPipe Tasks Vision y sus modelos Face Landmarker y EfficientDet-Lite2 | 1.0.1 | Localizar los ojos y la barbilla en la foto de carnet, y los vehículos de una foto para tapar sus matrículas | Apache-2.0 |
| transformers.js | 4.2.0 | Ejecutar el modelo que quita el fondo de la foto de carnet (desde jsDelivr) | Apache-2.0 |
| ONNX Runtime Web | La que carga transformers.js | El motor sobre el que funciona ese modelo (desde jsDelivr) | MIT |
| MODNet | Xenova/modnet | El modelo que separa a la persona del fondo | Apache-2.0 |
| GSAP y su complemento ScrollTrigger | 3.15.0 | Las animaciones al cambiar de pantalla en las herramientas y al bajar por la portada | Standard «No Charge» de GSAP (no es de código abierto) |
| Inter | La de Google Fonts (v20), solo el alfabeto latino | La tipografía de la web | OFL-1.1 |
Sobre heic-to (LGPL-3.0): se utiliza tal cual, sin modificar, como archivo independiente que la web carga cuando hace falta convertir una foto de iPhone. Puedes obtener su código fuente en el enlace de la tabla, y sustituirlo por otra versión compatible si lo deseas. El texto completo de esta y del resto de licencias viaja dentro del propio archivo de cada librería.
Datos
Para reconocer nombres y apellidos españoles se usan las listas de frecuencia del Instituto Nacional de Estadística (datos a 1 de enero de 2025):
Elaboración propia con datos extraídos del sitio web del INE: www.ine.es
Las listas se usan solo para decidir si una palabra parece un nombre; no contienen datos de personas concretas. Puedes consultar el origen de estas estadísticas en el INE.
Para reconocer nombres de empresas se usa una lista de sociedades elaborada a partir de los índices alfabéticos de sociedades del Boletín Oficial del Registro Mercantil (BORME) de los últimos dos años:
Basado en datos de la Agencia Estatal Boletín Oficial del Estado: www.boe.es
La lista es una elaboración propia, no oficial: se han quitado las formas jurídicas (S.L., S.A.…) y los nombres que se confundirían con palabras corrientes, y la web no guarda los nombres tal cual, sino una «huella» de cada uno que solo sirve para comprobar si unas palabras del documento coinciden con alguna empresa. Solo contiene nombres de sociedades, nunca los datos de sus administradores ni de sus socios.
Qué es nuestro
El diseño, los textos y el código propio de la web (la interfaz de las herramientas, el motor de detección de datos personales y las páginas) están hechos para este proyecto. Consulta el aviso legal para saber qué puedes hacer con ellos.
Gracias
Sin el trabajo de quienes publican estas librerías con licencias abiertas, una web como esta no sería posible: hacen que todo el procesamiento pueda ocurrir dentro del navegador, sin servidores y sin que tus documentos salgan de tu dispositivo.