Resumir un documento
Pega un texto o suelta un archivo y recibirás unas pocas frases. El modelo se descarga a tu dispositivo y se ejecuta ahí — el documento nunca sale de esta pestaña.
Suelta aquí un documento
TXT · MD · HTML · PDF — o pega el texto abajo
Pulsar el botón descarga unos 249 MB de motor y modelo. Se descarga una vez y tu navegador lo guarda — el siguiente documento empieza al momento.
El modelo es pequeño: acierta en lo esencial y puede fallar en los detalles. Comprueba en el documento todo lo que importe.
¿A dónde va mi documento?
A ningún sitio. Se lee dentro de esta pestaña y nunca se sube. Aquí eso es lo esencial: los documentos que más se quieren resumir — contratos, informes médicos, borradores inéditos — son justo los que no deberías pegar en el servidor de otra persona.
¿Por qué esta herramienta necesita tarjeta gráfica?
Porque sin ella no hay ningún camino que funcione. La versión ONNX del modelo usa una operación para la que el entorno del procesador no tiene implementación, así que la sesión ni siquiera se abre. Medimos el modelo más parecido que sí funciona en el procesador: 0,9 tokens por segundo, casi cuatro minutos para un documento corto. Preferimos decir que no antes que entregar eso.
¿Qué tal es el resumen?
Capta bien la forma del documento y es poco fiable en los detalles. Es un modelo de 350 millones de parámetros: lo bastante pequeño para descargarlo y ejecutarlo en una pestaña, y lo bastante pequeño para equivocarse en los hechos. En nuestras medidas llegó a desarrollar NADPH con un nombre químico que no existe. Toma el resumen como un mapa del documento, no como un sustituto de leerlo.
¿Qué archivos puedo usar?
Texto plano, Markdown, HTML y PDF. Un PDF solo sirve si tiene una capa real de texto: una página escaneada es una fotografía de palabras y no se puede extraer nada de ella. Si aparece que no se encontró texto, pasa antes el archivo por la herramienta de imagen a texto y pega aquí el resultado.
¿Puede resumir a otro idioma?
No, y lo probamos antes de decidirlo. El resumen siempre vuelve en el idioma en que está escrito el documento. Si se le pide pasar al coreano se derrumba inventando palabras, y en sentido contrario ignora la instrucción. Ofrecer un selector de idioma que falla en dos de nuestros seis idiomas sería peor que no ofrecerlo.
¿Por qué hay un límite superior e inferior?
Un token equivale más o menos a una palabra corta en inglés y a una sílaba en coreano o japonés, por eso una misma página se cuenta de forma muy distinta según el idioma. Por debajo de unos 200 tokens el modelo deja de resumir y empieza a inventar: ante una caja vacía produjo con toda confianza el resumen de una campaña de salud pública que no existía. Por encima de 16.000 se queda sin memoria gráfica. Ambos límites están medidos, y preferimos rechazar antes que resumir en silencio solo la primera parte.
¿Qué modelo es y cuál es su licencia?
LFM2.5-350M de Liquid AI, convertido a ONNX. Lo elegimos tras medir cuatro candidatos con los mismos documentos reales, y fue el único que resumía de verdad en lugar de devolver el texto original. Su licencia es la LFM Open License v1.0: no es copyleft, pero el uso comercial está condicionado a que la organización se mantenga por debajo de los 10 millones de dólares de ingresos anuales. Este sitio está muy lejos de esa línea, y preferimos escribirlo aquí antes que ocultarlo. Los pesos los descarga tu navegador directamente de Hugging Face; nosotros nunca los alojamos ni los redistribuimos.
Otras herramientas
- Unir PDFVarios PDF en uno solo, en el orden que elijas. Las páginas se copian, nunca se rerenderizan.
- Dividir PDFSaca las páginas que quieras o separa cada página en su propio PDF dentro de un ZIP.
- Girar y borrar páginasMira todas las páginas, endereza las que salieron de lado y quita las que sobran.
- Comprimir PDFRecomprime las fotos que hay dentro del PDF. El texto sigue siendo texto.