1. Flujo de procesamiento de AI
- 01La extensión conserva el PDF actual en el navegador y calcula el hash de su contenido para establecer la identidad del documento.
- 02Cada solicitud de AI relacionada con un documento incluye el PDF completo actual; la API vuelve a verificar el hash y la titularidad de los bytes reales.
- 03La API carga de PostgreSQL el historial de la conversación actual y organiza la selección, el número de página o los segmentos locales de PDF.js.
- 04El PDF completo, el historial y la pregunta actual se envían al proveedor externo de modelos sin estado configurado.
- 05La respuesta del modelo se muestra en la interfaz de lectura; la API guarda los resultados cuya conservación está permitida y los datos de uso, y libera los bytes del PDF de esta solicitud.
2. Contenido utilizado por las distintas funciones
- Resúmenes y palabras clave:Utiliza el PDF original completo del PDF actual para generar una única vista general consolidada de todo el documento y almacenar el resultado en caché.
- Preguntas y respuestas sobre el texto completo:En cada interacción se envían el PDF completo, el historial de la conversación almacenado en el servidor y la pregunta actual.
- Explicación del texto seleccionado:Envía el PDF completo, el texto o la fórmula seleccionados, el número de página físico y las coordenadas normalizadas.
- Traducción del texto seleccionado:Solo se traduce el contenido seleccionado en ese momento, sin añadir contexto del texto completo.
- Traducción página por página:Envía el PDF completo y los segmentos de la página actual generados localmente por PDF.js, y guarda el estado y los resultados de cada página.
- Resaltado automático:Identificar, a partir del PDF completo, los métodos, las contribuciones, los resultados u otros tipos de información destacada que seleccione el usuario.
- Descripción de la imagen:Cuando la función está activada, se envían conjuntamente al modelo los píxeles del recorte de la página de PDF, el número de página y la región que haya confirmado el usuario, junto con el PDF completo.
3. Modelos y proveedores
El cliente solo puede seleccionar los alias de modelos publicados por el servidor; no puede enviar directamente un ID de modelo arbitrario del proveedor. El servidor asigna cada alias a un modelo validado mediante el protocolo real. No se debe presuponer que el proveedor admite Files API, la reutilización de archivos, las sesiones ni ninguna otra función no verificada.
El proveedor de documentos funciona como un servicio sin estado, por lo que un mismo PDF puede enviarse varias veces en sucesivas solicitudes de AI. Los proveedores pueden procesar las solicitudes conforme a sus condiciones de servicio. Sin pruebas contractuales y de configuración, Explixit no garantiza que los datos «no se usarán nunca para entrenamiento» ni que haya una «retención cero».
4. Fórmulas y texto enriquecido
Explixit procura transmitir las fórmulas como contenido estructurado y utiliza Markdown, DOMPurify y una versión local de KaTeX para renderizar las respuestas del modelo. Aun así, el modelo puede omitir variables, subíndices, transposiciones o condiciones de las ecuaciones, por lo que las fórmulas importantes deben cotejarse con el PDF original.
5. Descripciones de imágenes
Las solicitudes de descripción de imágenes deben incluir un PNG o JPEG recortado del canvas real de PDF, en lugar de enviar únicamente el OCR, el pie de imagen o datos de prueba fijos. El servidor verifica la titularidad del documento, el número de página, el tipo MIME, la firma del archivo, el tamaño y las dimensiones en píxeles.
Explixit no almacena de forma persistente las imágenes originales de los recortes realizados por el usuario; solo conserva los metadatos necesarios sobre la fuente de la explicación y la respuesta del modelo. El tratamiento de las solicitudes sigue sujeto a las políticas de registro de los proveedores de modelos y de la infraestructura.
6. Limitaciones de los resultados
- El modelo puede generar errores factuales, citas incorrectas, fórmulas erróneas o conclusiones de artículos que no existen.
- La calidad del escaneado, el cifrado, el tamaño del archivo, el número de páginas o los límites de contexto del modelo pueden hacer que algunos PDF no estén disponibles temporalmente.
- Una misma pregunta puede dar resultados distintos según el modelo, el momento y el contexto.
- Los subrayados representan los puntos de lectura que recomienda el modelo; no constituyen una revisión por pares ni una valoración de la calidad del artículo.
- El usuario debe verificar la información importante consultando el PDF original y bases de datos fiables, y aplicando su criterio profesional.
7. Control humano
- El usuario decide si activa el modo de lectura de Explixit para el PDF actual.
- La traducción automática del texto completo puede pausarse y reanudarse; si falla una página, no se borran las demás.
- Las tareas en streaming de AI se pueden cancelar; si fallan o se cancelan, no deben presentarse como resultados completados.
- Los resaltados manuales y automáticos, los comentarios, las notas y el historial de explicaciones se pueden consultar y eliminar.
- El usuario puede salir del modo de lectura y volver al lector de PDF nativo de Chrome.
8. Seguridad y comentarios
La clave de API solo se almacena en el servidor. La interfaz de error no debe mostrar la clave, la traza interna de la pila ni una respuesta alternativa predefinida. Para problemas con el modelo, infracciones e incidentes de seguridad, puede contactar con explixitai@outlook.com。