1. Proces przetwarzania przez AI
- 01Rozszerzenie przechowuje bieżący PDF w przeglądarce i oblicza skrót jego zawartości w celu jednoznacznej identyfikacji dokumentu.
- 02Każde żądanie dotyczące dokumentu kierowane do AI obejmuje pełny, aktualny plik PDF; API ponownie weryfikuje skrót rzeczywistych bajtów i prawo własności.
- 03API wczytuje z PostgreSQL historię bieżącej rozmowy i porządkuje zaznaczony fragment, numer strony lub lokalne segmenty PDF.js.
- 04Cały dokument PDF, historia i bieżące pytanie są wysyłane do skonfigurowanego zewnętrznego dostawcy bezstanowego modelu.
- 05Wyniki modelu są zwracane do interfejsu czytnika; API zapisuje wyniki, które mogą być przechowywane, oraz dane o wykorzystaniu, a następnie zwalnia bajty bieżącego pliku PDF.
2. Treści wykorzystywane przez poszczególne funkcje
- Podsumowanie i słowa kluczowe:Na podstawie bieżącego PDF, czyli oryginalnego, pełnego pliku PDF, generowany jest jeden scalony przegląd całego dokumentu, a wynik jest zapisywany w pamięci podręcznej.
- Pytania i odpowiedzi dotyczące całego tekstu:W każdej turze przesyłane są: pełny plik PDF, historia rozmowy zapisana na serwerze oraz bieżące pytanie.
- Objaśnianie zaznaczonego tekstu:Wysyła cały plik PDF, zaznaczony tekst lub wzór, fizyczny numer strony oraz znormalizowane współrzędne.
- Tłumaczenie zaznaczonego tekstu:Tłumaczone są wyłącznie treści aktualnie zaznaczone przez użytkownika, bez dodatkowego rozszerzania kontekstu na cały dokument.
- Tłumaczenie strona po stronie:Wysyła cały plik PDF oraz segmenty bieżącej strony utworzone lokalnie przez PDF.js, a także zapisuje stan i wyniki każdej strony.
- Automatyczne wyróżnianie:Na podstawie całego PDF identyfikuje metody, wkład, wyniki lub inne wybrane przez użytkownika kategorie kluczowych informacji.
- Opis ilustracji:Po włączeniu tej funkcji do modelu są łącznie wysyłane zatwierdzone przez użytkownika dane pikselowe wycinka strony PDF, numer strony i obszar oraz cały PDF.
3. Modele i dostawcy
Klient może wybierać wyłącznie aliasy modeli udostępnione przez serwer i nie może bezpośrednio przesyłać dowolnego identyfikatora modelu dostawcy. Serwer mapuje aliasy na modele, których zgodność z rzeczywistym protokołem została zweryfikowana. Nie należy zakładać, że dostawca obsługuje Files API, ponowne użycie plików, sesje ani inne niezweryfikowane funkcje.
Dostawca obsługujący dokumenty działa jako usługa bezstanowa, dlatego ten sam PDF może być wielokrotnie przesyłany w ramach kolejnych żądań AI. Dostawcy mogą przetwarzać żądania zgodnie z warunkami świadczenia swoich usług; bez potwierdzenia w umowie i konfiguracji Explixit nie gwarantuje, że dane „nigdy nie będą wykorzystywane do trenowania” ani że będą „przechowywane przez zerowy okres”.
4. Formuły i tekst sformatowany
Explixit w miarę możliwości przekazuje formuły jako treść strukturalną oraz renderuje odpowiedzi modelu przy użyciu Markdown, DOMPurify i lokalnej biblioteki KaTeX. Model może jednak pominąć zmienne, indeksy dolne, transpozycje lub warunki równań, dlatego kluczowe formuły należy porównać z oryginalnym dokumentem PDF.
5. Opisy obrazów
Żądania opisu obrazów powinny zawierać plik PNG lub JPEG wycięty z rzeczywistego obszaru canvas dokumentu PDF, a nie wyłącznie tekst OCR, podpis ilustracji lub stałe dane testowe. Serwer weryfikuje właściciela dokumentu, numer strony, typ MIME, sygnaturę pliku, rozmiar pliku i wymiary obrazu w pikselach.
Explixit nie przechowuje trwale oryginalnych obrazów wyciętych przez użytkownika. Zapisywane są jedynie metadane niezbędne do wskazania źródła objaśnienia oraz odpowiedzi modelu. Przetwarzanie żądań nadal podlega zasadom rejestrowania danych stosowanym przez dostawców modeli i infrastruktury.
6. Ograniczenia generowanych treści
- Model może generować błędy rzeczowe, nieprawidłowe cytowania i wzory lub wnioski, które nie występują w publikacji.
- Jakość skanu, szyfrowanie, rozmiar pliku, liczba stron lub limit kontekstu modelu mogą sprawić, że niektóre pliki PDF będą tymczasowo niedostępne.
- To samo pytanie może przynieść różne wyniki w zależności od modelu, czasu i kontekstu.
- Podświetlenia wskazują sugerowane przez model najważniejsze fragmenty tekstu. Nie stanowią recenzji naukowej ani oceny jakości publikacji.
- Użytkownik powinien weryfikować ważne treści na podstawie oryginalnego PDF, wiarygodnych baz danych i fachowej oceny.
7. Kontrola użytkownika
- Użytkownik decyduje, czy włączyć tryb czytania Explixit dla bieżącego pliku PDF.
- Automatyczne tłumaczenie całego dokumentu można wstrzymać i wznowić, a błąd tłumaczenia jednej strony nie powoduje usunięcia wyników dla pozostałych stron.
- Zadania AI realizowane strumieniowo można anulować; zadanie zakończone błędem lub anulowane nie powinno być przedstawiane jako ukończone.
- Można przeglądać i usuwać ręczne i automatyczne wyróżnienia, komentarze, notatki oraz historię wyjaśnień.
- Użytkownik może wyłączyć tryb czytania i powrócić do natywnego czytnika PDF w Chrome.
8. Bezpieczeństwo i informacje zwrotne
Klucz API jest przechowywany wyłącznie po stronie serwera. Ekran błędu nie powinien wyświetlać klucza, wewnętrznego stosu wywołań ani z góry ustalonej odpowiedzi zastępczej. W sprawie problemów z modelem, naruszeń praw i incydentów bezpieczeństwa można skontaktować się pod adresem explixitai@outlook.com。