Indeksowanie plików

Zanim jakiekolwiek narzędzie AI będzie mogło odpowiadać na pytania dotyczące pliku, Studycamp musi go odczytać i zindeksować. Zwykle zajmuje to od kilku sekund do kilku minut, w zależności od rozmiaru pliku.

Jak to działa

  1. Przesyłasz plik. Jego status zaczyna się jako oczekujący.
  2. Studycamp wyodrębnia tekst, dzieli go na fragmenty i generuje osadzenia dla każdego fragmentu. Status zmienia się na w trakcie przetwarzania.
  3. Po zakończeniu status staje się gotowy i każde narzędzie AI w tej przestrzeni roboczej może z niego korzystać, w tym cytaty z numerami stron w Czat.
  4. Jeśli coś pójdzie nie tak, status zmienia się na błąd.

Co powinieneś zobaczyć

Pillka statusu na pliku: Indeksowanie podczas oczekiwania lub przetwarzania, Gotowy gdy jest użyteczny, lub stan niepowodzenia z opcją ponownego próby w przypadku błędu. Panel Baza wiedzy pokazuje ten sam status dla pliku.

Dobrze wiedzieć

  • Indeksowanie odbywa się automatycznie po przesłaniu. Nie musisz go uruchamiać.
  • Bardzo krótkie pliki (poniżej kilku dziesięciu znaków tekstu do wyodrębnienia) mogą nie generować żadnych użytecznych fragmentów, na przykład zeskanowany obraz bez warstwy tekstowej.
  • Cytaty w Czat zawierają numer strony, z której pochodzi fragment, co działa tylko po zakończeniu indeksowania.

Jeśli to nie działa

Zatrzymane na “przetwarzaniu” przez długi czas: duże pliki (ponad 100 stron) mogą zająć kilka minut. Jeśli minęło ponad 10 minut, odśwież stronę; jeśli nadal jest zatrzymane, usuń i przesył ponownie.

Status pokazuje “błąd”: plik może być uszkodzony, chroniony hasłem lub w formacie, z którego Studycamp nie może wyodrębnić tekstu (jak czysty skan obrazu bez OCR). Spróbuj ponownie wyeksportować go jako standardowy PDF lub DOCX.

Czat mówi, że nie może znaleźć niczego istotnego: sprawdź, czy plik jest oznaczony jako Gotowy, a nie tylko przesłany. Nieindeksowany plik nie ma fragmentów do przeszukiwania.

esc