To aplikacja wewnętrzna z dostępem po logowaniu, więc nie podajemy adresu. Mechanikę, liczby i zrzuty ekranu pokazujemy na rozmowie. Technicznie jest to najbardziej zaawansowany projekt we flocie: około 66 000 linii kodu i cztery kontenery na produkcji.
Czat ma 23 narzędzia, którymi steruje sam: tworzenie i aktualizacja wpisu, czytanie długiej treści po częściach, dopinanie plików, tłumaczenie, szukanie oraz pobieranie treści z dziesięciu źródeł. Załączniki przetwarza per typ — obraz jako obraz, audio i wideo przez ffmpeg do transkrypcji z cięciem na segmenty, dokument przez ekstrakcję tekstu z limitem znaków. Plik nieczytelny dostaje w prompcie jawny błąd i zakaz zgadywania treści.
Osobny worker prowadzi kolejkę źródeł, pobiera napisy albo transkrybuje modelem, klasyfikuje treść, generuje wpis, ponawia błędy i deduplikuje wyniki. Obok stoi brama sterująca agentem kodującym w trybie headless, z asynchronicznym API zadań.
Wybór modeli opiera się na pomiarze. Dla czatu: 288 prób, zero błędów, 4,2 s na turę i 0,0061 USD za turę — dwa razy taniej i szybciej niż poprzedni wybór. Dla generowania treści: wierność 100 i 99,4 procent w dwóch niezależnych przebiegach oraz 41 z 41 faktów krytycznych za każdym razem.

