Co robimy · Agenci AI

Agent AI.
Od kuchni.

Pytanie, rozumowanie, prawdziwe wywołania narzędzi, zgoda człowieka i odpowiedź ze źródłami. Tak pracuje agent pimento: na lokalnych modelach i naszych GPU, krok po kroku.

~30 mld tokenów na naszych GPU w 2026 (szacunek)NVIDIA BlackwellQwen · Gemma · GLM · Mistral
01 · Pytanie → plan

Zanim agent coś zrobi, myśli na głos

Pytanie trafia do modelu razem z personą kancelarii, procedurą i opisem narzędzi. Model rozpisuje rozumowanie w bloku <think> i układa plan: co sprawdzić, którym narzędziem i w jakiej kolejności. Rozumowanie zostaje w logu, do klienta trafia tylko odpowiedź.

  1. 01prompt
  2. 02rozumowanie
  3. 03plan
  4. 04krok 1
dalejPlan gotowy. Pierwsze narzędzie już startuje.
02 · Narzędzia

Prawdziwe wywołania, prawdziwy JSON

Model nie „pamięta” przepisów, tylko je wyszukuje. Każde wywołanie to JSON z argumentami. Wyszukiwanie w wektorach i pełnotekstowe w bazie idą równolegle, a wyniki są łączone i przesiewane. Do kontekstu wracają fragmenty z identyfikatorami, oznaczone jako dane, nie polecenia.

  1. 01argumenty JSON
  2. 02równolegle
  3. 03łączenie
  4. 04do kontekstu
dalejKontekst rośnie z każdym krokiem. Co, gdy przestaje się mieścić?
03 · Pamięć i kontekst

Pamięć krótka i pamięć długa

Krótka pamięć to okno kontekstu: pytanie, kroki i wyniki narzędzi. Przed limitem stare wyniki zamieniają się w ślad wykonania („zrobione, nie powtarzaj”), a ostatnie kroki zostają nietknięte. Długa pamięć to fakty o sprawie w bazie wektorowej, przywoływane wtedy, gdy są potrzebne.

  1. 01okno się zapełnia
  2. 02kompresja
  3. 03pamięć długa
  4. 04kontekst gotowy
dalejSzkic pisma jest gotowy. Wysłać go może tylko człowiek.
04 · Człowiek w pętli

Akcje ze skutkiem czekają na zgodę

Czytać agent może sam. Wysłać pismo, wpisać termin czy zmienić dane może dopiero po zgodzie prawnika. Pętla staje na bursztynowym kroku i czeka. Odrzucenie z uwagą wraca do agenta jako nowe polecenie, a brak decyzji oznacza odmowę.

  1. 01szkic pisma
  2. 02akcja
  3. 03czeka na zgodę
  4. 04decyzja
spróbujzatwierdź albo odrzuć szkic w scenie
dalejKażda z tych decyzji zostaje w dzienniku. Tak jak wszystko inne.
05 · Bezpieczeństwo i audyt

Granice, budżet i ślad każdego kroku

Narzędzia działają w piaskownicy z listą dozwolonych poleceń. Tekst z dokumentów to dane, nie instrukcje, więc „zignoruj polecenia” w aktach niczego nie zmienia. Budżet kroków i bezpiecznik pętli zatrzymują agenta, który kręci się w kółko. Każdy krok trafia do dziennika audytu.

  1. 01piaskownica
  2. 02wstrzyknięcie
  3. 03bezpiecznik pętli
  4. 04dziennik
dalejZ dziennika powstaje coś jeszcze: egzamin dla kolejnej wersji.
06 · Ewaluacja

Każda nowa wersja zdaje egzamin

Prawdziwe rozmowy po przeglądzie przez człowieka trafiają do zestawu testowego. Przed wdrożeniem nowego promptu, procedury albo modelu agent przechodzi cały zestaw: czy cytuje właściwy przepis, czy nie działa bez zgody, czy mieści się w budżecie kroków. Regresja zatrzymuje wdrożenie.

  1. 01zestaw z logów
  2. 02przebieg
  3. 03regresja
  4. 04poprawka
dalejGdzie to wszystko działa? U Ciebie.
07 · Na Twoim sprzęcie

Lokalne modele, Twoje dane zostają w środku

Agent, model, wektory i dziennik działają na serwerach z GPU NVIDIA Blackwell: u nas albo w Twojej serwerowni. Modele open-source (Qwen, Gemma, GLM, Mistral) serwujemy sami, bez zewnętrznych API. Ruch wychodzący jest domyślnie zamknięty, więc pytania, akta i odpowiedzi nie opuszczają sieci.

  1. 01pytanie w sieci
  2. 02prefill
  3. 03decode
  4. 04ruch wychodzący
dalejChcesz zobaczyć tę pętlę na swoich dokumentach?
Porozmawiajmy

Agent, który pracuje u Ciebie.

Zaczynamy od jednego procesu i Twoich dokumentów. Na warsztacie pokażemy tę samą pętlę na Twoich danych: z narzędziami, zgodami i dziennikiem, na naszych GPU albo na Twoich.

  • 01Warsztat: wybieramy proces i narzędzia
  • 02Prototyp agenta na Twoich dokumentach
  • 03Zestaw testowy, zgody, dziennik audytu
  • 04Wdrożenie na lokalnych modelach

scenariusz kancelarii jest przykładowy, czasy i identyfikatory są ilustracją mechaniki