01. Sygnał
Wiadomość w skrzynce, spadek dostępności API, zapytanie klienta, zdarzenie w repozytorium.
Gorgos jest systemem operacyjnym dla firmy, w której pracę wykonuje AI: obserwuje dane, proponuje działania, sprawdza w polityce, co wolno, wykonuje to, co wolno samodzielnie, i zatrzymuje resztę przed Twoim podpisem. Każde działanie zostawia dowód.
Dziś jest wewnętrzną alfą. Działa u nas, na wybranych ścieżkach, pod naszym nadzorem. Nie mamy klientów komercyjnych Gorgosa ani przychodu z niego. Mówimy to na początku, bo dojrzałość powiedziana wprost jest warta więcej niż dojrzałość odkryta później.
Pętla operacyjna
Większość systemów agentowych kończy na etapie czwartym, w którym działanie już się wykonało. Dwa ostatnie etapy są tym, co budujemy: dowód i decyzja człowieka.
Wiadomość w skrzynce, spadek dostępności API, zapytanie klienta, zdarzenie w repozytorium.
AI CEO zna stan firmy, ustala, co jest dziś ważne, i deleguje zadanie.
Przeglądana konfiguracja, nie krucha instrukcja w prompcie. Dopuszcza cykle, krytykę i podgrafy.
Agenci ról z określonym mandatem, pamięcią, narzędziami i miarami.
Poczta, kalendarz, telefonia, infrastruktura, repozytoria, przeglądarka, CRM.
Testy regresyjne, skany bezpieczeństwa i niezależna ocena dołączone do decyzji.
Zatwierdzasz, zmieniasz, odrzucasz albo poprawiasz politykę, która o tym zdecydowała.
Polityka i poziomy
Poziomy są zapisane w jednym pliku konfiguracyjnym, wersjonowanym jak kod. Przykłady poniżej sprawdzamy skryptem przed publikacją: jeśli rozjadą się z tym, co zwraca prawdziwa bramka, publikacja się nie udaje.
POZIOM 1
Działania odwracalne i wewnętrzne. Wykonują się od razu i trafiają do dziennika decyzji.
POZIOM 2
Przygotowane w całości, razem z dowodami, i wstrzymane do podpisu. To, co tu trafia, ustala polityka właściciela; poniżej te bramkowane w naszym profilu.
POZIOM 3
Odrzucane przed kolejką. Nie kolejkuje, nie szkicuje. Ominięcie wymaga świadomego, zapisanego działania właściciela.
Agent może poprawiać sposób, w jaki pracuje. Nie może przepisać reguł, według których jest oceniany.
Wyjaśnienia
Cztery rzeczy, które albo są, albo ich nie ma.
Jeden plik decyduje, co agent może zrobić sam.
Zapis, który odpowiada, kto pozwolił, a nie tylko co się stało.
Sam, bramka właściciela, nigdy.
Artykuły 4, 12, 14, 26 i 50 z datami.
Dwa tygodnie obserwacji, zanim cokolwiek zostanie zablokowane.
Gdzie w tym jesteśmy
Notatki
Komisja Rozwoju i Bezpieczeństwa Sztucznej Inteligencji zaczyna nadzór nad polskim rynkiem AI. Co realnie może sprawdzić w firmie, która używa agentów AI, i co warto mieć przygotowane.
Digital Omnibus przepisał artykuł 4: z obowiązku zapewnienia wystarczającego poziomu kompetencji na obowiązek podejmowania działań wspierających ich rozwój. Co to zmienia w praktyce.
Artykuł 12 i artykuł 26 AI Act mówią o rejestrowaniu zdarzeń i przechowywaniu logów. Co to znaczy w praktyce dla firmy, która uruchomiła agentów.
Przepis mówi o osobach fizycznych, które mogą zrozumieć system, wychwycić jego błędy i przerwać jego działanie. Co to znaczy, gdy nie masz działu compliance.
Kontakt
Interaktywne demonstracje są na razie po angielsku: guided demos (EN).