Które zadania oddać agentowi AI — test z pięciu pytań
Pierwsze zadanie agenta przesądza, czy w firmie zostanie cokolwiek. Pięć pytań, które je wybierają, przykłady zadań zdanych i oblanych oraz właściwa kolejność.
Decyzja o tym, co agent AI dostanie do roboty jako pierwsze, zwykle nie jest decyzją. Ktoś pokazuje demo, ktoś inny mówi „to spróbujmy z ofertami”, i tydzień później firma ma agenta przy ofertach.
Rzecz w tym, że to jedyny moment, w którym cała reszta jest jeszcze otwarta. Pierwsze zadanie ustawia zdanie, które zespół będzie powtarzał o AI przez następny rok — a te zdania są krótkie i trwałe: „to działa” albo „to zgaduje”.
Poniżej test z pięciu pytań, przykłady zadań zdanych i oblanych oraz kolejność dalszych kroków.
To nie jest ten sam wybór co wybór procesu
Warto rozdzielić dwie decyzje, bo mylą się nagminnie.
Pierwsza dotyczy tego, od czego zacząć wdrożenie AI jako całości: który obszar pracy wziąć, kto za niego odpowiada, po czym poznacie, że wyszło. To decyzja o procesie i o firmie, zapada na spotkaniu i zwykle ktoś ją zapisuje.
Druga jest węższa i zapada później. Wewnątrz wybranego procesu jest wiele osobnych czynności, a agent dostaje jedną albo dwie. Tej decyzji prawie nikt nie podejmuje świadomie — zapada przy konfiguracji, przez osobę, która akurat ją klika, i nikt jej nigdzie nie notuje.
Ten tekst jest o tej drugiej.
Pięć pytań
Żadne z nich nie dyskwalifikuje zadania samodzielnie. Liczy się bilans: im więcej odpowiedzi „nie”, tym dalej w kolejce.
Czy skutek da się cofnąć — i kto go cofa. Nie „czy teoretycznie istnieje sposób”, tylko czy osoba, która zauważy błąd, odwróci go sama, w minutę, bez zgłaszania czegokolwiek komukolwiek. Zmiana statusu zlecenia — tak. Wiadomość, która wyszła do klienta — nie, niezależnie od tego, co obiecuje przycisk „cofnij wysyłkę”.
Jak często to się dzieje. Zadanie wykonywane codziennie daje wam ocenę jeszcze w tym samym tygodniu. Przy zadaniu miesięcznym nikt do następnego razu nie pamięta, co poprzednio poszło nie tak, więc każde wykonanie zaczyna się od zera. Częstotliwość waży tu więcej niż wielkość oszczędności, bo na starcie nie kupujecie czasu, tylko wiedzę o tym, gdzie agent jest dobry, a gdzie zmyśla.
Czy wynik da się sprawdzić w kilkanaście sekund. To pytanie wypada z listy najczęściej i kosztuje najwięcej. Sprawdzanie jest częścią zadania dopóty, dopóki nikt agentowi nie ufa — a na początku nie ufa nikt. Jeżeli weryfikacja wyniku trwa tyle samo co wykonanie zadania ręcznie, zysku nie ma. Jest nowa czynność.
Czy dane potrzebne do zadania są już uporządkowane. Chodzi o wąski wycinek: te dwa, trzy zbiory, z których agent będzie czytał. Jeżeli ta sama informacja mieszka w trzech miejscach i nikt nie wie, które jest prawdziwe, agent nie wybierze lepiej niż człowiek — wybierze szybciej i tym samym pewnym tonem. Zanim ruszy takie zadanie, trzeba przygotować dane firmy pod AI przynajmniej w tym jednym miejscu.
Ile osób musi zmienić nawyk. Zadanie, przy którym inaczej zaczyna pracować jedna osoba, ruszy w poniedziałek. Zadanie wymagające, żeby cały zespół zaczął wypełniać nowe pole, nie ruszy wcale — i nie będzie to wina agenta. Na pierwszy raz wybierzcie czynność, którą i tak wykonuje jeden człowiek.
Zadania, które ten test przechodzą
Wspólny mianownik: agent czyta dużo, pisze mało albo nic, a wynik widać na jeden rzut oka. Część z nich wygląda przez to jak zwykły czat i nie jest to zarzut — to ten sam agent i te same dostępy, tylko z zakręconym kurkiem po stronie zapisu.
Odpowiadanie na pytania o stan rzeczy. Ile otwartych zleceń ma ten klient, kiedy była u niego ostatnia wizyta, co się zmieniło w tej sprawie od piątku. Zdarza się wiele razy dziennie, sprawdzenie to jedno wejście w rekord, a nawyk zmienia wyłącznie osoba, która przestaje szukać ręcznie.
Podsumowanie dnia albo tygodnia dla jednej osoby. Kierownik serwisu dostaje rano listę tego, co stoi i dlaczego. Błąd kosztuje minutę czytania, a braki widać natychmiast, bo odbiorca zna temat lepiej niż agent.
Szkic, który i tak przechodzi przez człowieka. Notatka ze zlecenia, odpowiedź na typowe zapytanie, opis usterki złożony z rozmowy i zdjęć. Skutek jest odwracalny z definicji: dopóki ktoś nie kliknie „wyślij”, nie wyszło nic.
Znalezienie dokumentu albo zapisu w procedurze. Zadanie o zerowym koszcie błędu — albo agent trafił, albo szukacie dalej tak jak dotychczas.
Zadania, które go oblewają
Wysyłka czegokolwiek na zewnątrz. Maile, oferty, potwierdzenia terminów. Pierwsze pytanie od razu na „nie”, a przy zadaniu, którego skutku nie da się cofnąć, zatwierdzanie akcji przez człowieka zostaje na stałe. Jako pierwsze zadanie daje więc najwięcej pracy przy najmniejszej nauce.
Masowe porządkowanie bazy wstecz. Kusi, bo wygląda na jednorazowy zysk. Ma dwie wady naraz: zdarza się raz, więc niczego was nie uczy, a wyniku nie da się sprawdzić inaczej niż przeglądając wszystko, co zostało zmienione.
Kwalifikacja albo ustalanie priorytetów dla całego zespołu. Tu wypada piąte pytanie. Żeby to miało sens, cały zespół musi zaufać kolejności, której sam nie ustawił — a zaufanie buduje się wcześniej, na zadaniach, przy których jest tanie.
Wszystko, co ktoś potrafi zapisać jako kroki na kartce. Jeżeli droga do celu jest znana i za każdym razem taka sama, to nie jest zadanie dla agenta, tylko dla zwykłej automatyzacji — tańszej, przewidywalnej i prostszej w diagnostyce.
Kolejność, która działa
Trzy etapy. To nie jest harmonogram, tylko zależność: każdy etap produkuje dowód potrzebny do następnego.
Najpierw czytanie i podsumowywanie. Agent nie zapisuje niczego. Ten etap odpowiada na pytanie, czy dane są w porządku — a odpowiedź bywa ciekawsza, niż ktokolwiek się spodziewał. Jeżeli agent odpowiada źle, kosztuje to na tym etapie zdziwienie, a nie sprzątanie.
Potem propozycje do zatwierdzenia. Agent przygotowuje zapis, człowiek klika. Najciekawsze na tym etapie nie jest to, ile propozycji przechodzi, tylko co poprawiacie w tych odrzuconych. Poprawki układają się w listę informacji, których agent nie miał, a które ktoś w firmie ma w głowie — i jest to zwykle lista konkretniejsza niż cokolwiek, co wyszło z rozmów przed startem.
Na końcu działanie samodzielne, i tylko tam, gdzie jest tanio. Warunkiem przejścia nie jest upływ czasu, tylko nuda: dwa poprzednie etapy przestały przynosić niespodzianki. Dotyczy to zawsze pojedynczej czynności, nie zadania w całości — w obrębie jednego zadania jeden krok może iść już sam, a następny dalej przez człowieka.
Podsumowanie
Pierwsze zadanie dla agenta wybiera się raz i rzadko świadomie, a to ono decyduje, czy będzie drugie. Pięć pytań — odwracalność skutku, częstotliwość, czas sprawdzenia wyniku, stan danych i liczba osób zmieniających nawyk — zajmuje kwadrans i wystarcza, żeby oddzielić zadania efektowne od tych, po których coś zostaje.
Reszta jest kolejnością: czytanie, potem propozycje do zatwierdzenia, na końcu samodzielność w miejscach, w których błąd jest tani. Szerszy kontekst — co agenci robią, gdzie zawodzą i jakich mechanizmów kontroli wymagają — opisujemy w przewodniku agenci AI w firmie.
Częste pytania
- Jakie zadanie oddać agentowi AI jako pierwsze?
- Takie, którego skutek da się cofnąć w minutę, które zdarza się codziennie, którego wynik sprawdzicie w kilkanaście sekund, które korzysta z danych już uporządkowanych i przy którym nawyk zmienia jedna osoba. W praktyce najczęściej wychodzi z tego odpowiadanie na pytania o stan rzeczy albo poranne podsumowanie dla jednej osoby.
- Dlaczego pierwszym zadaniem agenta nie powinna być wysyłka do klienta?
- Bo skutku nie da się cofnąć po drugiej stronie, więc zatwierdzanie przez człowieka zostaje przy takim zadaniu na stałe. Dostajecie najwięcej pracy przy najmniejszej nauce, a na starcie chodzi o coś odwrotnego — o sprawdzenie, gdzie agent jest dobry, przy błędach, które nic nie kosztują.
- Czy warto oddać agentowi zadanie wykonywane raz w miesiącu?
- Rzadko. Między jednym a drugim wykonaniem nikt nie pamięta, co poprzednio poszło nie tak, więc ocena opiera się na wrażeniach zamiast na powtórzeniach. Nawet jeżeli oszczędność wygląda na większą, lepiej zacząć od czynności powtarzalnej i wrócić do tej rzadkiej, gdy będzie już czym mierzyć.
Czytaj dalej
Uprawnienia agenta AI — co mu wolno i jak to ograniczyć
Agent dziedziczy uprawnienia jakiegoś konta i całe pytanie brzmi, jakiego. Jak oddzielić odczyt od zapisu, co z działaniami nieodwracalnymi i co sprawdzić.
Agent AI, automatyzacja i chatbot — trzy różne rzeczy pod jedną nazwą
Automatyzacja wykonuje zapisaną ścieżkę, chatbot odpowiada, agent sam dobiera kroki. Czym się różnią, kiedy który jest właściwym wyborem i ile kosztuje pomyłka.
Zatwierdzanie akcji AI przez człowieka — jak to wygląda w praktyce
Human-in-the-loop brzmi jak żargon, a jest mechanizmem. Co musi być na ekranie zatwierdzenia, dlaczego zbiorcza akceptacja nie działa i kiedy ją poluzować.