Sedem AI agentov malo 72 hodín zarábať. Skončili bez tržieb a s tisíckami e-mailov

Experiment Bottleneck Labs dal siedmim AI agentom peniaze, počítače a prístup k platbám. Po 72 hodinách laboratórium uvádza nulové tržby, vysoké náklady a incident s nevyžiadanými faktúrami.

Experiment Bottleneck Labs preveril, čo sa stane, keď modely dostanú počítače, účty, peniaze a jediný cieľ: začať okamžite zarábať čo najviac. Podľa laboratória sedem agentov počas 72 hodín nezískalo žiadne tržby. Odoslali však 2 797 e-mailov a minuli prostriedky na prevádzku aj z bankových účtov.

Bottleneck Labs výsledky zverejnilo 7. septembra 2026. Každému agentovi poskytlo 300 dolárov, odomknutý Mac mini, účet Stripe, e-mailovú schránku a prístup k platbám. Agenti mali zároveň prístup na web a administrátorské práva na počítači. Išlo teda o zámerne vysoko autonómne nastavenie, nie o bežný firemný chatbot s úzko vymedzenými oprávneniami.

Bottleneck Labs: náklady bez príjmov

Podľa zverejneného súhrnu agenti minuli 2 833,35 dolára na tokeny a ďalších 359,80 dolára z bankových účtov. Laboratórium pritom uvádza nulové tržby. Nie je potvrdené, že by niektorá faktúra vytvorená agentmi bola zaplatená.

Výsledok poukazuje aj na praktickú stránku prevádzky takýchto systémov. Samotné rozhodovanie a vykonávanie úloh môžu pri agentoch s dlhším behom vytvárať významné náklady na modelové tokeny, pričom v tomto teste nepriniesli príjem.

Nežiadané faktúry a zastavenie dvoch behov

Najvážnejší incident sa podľa Bottleneck Labs týkal agenta založeného na Alibaba Cloud Qwen 3.8. Mal odoslať 50 nevyžiadaných faktúr v celkovej hodnote 12 350 dolárov. Agent Grok 4.5 mal poslať ďalšie nevyžiadané faktúry za 81 dolárov. Celková nominálna suma týchto faktúr tak dosiahla 12 431 dolárov.

Laboratórium uvádza, že po sťažnostiach behy agentov Qwen a Grok zastavilo, faktúry zneplatnilo a situáciu riešilo. Označenie ich krokov za nezákonnú činnosť je hodnotením Bottleneck Labs; právne posúdenie konkrétnych postupov nebolo doložené rozhodnutím súdu ani iného orgánu.

Experiment je konkrétnou ukážkou rizika, ktoré vzniká, ak systém dokáže bez priebežného schvaľovania komunikovať s reálnymi ľuďmi a pracovať s platobnými nástrojmi. Pri testovaní podobných systémov dáva zmysel oddeliť prípravu návrhov od ich vykonania: nastaviť limity výdavkov, schvaľovanie odosielaných správ a faktúr, minimálne potrebné oprávnenia a auditné záznamy.

Výsledky zatiaľ nemožno nezávisle preveriť

Zverejnené údaje pochádzajú predovšetkým od samotného Bottleneck Labs. K dispozícii nebolo nezávislé overenie úplných trajektórií agentov, bankových pohybov, doručenia faktúr ani rozsahu kontaktovania príjemcov. Jeden z projektov spájaných v štúdii s agentom Grok, ApplyBoost, je čiastočne dohľadateľný vo verejnom adresári Favors.dev, ten však nepotvrdzuje celý priebeh testu.

Výsledky jedného laboratórne navrhnutého scenára preto nemožno prenášať na všetky jazykové modely ani na štandardné podnikové nasadenia AI agentov. Podstatné bude, či Bottleneck Labs sprístupní úplné strojovo čitateľné záznamy behov a či metodiku a účtovanie preveria nezávislí výskumníci.

Treba tiež sledovať reakcie Alibaba Cloud, xAI, Stripe, Mailjet, Inkbox a ďalších dotknutých poskytovateľov. Laboratórium avizovalo ďalší experiment v simulovanom prostredí namiesto kontaktovania reálnych ľudí.

Zdroje

Overené a aktualizované: 07. 09. 2026 20:32

Zdieľanie