Robocikowo>ROBOCIKOWO
Sztuczna Inteligencja

Tokenmaxxing: firmy palą budżety na AI i nie umieją ich rozliczyć

Pan Robocik12 września 2026 · 3 min czytania
Tokenmaxxing: firmy palą budżety na AI i nie umieją ich rozliczyć

VentureBeat opisał 7 września 2026 problem, który dorobił się już własnej nazwy: tokenmaxxing, czyli gwałtowny wzrost zużycia tokenów bez ROI, który by go uzasadniał. Problem w tym, że prawie nikt nie potrafi wykazać, co z tych wydatków wynika.

207 mld USDPrognozowane wydatki na oprogramowanie agentowe w 2026 roku — wzrost o 139% wobec 86,4 mld USD rok wcześniejGartner, za VentureBeat

Najważniejsze w skrócie

  • Prognoza Gartnera: 207 mld USD na oprogramowanie agentowe w 2026, wzrost o 139%
  • Uber wyczerpał roczny budżet na kodowanie AI do kwietnia 2026, cztery miesiące po wdrożeniu
  • Nowy limit w Uberze: 1500 USD miesięcznie na pracownika
  • Everlaw: projekt za 3500 USD tokenów skrócił wdrożenie z 9,5 do 2,5 osobomiesiąca
  • Warstwy routingu oferują już Databricks, Amazon Bedrock, Azure AI Foundry i Merge

Uber wyczerpał roczny budżet w cztery miesiące

Uber udostępnił Claude Code inżynierom w grudniu 2025. Do kwietnia 2026 cały roczny budżet na kodowanie AI był wyczerpany. Zużycie tokenów rosło, ale nie dało się go powiązać z lepszym produktem.

Nie ma jeszcze związku między tym rozdmuchanym zużyciem a dostarczaniem faktycznie lepszych produktów.

Andrew Macdonald, prezes i dyrektor operacyjny Ubera.

1500 USDMiesięczny limit wydatków na AI przypadający na jednego pracownika Ubera po wyczerpaniu budżetuVentureBeat

Everlaw pokazuje drugą stronę

Kontrprzykładem jest Everlaw, gdzie rachunek daje się domknąć. Max Christoff, dyrektor techniczny, podaje projekt infrastruktury w Javie: wydanie 3500 USD na tokeny skróciło wdrożenie z 9,5 do 2,5 Osobomiesiąc: Jednostka pracochłonności: praca jednego inżyniera przez jeden miesiąc. Pozwala porównywać projekty o różnej wielkości zespołu.. Przy większym produkcie koszt sięgnął 27–40 tys. USD, ale zakres pracy spadł z 90–100 osobomiesięcy do 19.

WymiarUberEverlaw
Zakresfirmowe wdrożenie od grudnia 2025pojedyncze projekty inżynierskie
Punkt odniesienia ustalony z górynietak
Koszt tokenówroczny budżet wyczerpany do kwietnia 20263500 USD oraz 27–40 tys. USD
Wynikbrak wykazanego związku z jakością produktu9,5 → 2,5 i 90–100 → 19 osobomiesięcy
Reakcjalimit 1500 USD na pracownika miesięcznie
Te same narzędzia, przeciwny wniosek

Różnica nie leży w narzędziu, tylko w tym, że ktoś z góry określił punkt odniesienia. Bez niego rachunek za tokeny jest nierozstrzygalny.

Everlaw liczy tak każdy projekt. Uber nie ustalił wartości bazowej przed wdrożeniem, więc nie miał wobec czego porównać rachunku za tokeny.
Znaczenie symboli
realna oszczędność projektu
szacowany koszt zadania bez AI, ustalony przed startem prac
rachunek za zużyte tokeny
koszt pozostałej pracy inżynierów

Warstwa routingu jako odpowiedź

Najczęściej proponowanym rozwiązaniem jest routing modeli — dobieranie modelu i harnessu do zadania, zamiast puszczania wszystkiego przez najdroższy dostępny.

Jak działa warstwa routingu

Zapytanieinżynier zleca zadanie
Klasyfikacjawarstwa ocenia trudność i typ zadania
Wybórdobierany jest model i harness o odpowiednim koszcie
Wykonaniezadanie trafia do wybranego modelu
Rozliczeniezużycie przypisywane jest do zespołu i budżetu

Databricks wprowadził Smart Routing w Unity AI Gateway, z zapowiedzią automatycznego doboru modelu i harnessu do każdego zadania kodowania. Podobne mechanizmy mają Amazon Bedrock i Azure AI Foundry, a na rynku działa też Merge.

Dlaczego to ważne?

Uber i Everlaw używały tych samych narzędzi i doszły do przeciwnych wniosków, bo tylko jedna z tych firm ustaliła wcześniej, ile dane zadanie kosztowałoby bez AI.

Przy prognozie 207 mld USD to przestaje być kwestią higieny finansowej, a staje się warunkiem utrzymania budżetów w kolejnym roku.

Co dalej?

  • Limit 1500 USD na pracownika w Uberze jest twardym testem — pokaże, czy ograniczenie zużycia obniży jakość, czy tylko rachunek
  • Prognoza Gartnera zakłada wzrost o 139% rok do roku, więc presja na wykazanie zwrotu narasta szybciej niż same wydatki
  • Żaden z opisanych dostawców routingu nie publikuje jeszcze porównywalnych danych o realnych oszczędnościach u klientów

Źródła

Udostępnij ten artykuł