Szczegółowy harmonogram stawek za użytkowanie
Ta strona szczegółowo wyjaśnia, jak Neotask oblicza opłaty oparte na użytkowaniu. Większość użytkowników planu Individual nigdy nie zobaczy tych opłat. Ten opis jest dla zaawansowanych użytkowników Enterprise, których agenci działają na dużą skalę.
Przegląd planów i sposobu działania rozliczeń znajdziesz w artykule Rozliczenia i plany.
Jak obliczane jest użytkowanie
Za każdym razem, gdy Twój agent przetwarza wiadomość, zużywa tokeny AI (wejściowe i wyjściowe). Koszt tych tokenów zależy od tego, którego modelu AI używa Twój agent. System śledzi cztery typy tokenów oddzielnie, każdy z własną stawką:
- Tokeny wejściowe: prompt i kontekst wysyłane do modelu
- Tokeny wyjściowe: odpowiedź generowana przez model
- Tokeny odczytu cache: tokeny serwowane z cache promptów (tańsze niż wejściowe)
- Tokeny zapisu cache: tokeny zapisywane do cache promptów do przyszłego ponownego użycia
Formuła kosztu tokena
Koszt = (tokeny wejściowe / 1 000 000) x stawka wejściowa
+ (tokeny wyjściowe / 1 000 000) x stawka wyjściowa
+ (tokeny odczytu cache / 1 000 000) x stawka odczytu cache
+ (tokeny zapisu cache / 1 000 000) x stawka zapisu cache
Źródło: server/src/config/modelPricing.ts
Stawki tokenów modeli AI
Są to stawki per token dla każdego obsługiwanego modelu AI. Wszystkie stawki są w USD za 1 milion tokenów.
Anthropic Claude
| Model | Wejście | Wyjście | Odczyt cache | Zapis cache |
|---|---|---|---|---|
| Claude Opus 4.6 | 15,00 USD | 75,00 USD | 1,50 USD | 18,75 USD |
| Claude Sonnet 4.5 | 3,00 USD | 15,00 USD | 0,30 USD | 3,75 USD |
| Claude Haiku 4.5 | 0,80 USD | 4,00 USD | 0,08 USD | 1,00 USD |
| Claude 3.5 Sonnet | 3,00 USD | 15,00 USD | 0,30 USD | 3,75 USD |
| Claude 3.5 Haiku | 0,80 USD | 4,00 USD | 0,08 USD | 1,00 USD |
| Claude 3 Opus | 15,00 USD | 75,00 USD | 1,50 USD | 18,75 USD |
| Claude 3 Sonnet | 3,00 USD | 15,00 USD | 0,30 USD | 3,75 USD |
| Claude 3 Haiku | 0,25 USD | 1,25 USD | 0,03 USD | 0,30 USD |
OpenAI
| Model | Wejście | Wyjście | Odczyt cache | Zapis cache |
|---|---|---|---|---|
| GPT-4o | 2,50 USD | 10,00 USD | 1,25 USD | 2,50 USD |
| GPT-4o Mini | 0,15 USD | 0,60 USD | 0,075 USD | 0,15 USD |
| GPT-4 Turbo | 10,00 USD | 30,00 USD | 5,00 USD | 10,00 USD |
| GPT-4 | 30,00 USD | 60,00 USD | 15,00 USD | 30,00 USD |
| o1 | 15,00 USD | 60,00 USD | 7,50 USD | 15,00 USD |
| o1-mini | 3,00 USD | 12,00 USD | 1,50 USD | 3,00 USD |
| o3-mini | 1,10 USD | 4,40 USD | 0,55 USD | 1,10 USD |
Google Gemini
| Model | Wejście | Wyjście | Odczyt cache | Zapis cache |
|---|---|---|---|---|
| Gemini 2.0 Flash | 0,10 USD | 0,40 USD | 0,025 USD | 0,10 USD |
| Gemini 1.5 Pro | 1,25 USD | 5,00 USD | 0,3125 USD | 1,25 USD |
| Gemini 1.5 Flash | 0,075 USD | 0,30 USD | 0,01875 USD | 0,075 USD |
Źródło: server/src/config/modelPricing.ts linie 8-42
Opłaty platformy i narzuty
Istnieje kilka odrębnych opłat, które mogą mieć zastosowanie w zależności od sposobu używania agenta. Nie jest to jedna stała stawka; każda z nich ma zastosowanie w różnych sytuacjach.
1. Narzut trybu kredytowego (klucz systemowy): 20%
Gdy używasz zarządzanych kluczy API Neotask (tryb klucza systemowego), na surowym koszcie tokena jest nakładany narzut 20%. Pokrywa to zarządzanie kluczami API, automatyczne przełączanie między dostawcami, kierowanie modeli i infrastrukturę.
Jeśli używasz trybu BYOK (Bring Your Own Keys), koszty tokenów trafiają bezpośrednio do Twojego dostawcy AI, ale pobierana jest opłata platformowa 20% z Twoich kredytów.
Źródło: server/src/config/modelPricing.ts linia 53, CREDIT_MODE_MARKUP_PCT = 0.20
2. Opłata platformy za nadwyżkę (zmienna)
Gdy Twoje użytkowanie przekracza Twój dołączony pulę kredytów, pozostały koszt staje się nadwyżką. Na kwocie nadwyżki jest nakładana opłata platformy. Stawka zależy od poziomu planu:
| Poziom | Opłata za nadwyżkę |
|---|---|
| Individual | 25% |
| Business | 15% |
| Enterprise | 10% |
Opłata za nadwyżkę jest pobierana tylko od kwoty przekraczającej pulę kredytów. Użytkowanie w ramach puli nie podlega dodatkowej opłacie.
Nadwyżka jest automatycznie pobierana z karty, gdy niezliczona kwota osiągnie 10 USD (minimalna opłata Stripe: 0,50 USD).
Źródło: server/src/config/planConfig.ts, overageFeePct i overageChargeThreshold
3. Narzut za automatyzację: progresywny od 50% do 33%
Gdy Twoi agenci uruchamiają zautomatyzowane zadania (zaplanowane zadania, zadania cron, cykliczne automatyzacje), na surowym koszcie tokena jest nakładany dodatkowy narzut za automatyzację. Wynika to z faktu, że zautomatyzowani agenci zastępują ręczną pracę. Działają bez nadzoru, zgodnie z harmonogramem, obsługując zadania, które wymagałyby w innym przypadku pracowników.
Narzut za automatyzację używa progresywnych progów (jak podatek dochodowy). Płacisz wyższą stawkę od pierwszych dolarów zautomatyzowanego użytkowania i niższą stawkę w miarę wzrostu zautomatyzowanych wydatków. Nie ma efektów klifu; każdy dolar jest pobierany tylko według stawki swojego progu.
| Skumulowane zautomatyzowane wydatki (na cykl rozliczeniowy) | Marginalna stawka narzutu |
|---|---|
| 0 USD - 10 USD | 50% |
| 10,01 USD - 25 USD | 45% |
| 25,01 USD - 50 USD | 40% |
| 50,01 USD - 100 USD | 37% |
| 100,01 USD+ | 33% |
Źródło: server/src/config/automationMarkup.ts linie 38-44, DEFAULT_AUTOMATION_BRACKETS
4. Narzut za zadanie kodowania: stałe 50%
Zautomatyzowane zadania obejmujące narzędzia kodowania (odczyty plików, zapisy, wykonywanie kodu, polecenia bash) są pobierane według stałego narzutu 50%. Progresywna redukcja nie ma zastosowania do zadań kodowania; zawsze wynosi 50% niezależnie od skumulowanych wydatków.
Narzędzia kodowania: exec, read, write, bash, code
Źródło: server/src/config/automationMarkup.ts linia 49, CODING_TASK_MARKUP_RATE = 0.50
Jak koszty się kumulują
Opłaty te mogą się kumulować w zależności od sytuacji:
Interaktywny czat (tryb klucza systemowego):
- Surowy koszt tokena + 20% narzut trybu kredytowego
- Brak narzutu za automatyzację (nie jest zautomatyzowany)
Interaktywny czat (tryb BYOK):
- Surowy koszt tokena + 20% opłata platformowa z kredytów
Zautomatyzowane zadanie cron (tryb klucza systemowego):
- Surowy koszt tokena + 20% narzut trybu kredytowego + narzut za automatyzację (50%-33%)
Zautomatyzowane zadanie kodowania (tryb klucza systemowego):
- Surowy koszt tokena + 20% narzut trybu kredytowego + 50% narzut za zadanie kodowania
Przykład rozliczenia automatyzacji
Zaplanowane zadanie cron działa codziennie. Agent AI potrzebuje około 2-3 godzin na ukończenie pracy. Zadanie zużywa 10 USD w surowych tokenach (rzeczywisty koszt dla dostawcy AI).
Podział:
- Koszt tokenów: 10 USD (przekazywany do dostawcy AI; to jest koszt obliczeń)
- Narzut za automatyzację: 10 USD x 50% = 5 USD (opłata platformy za uruchomienie zadania bez nadzoru)
- Całkowita opłata: 15 USD
10 USD pokrywa rzeczywiste obliczenia AI, które zużył Twój agent. 5 USD to opłata za automatyzację. Platforma uruchomiła zadanie zgodnie z harmonogramem, monitorowała wykonanie, obsługiwała ponowne próby i dostarczyła wyniki -- wszystko bez konieczności, aby ktokolwiek był przy komputerze.
Dlaczego automatyzacja kosztuje więcej: Zautomatyzowani agenci zastępują pracę ludzką. Zadanie cron, które każdego ranka sprawdza Twoją analitykę, tworzy raporty, monitoruje zapasy lub przetwarza przychodzące zamówienia, wykonuje pracę, która w innym przypadku wymagałaby czasu osoby. Narzut za automatyzację odzwierciedla wartość tego wykonania bez nadzoru i maleje, im więcej automatyzujesz, nagradzając skalę. Dzierżawca wydający ponad 100 USD/cykl na zautomatyzowane zadania płaci tylko 33% narzutu zamiast 50%.
Doładowania kredytów
Możesz w dowolnym momencie zakupić dodatkowe kredyty, aby zapłacić z góry za użytkowanie:
- Minimalne doładowanie: 5 USD
- Maksymalne doładowanie: 10 000 USD
- Kredyty nigdy nie wygasają. Pozostają na koncie do momentu wykorzystania.
- Automatyczne doładowanie: Opcjonalnie skonfiguruj automatyczne doładowania, gdy saldo spadnie poniżej progu (domyślnie: saldo 2 USD wyzwala doładowanie 10 USD)
Kredyty doładowania są zużywane po wyczerpaniu puli kredytów, a przed naliczeniem nadwyżki. Oznacza to, że doładowania działają jako bufor między dołączonymi kredytami a opłatami za nadwyżkę.
Źródło: server/src/services/overageCharger.ts, server/src/services/balanceService.ts
Kolejność odliczania kredytów
Gdy Twój agent ukończy zadanie, koszt jest odliczany w tej kolejności:
- Kredyty rejestracyjne (jednorazowe $10 przy rejestracji, nie resetują się)
- Saldo doładowania (zakupione kredyty, nigdy nie wygasają)
- Nadwyżka (pobierana z karty z zastosowaną opłatą platformy)
Oznacza to, że dołączone kredyty są zawsze zużywane najpierw, następnie wszelkie zakupione doładowania, i dopiero po wyczerpaniu obu zaczyna się rozliczanie nadwyżki.
Źródło: server/src/services/balanceService.ts linie 240-286
Kontrole budżetu
Użytkownicy Enterprise mają wbudowane egzekwowanie budżetu:
- Globalny dzienny budżet: Domyślnie 500 USD/dzień (konfigurowalny). Po przekroczeniu brama agenta automatycznie się wyłącza, aby zapobiec niekontrolowanym kosztom.
- Limity wydatków per agent: Ustaw dzienny limit dla każdego indywidualnego agenta. Gdy agent osiągnie swój limit, jego sesje są automatycznie wstrzymywane.
- Automatyczne wyłączenie: Konfigurowalne. Włącz lub wyłącz automatyczne wyłączenie bramy przy przekroczeniu budżetu.
- Egzekwowanie w czasie rzeczywistym: Budżet jest sprawdzany co 30 sekund.
Źródło: Neotask-Electron/src/main/budgetEnforcer.ts, Neotask-Electron/src/main/agentSpendLimitStore.ts
Wyświetlanie użytkowania
Śledź to wszystko w czasie rzeczywistym na stronie Użytkowanie w aplikacji desktopowej:
- Podział na poziomie tokenów według modelu, dostawcy, agenta, kanału i daty
- Podział kosztów: koszty wejścia, wyjścia, odczytu cache i zapisu cache wyświetlane oddzielnie
- Szczegółowość czasowa: dzisiaj, ostatnie 24h, 7 dni, 30 dni, 365 dni lub niestandardowy zakres
- Atrybucja per agent: dokładnie sprawdź, który agent co zużywa
- Atrybucja per kanał: podział kosztów według kanału komunikacyjnego
- Atrybucja per dostawca: koszt według dostawcy AI (Anthropic, OpenAI, Google)
- Eksport CSV/JSON do zewnętrznej analizy
Więcej informacji o zarządzaniu subskrypcją znajdziesz w artykule Rozliczenia i plany.