Hur agenter debiteras
Per token till API-pris
Cursor: "Cloud Agents are charged at API pricing for the selected model … a larger context window can increase token usage and costs." [1]
Plan plus mätbaserad användning
GitHub Copilot cloud agent "uses GitHub Actions minutes and AI credits." [8]
Oavsett modell kostar större kontext mer. Hos Anthropics API prissätts till exempel indata, utdata och cacheläsningar separat per miljon tokens. [2]
Den verkliga enheten: kostnad per mergad PR
En billig körning som kastas bort kostar mer än en dyr körning som mergas. Mät därför det du faktiskt vill ha:
cost per merged PR =
(agent spend + CI spend + review hours × hourly cost)
÷ PRs merged
Example (illustrative):
Story A, vague: 4 runs × $3 + 4 CI runs × $0.40 + 60 min review → 1 PR
Story B, sharp: 1 run × $5 + 1 CI run × $0.40 + 15 min review → 1 PRSiffrorna är påhittade; formen är det inte. Story B:s körning var dyrare, och ändå mycket billigare totalt — mest tack vare raden för granskning.
Multiplikatorerna
Vaga stories
Varje missförstånd blir en omkörning. Se vår guide till stories för kodningsagenter.
Uppgifter som är för stora för en körning
Långa körningar fyller kontexten, och kvaliteten sjunker allteftersom den fylls.
Långsam feedback
Agenten pushar, väntar på CI, fixar, pushar igen — varje loop kostar tokens plus CI-minuter.
Överlappande parallellt arbete
Två agenter i samma filer innebär konfliktlösningskörningar som ingen planerat för.
Om kontextpoängen är Claude Codes dokumentation tydlig: "Claude's context window fills up fast, and performance degrades as it fills." [4] Mer om att skriva arbete som körs rätt första gången i vår guide till stories för kodningsagenter.
Kostnadshävstänger som fungerar
Skarpa stories
Acceptanskriterier och icke-mål minskar fler omkörningar än någon prisändring.
Mindre bitar
En story, en körning, en granskningsbar PR.
Snabba lokala kontroller
Låt agenten hitta problem innan den pushar — se vår guide till direkt feedback.
Anpassa modellens storlek
Använd den starkaste modellen där omdöme krävs och en billigare för mekaniska ändringar.
Budgetering för ett team
Tre modeller dominerar: förbetalda krediter, prenumerationer med användningsgränser och per-plats-planer. Avvägningen är mellan förutsägbarhet och slöseri. Per-plats- och prenumerationsplaner är förutsägbara men betalar för inaktiva platser och slår i taket vid sämsta tänkbara tillfälle. Förbetalda krediter följer den faktiska användningen. En gemensam teampott gör att den som kör fem agenter den här veckan kan låna av den som är ledig; individuella gränser skyddar mot en enskild skenande körning.
Oavsett vad du väljer: budgetera per mergad PR, inte per plats.
Var Aerunit passar in
Aerunit debiteras på det sätt den här guiden rekommenderar att tänka kring kostnad: förbetalda, pay-as-you-go-krediter i en gemensam pott per team, utan prenumeration. Själva agentkörningarna debiteras av Cursor på ditt eget Cursor-konto; Aerunit-krediter täcker Aerunits arbete — att skriva stories, fördela och granska.
Det adresserar också den största multiplikatorn — omkörningar. Story-skrivaren föreslår Linear-ärenden med omfattning, acceptanskriterier och icke-mål, och beroendemedveten fördelning startar bara en del när ärendet som blockerar den har mergats, så agenter bygger inte på kod som ännu inte finns. Automatisk PR-granskning skickar tillbaka upptäckter till agentens session innan du lägger granskningstid på den.
Pay as you go
Förbetalda krediter, en gemensam pott per team, ingen prenumeration.
Färre omkörningar
Skarpare stories och fördelning i beroendeordning.
Granskning innan du spenderar
Automatisk granskning skickar tillbaka upptäckter till agenten innan din granskningstid går in.
Vanliga frågor
Vad kostar en kodningsagent per månad?
Det varierar mycket mellan verktyg och användning. Som en datapunkt rapporterar Anthropic att Claude Code i genomsnitt kostar runt 13 dollar per utvecklare och aktiv dag, och 150–250 dollar per utvecklare och månad, i företagsdrift. Cursor Cloud Agents debiteras enligt API-prissättning för den valda modellen, så kostnaden följer antalet tokens. [5] [1]
Är en billigare modell alltid billigare?
Nej. Om en billigare modell behöver tre körningar för att ge en PR som går att merga, medan en starkare modell klarar det på en, blir den starkare modellen billigare per mergad PR — och den kostar dig även mindre granskningstid. Anpassa modellen efter uppgiften.
Vad är den största dolda kostnaden?
Granskningstid. Den växer med antalet PR:ar och syns aldrig på en faktura. CI-minuter kommer därefter: de mäts utöver din plans ingående kvot, och varje agent-push kan utlösa en körning. [7]
Källor
- [1]Cursor Docs — Cloud Agents (billing)
- [2]Anthropic — API pricing
- [3]Anthropic — Prompt caching
- [4]Claude Code Docs — Best practices
- [5]Claude Code Docs — Manage costs
- [6]OpenAI Developers — Codex pricing
- [7]GitHub Docs — GitHub Actions billing
- [8]GitHub Docs — About Copilot cloud agent
- [9]GitHub Docs — Control workflow concurrency
- [10]Claude Code Docs — Claude Code on the web (limitations)