Wie Agenten abgerechnet werden
Pro Token zu API-Preisen
Cursor: "Cloud Agents are charged at API pricing for the selected model … a larger context window can increase token usage and costs." [1]
Plan plus gemessene Nutzung
GitHub Copilot cloud agent "uses GitHub Actions minutes and AI credits." [8]
Egal bei welchem Modell: größere Kontexte kosten mehr. Bei Anthropics API etwa werden Eingabe, Ausgabe und Cache-Lesezugriffe getrennt pro Million Tokens bepreist. [2]
Die eigentliche Einheit: Kosten pro gemergtem PR
Ein billiger Lauf, der verworfen wird, kostet mehr als ein teurer, der gemergt wird. Miss also, was du wirklich willst:
cost per merged PR =
(agent spend + CI spend + review hours × hourly cost)
÷ PRs merged
Example (illustrative):
Story A, vague: 4 runs × $3 + 4 CI runs × $0.40 + 60 min review → 1 PR
Story B, sharp: 1 run × $5 + 1 CI run × $0.40 + 15 min review → 1 PRDie Zahlen sind erfunden, das Muster nicht. Der Lauf von Story B war teurer und insgesamt trotzdem deutlich günstiger — vor allem wegen der Review-Zeile.
Die Multiplikatoren
Vage Stories
Jedes Missverständnis bedeutet einen Nachbesserungslauf. Siehe unseren Guide zu Stories für Coding-Agenten.
Aufgaben, die für einen Lauf zu groß sind
Lange Läufe füllen den Kontext, und die Qualität sinkt, je voller er wird.
Langsames Feedback
Der Agent pusht, wartet auf CI, behebt, pusht erneut — jede Schleife kostet Tokens plus CI-Minuten.
Überlappende Parallelarbeit
Zwei Agenten in denselben Dateien bedeuten ungeplante Konfliktlösungsläufe.
Zum Kontextpunkt ist die Claude-Code-Dokumentation deutlich: "Claude's context window fills up fast, and performance degrades as it fills." [4] Mehr dazu, wie man Aufgaben so schreibt, dass sie gleich beim ersten Mal richtig laufen, in unserem Guide zu Stories für Coding-Agenten.
Kostenhebel, die wirken
Klare Stories
Akzeptanzkriterien und Nicht-Ziele senken Nachbesserungsläufe stärker als jede Preisänderung.
Kleinere Slices
Eine Story, ein Lauf, ein reviewbarer PR.
Schnelle lokale Checks
Lass den Agenten Probleme finden, bevor er pusht — siehe unseren Guide zu sofortigem Feedback.
Modellgröße passend wählen
Nutze das stärkste Modell, wo Urteilsvermögen zählt, und ein günstigeres für mechanische Änderungen.
Budgetierung für ein Team
Drei Modelle dominieren: vorausbezahlte Guthaben, Abonnements mit Nutzungslimits und Pro-Platz-Pläne. Der Trade-off liegt zwischen Planbarkeit und Verschwendung. Pro-Platz- und Abo-Pläne sind planbar, zahlen aber für ungenutzte Plätze und stoßen im ungünstigsten Moment an ihre Grenzen. Vorausbezahlte Guthaben folgen der tatsächlichen Nutzung. Ein gemeinsamer Team-Pool erlaubt es, dass sich jemand mit fünf Agenten diese Woche von jemandem im Urlaub leihen kann; individuelle Limits schützen vor einem einzelnen außer Kontrolle geratenen Lauf.
Wofür du dich auch entscheidest: budgetiere pro gemergtem PR, nicht pro Platz.
Wo Aerunit ansetzt
Aerunit wird genau so abgerechnet, wie dieser Guide es empfiehlt: vorausbezahlte Pay-as-you-go-Guthaben in einem gemeinsamen Pool pro Team, ohne Abonnement. Die Agentenläufe selbst werden von Cursor über dein eigenes Cursor-Konto abgerechnet; Aerunit-Guthaben decken Aerunits Arbeit — Stories schreiben, verteilen und reviewen.
Es wirkt außerdem gegen den größten Multiplikator — Nachbesserungsläufe. Der Story-Writer schlägt Linear-Issues mit Umfang, Akzeptanzkriterien und Nicht-Zielen vor, und das abhängigkeitsbewusste Dispatching startet eine Slice erst, wenn das blockierende Issue gemergt ist, sodass Agenten nicht auf noch nicht existierendem Code aufbauen. Automatisches PR-Review schickt Befunde zurück in die Session des Agenten, bevor du Review-Zeit investierst.
Pay as you go
Vorausbezahlte Guthaben, ein gemeinsamer Pool pro Team, kein Abonnement.
Weniger Nachbesserungsläufe
Klarere Stories und Dispatching in Abhängigkeitsreihenfolge.
Review vor der Ausgabe
Automatisches Review schickt Befunde an den Agenten zurück, bevor deine Review-Zeit anfällt.
Häufige Fragen
Was kostet ein Coding-Agent pro Monat?
Das variiert stark je nach Tool und Nutzung. Als Datenpunkt: Anthropic berichtet, dass Claude Code in Unternehmenseinsätzen im Schnitt rund 13 US-Dollar pro Entwickler und aktivem Tag bzw. 150–250 US-Dollar pro Entwickler und Monat kostet. Cursor Cloud Agents werden zu API-Preisen des gewählten Modells abgerechnet, die Kosten folgen also den genutzten Tokens. [5] [1]
Ist ein günstigeres Modell immer billiger?
Nein. Wenn ein günstigeres Modell drei Durchläufe braucht, um einen mergbaren PR zu liefern, ein stärkeres aber nur einen, ist das stärkere pro gemergtem PR billiger — und kostet dich zusätzlich weniger Review-Zeit. Wähle das Modell passend zur Aufgabe.
Was ist die größte versteckte Kostenquelle?
Review-Zeit. Sie wächst mit dem PR-Volumen und taucht nie auf einer Rechnung auf. CI-Minuten kommen direkt danach: Sie werden über das im Plan enthaltene Kontingent hinaus abgerechnet, und jeder Agent-Push kann einen Lauf auslösen. [7]
Quellen
- [1]Cursor Docs — Cloud Agents (billing)
- [2]Anthropic — API pricing
- [3]Anthropic — Prompt caching
- [4]Claude Code Docs — Best practices
- [5]Claude Code Docs — Manage costs
- [6]OpenAI Developers — Codex pricing
- [7]GitHub Docs — GitHub Actions billing
- [8]GitHub Docs — About Copilot cloud agent
- [9]GitHub Docs — Control workflow concurrency
- [10]Claude Code Docs — Claude Code on the web (limitations)