Was die Kosten eines KI-Agenten wirklich treibt.
Die Modell-API ist meist der kleinste Posten im Budget eines KI-Agenten. Bezahlt wird in Wirklichkeit die Ingenieurarbeit rund um das Gespräch — Telefonie und Integrationen, Leitplanken, Auswertung und das Tuning an echtem Verkehr. Ein produktiver Agent v1 liegt bei $25,000–60,000; dieser Leitfaden zeigt, was darüber entscheidet, wo in diesem Band Sie liegen, und wie die Zahl schriftlich fix wird, bevor irgendetwas gebaut wird.
Indikative Bänder für 2026, kein Angebot. Was die Zahl bewegt, ist Komplexität — Integrationen, Compliance, Datenmigration und die Zuverlässigkeit, die Sie ab Tag eins brauchen. Jedes Projekt wird nach einem bezahlten Discovery-Sprint fix und schriftlich bepreist, und der Sprint wird vollständig auf die Umsetzung angerechnet.
Fünf Treiber setzen jedes Agenten-Budget.
Seniorität des Teams
Einen Agenten vorzuführen kann jeder; produktiv zu werden sind die letzten zehn Prozent — Unterbrechungen, seltene Absichten, der Moment der Übergabe. Diese letzte Strecke ist Senior-Arbeit: Gesprächsdesign, Disziplin bei der Auswertung und das Urteilsvermögen zu wissen, wann der Agent aufhören sollte zu sprechen. Die Agents von LeadTrack AI wurden über mehr als 100'000 Live-Anrufe gehärtet, und diese Härtung ist Ingenieurarbeit, kein Glück.
Was ihn bewegt- Wer die Gesprächslogik entwirft und prüft
- Auswertungsdisziplin, bevor echte Anrufer kommen
- Das Urteil darüber, wann der Agent an einen Menschen übergeben muss
Wo die Zahl landetEin erfahrener KI- und Machine-Learning-Engineer kostet $9,000 im Monat in einem dedizierten Engagement — die Spitze unserer Spezialistensätze, und das mit Absicht. Die Zusammensetzung nach Seniorität wird im Discovery-Sprint benannt und in ein einziges fixes Angebot eingepreist, nie in einen offenen Tagessatz.
Umfang des Gesprächs
Der grösste Treiber ist, was der Agent übernehmen soll. Ein einzelnes, klar definiertes Gespräch — einen eingehenden Lead qualifizieren, einen Termin buchen — kostet einen Bruchteil eines offenen Assistenten. Mandantenfähige Plattformen, Skripte pro Kunde und zusätzliche Sprachen weiten den Umfang jeweils erneut.
Was ihn bewegt- Wie viele Absichten und Abläufe der Agent von Anfang bis Ende beherrscht
- Ein Unternehmen, oder mandantenfähig mit Skripten pro Mandant
- Sprachen, Kanäle und Stimmen, die er unterstützen muss
Wo die Zahl landetEin produktiver Agent v1 — KI-Engineer + Backend, 10–20 Wochen — liegt bei $25,000–60,000, mit einem einzelnen, klar definierten Gespräch nahe der Untergrenze und einer mandantenfähigen, mehrsprachigen Plattform an der Obergrenze. Der Discovery-Sprint legt fest, welche Gespräche v1 übernimmt, und das Angebot bepreist genau diese Zeile, schriftlich.
Integrationen und Telefonie
Das Modell ist der kleinste Posten im Budget eines Agenten; im Bindegewebe steckt der grösste Teil der Ingenieurarbeit. Bei LeadTrack AI haben wir rund um die Voice-Agents die Telefonie-Anbindung, das sofortige automatische Anwählen, die Qualifizierungslogik pro Mandant, die Live-Übergabe an Menschen und die Gesprächsanalyse gebaut — diese Plattformarbeit hat das Budget bestimmt, nicht das Modell.
Was ihn bewegt- Telefonie und Echtzeit-Audio-Infrastruktur
- Wie tief CRM und Pipeline angebunden werden
- Live-Übergabe mit angehängtem Transkript und Kontext
Wo die Zahl landetEin Preis pro Integration wäre hier nicht ehrlich — eine moderne CRM-API und ein Carrier-Stack mit eigenem Routing sind zwei verschiedene Projekte. Was einen Agenten in seinem Band nach oben bewegt, ist das Bindegewebe um das Modell herum, nicht das Modell selbst. Alles wird im Discovery-Sprint gegen Ihren tatsächlichen Stack geschnitten — Ihr CRM, Ihre Telefonie, Ihre Pipeline-Definitionen — nicht gegen eine generische Konnektorenliste.
Leitplanken und Compliance
Was darf der Agent sagen, tun und aufzeichnen? Die Einwilligung zur Aufzeichnung, der Speicherort der Daten, harte Grenzen für das, was er zusagen darf, und Eskalationsregeln für Gespräche neben dem Skript sind alles Ingenieurarbeit — und sie wegzulassen ist die teure Variante, später mit Zinsen bezahlt.
Was ihn bewegt- Einwilligung zur Gesprächsaufzeichnung und Datenschutzregeln
- Harte Grenzen dafür, was der Agent versprechen oder tun darf
- Eskalationsregeln für Gespräche neben dem Skript
Wo die Zahl landetLeitplanken haben keinen Standardpreis — die Einwilligung zur Aufzeichnung ist in einem Markt ein Häkchen und im nächsten Architektur. Sicher ist die Richtung: Sie fügen Umfang hinzu, und sie wegzulassen ist die teure Variante, die man später bezahlt. Anforderungen an Einwilligung, Speicherort und Eskalation gehen im Discovery-Sprint in den Umfang ein, vor dem Angebot und nicht nach einem Vorfall.
Laufendes Tuning und Pflege
Agents sind nie fertig — sie werden getunt. Echte Transkripte bringen Randfälle hervor, die keine Spezifikation vorhergesehen hat; Modelle werden aktualisiert; Skripte entwickeln sich weiter. Planen Sie den Loop ein, nicht den Launch: Auf FeelEats Prognoseplattform war das Modell in Wochen fertig, während die Drift-Überwachung und die operative Schicht darum herum Monate brauchten — und in dieser Schicht hielt der Nutzen.
Was ihn bewegt- Transkript-Reviews und Auswertungszyklen
- Modell-Updates und die Weiterentwicklung der Skripte
- Nutzungsabhängige Modell- und Telefoniegebühren bei Ihrem Anrufvolumen
Wo die Zahl landetCare-Pläne kosten $550 im Monat für 15 Stunden bei einem stabilen Produkt, $1,050 für 30 Stunden, solange es sich noch bewegt, und $1,950 für 60 Stunden mit einem namentlich benannten Entwickler bei geschäftskritischen Systemen. Auf jeden Launch folgt zuerst eine Gewährleistung von 30 Tagen, und der jährliche Support liegt typischerweise bei 15–20% der ursprünglichen Umsetzungskosten. Daneben stehen nutzungsabhängige Modell- und Telefoniegebühren — sie werden von Ihren Anbietern an Ihrem eigenen Anrufvolumen gemessen, also schätzen wir sie im Discovery-Sprint für Ihren Verkehr, statt einen Satz zu veröffentlichen, der nicht Ihrer wäre. Indikatives Band, kein Angebot — die fixe Zahl kommt aus einem bezahlten Discovery-Sprint und wird auf die Umsetzung angerechnet.
Lesen Sie das für ein echtes Projekt?
Sprechen wir es durch — ohne PitchVon unbekannt zu einem fixen Angebot, in drei Schritten.
Bezahlter Discovery-Sprint
$2,900–4,900 über 1–2 Wochen, vollständig auf die anschliessende Umsetzung angerechnet. Wir schneiden den Agenten gemeinsam zu: welche Gespräche er übernimmt, Ihre Eskalationsregeln, die Systeme, die er berühren muss, die Leitplanken, die er einhalten muss. Sie bezahlen den Sprint, weil sein Ergebnis für sich allein Wert hat — ein Umfang, den Sie überallhin mitnehmen könnten. Der erste Workshop und eine grobe Einschätzung sind kostenlos — in der Regel innerhalb von drei Arbeitstagen.
Fixes, transparentes Angebot
Der Sprint endet mit einer Zahl, schriftlich: feste Meilensteine und ein fixes Budget gegen den vereinbarten Umfang. Keine offenen Tagessätze — ändert sich der Umfang später, ändert sich das Angebot transparent mit, und Sie geben die Differenz vorher frei.
Laufende Pflege
Nach dem Launch beginnt der Tuning-Loop: Transkript-Review, Weiterentwicklung der Skripte, Modell-Updates — geplant als Pflege, nicht als Notfallrechnung. Produktive Agents verdienen sich Vertrauen so, wie LeadTrack AI es getan hat: Gespräch für Gespräch, gemessen.
Keine offenen Tagessätze, keine Überraschungsrechnungen. 100% des Codes, der Rechte und der Infrastruktur gehen an Sie über, und wir unterzeichnen auf Wunsch ein NDA. Indikatives Band, kein Angebot — die fixe Zahl kommt aus einem bezahlten Discovery-Sprint und wird auf die Umsetzung angerechnet.
Wohin Agenten-Budgets auf echten Projekten tatsächlich geflossen sind.
LeadTrack AI — eine mandantenfähige Voice-Agent-SaaS
Für LeadTrack AI (Australien) haben wir die komplette Plattform gebaut: KI-Voice-Agents, sofortiges automatisches Anwählen, Qualifizierungslogik pro Mandant, Übergabe an Menschen und Gesprächsanalyse. Das Modell war nie das Budget — die Telefonie, die Mandantenfähigkeit und die Auswertungsarbeit darum herum waren es, gehärtet über mehr als hunderttausend Live-Anrufe.
FeelEat Nachfrageprognose — die Ops-Schicht war das Budget
Die klarste Kostenlektion in unserem KI-Portfolio: Das Prognosemodell war in Wochen fertig, während die Ingestion-Pipelines, die Drift-Überwachung und die Planungsansichten, die jemand um acht Uhr morgens aufruft, Monate brauchten. In diese operative Schicht floss das Budget — und deshalb hat sich die Plattform im ersten Quartal bezahlt gemacht.
Fragen, die Teams zu den Kosten von KI-Agenten stellen
Schreiben Sie es in ein Briefing. Ein Senior-Engineer — kein Vertriebler — antwortet innerhalb eines Werktags.
Was kostet die Entwicklung eines KI-Agenten?
Ein produktiver Agent v1 liegt bei $25,000–60,000 — KI-Engineer + Backend über 10–20 Wochen — mit einem einzelnen, klar definierten Gespräch nahe der Untergrenze und einer mandantenfähigen, mehrsprachigen Plattform an der Obergrenze. Wo Sie liegen, entscheiden der Gesprächsumfang, die Integrationen und die Leitplanken, nicht das Modell, das Sie wählen. Indikatives Band, kein Angebot — die fixe Zahl kommt aus einem bezahlten Discovery-Sprint und wird auf die Umsetzung angerechnet.
Ist nicht das KI-Modell der Hauptkostenpunkt?
Nein — die Gebühren für die Modell-API sind meist der kleinste Posten. Das Budget liegt in der Ingenieurarbeit um das Modell herum: Telefonie, CRM-Anbindung, Übergabe an Menschen, Leitplanken und der Auswertungs-Loop, der den Agenten mit echten Kunden sicher macht. Genau dieses Bindegewebe ist der Wert von LeadTrack AI, gehärtet über mehr als 100'000 Live-Anrufe.
Was macht einen Agenten deutlich teurer als einen anderen?
Der Umfang des Gesprächs. Ein Agent, der ein klar definiertes Gespräch von Anfang bis Ende beherrscht — etwa die Qualifizierung eines eingehenden Leads — ist ein Bruchteil eines offenen Assistenten. Mandantenfähigkeit, Skripte pro Kunde und zusätzliche Sprachen weiten den Umfang jeweils erneut. Der Discovery-Sprint legt fest, welche Gespräche v1 übernimmt.
Was sind die laufenden Kosten nach dem Launch?
Zwei Zeilen. Der Tuning-Loop — Transkript-Review, Weiterentwicklung der Skripte, Modell-Updates — ist ein fixer Care-Plan: $550 im Monat für 15 Stunden, $1,050 für 30, oder $1,950 für 60 mit einem namentlich benannten Entwickler. Daneben stehen nutzungsabhängige Modell- und Telefoniegebühren, die Ihre Anbieter an Ihrem eigenen Anrufvolumen messen — wir schätzen sie im Discovery-Sprint für Ihren Verkehr, statt einen Satz zu veröffentlichen, der nicht Ihrer wäre.
Warum ein bezahlter Discovery-Sprint statt einer kostenlosen Schätzung?
Eine kostenlose Schätzung bepreist die Vermutung; der Sprint leistet die Arbeit, die eine ehrliche Zahl braucht. Wir kartieren, welche Gespräche der Agent übernimmt, welche Systeme er berührt und was die Leitplanken verlangen — und am Ende steht ein fixes, transparentes Angebot, schriftlich. Das Ergebnis hat für sich allein Wert, deshalb ist es bezahlt.
Rechnen sich KI-Agents wirklich?
Messen Sie es, und bestehen Sie auf der Ausgangslage, bevor Sie starten. Auf echten Projekten hält das Muster — LeadTrack AI hob die Conversion um 38%, indem jeder Lead in unter 30 Sekunden angerufen wurde, und FeelEats Prognoseplattform hat sich im ersten Quartal bezahlt gemacht. Wir legen Rollouts so an, dass der Business Case gemessen und nicht behauptet wird.
Wie fangen wir an?
Mit einem bezahlten Discovery-Sprint: Wir schneiden Ihre Gespräche, Eskalationsregeln und Integrationen gemeinsam zu, und Sie bekommen ein fixes, transparentes Angebot, bevor irgendetwas gebaut wird.
Ein Problem, das es wert ist,
gut gelöst zu werden?
Erzählen Sie uns von Ihrem Produkt, Ihrer Zeitschiene und Ihren Rahmenbedingungen. Wir antworten innerhalb eines Werktags mit einer ehrlichen Einschätzung zu Fit, Umfang und richtigem Team.
