Lösungen
KI-Agenten für Unternehmen
Die Infrastruktur, auf der ein KI-Agent läuft: 22 Chat-Modelle hinter einem API-Schlüssel und einem Prepaid-Guthaben, kompatibel mit den SDKs von OpenAI und Anthropic, mit automatischem Anbieterwechsel. Den Agenten schreiben Sie — wir stehen für den Zugang zu den Modellen und dafür ein, dass die Anfrage ankommt.
22
Chat-Modelle
Was ein Agent von seiner Infrastruktur braucht
Ein Agent ist eine Schleife aus Modell → Werkzeug → Modell, und das meiste, was im Produktivbetrieb bricht, bricht beim Zugriff auf die Modelle: ein Kontingent läuft aus, ein Anbieter antwortet mit einem Fehler, ein Schritt braucht ein günstigeres oder ein stärkeres Modell. Genau das deckt unsere API ab.
Pro Schritt ein anderes Modell
Routing und Klassifikation gehören auf ein günstiges Modell, Planung und Reasoning auf ein starkes. Alle Modelle liegen hinter demselben Schlüssel, und der Wechsel ist ein Feld model in der Anfrage.
Protokolle von OpenAI und Anthropic
Wir antworten im Format OpenAI Chat Completions und Anthropic Messages. LangChain, LlamaIndex, das Vercel AI SDK und Code direkt gegen das OpenAI-SDK laufen weiter — es ändern sich nur Basis-URL und Schlüssel.
Anbieter-Fallback
Hinter jedem Modell stehen mehrere Anbieter. Fällt der primäre aus oder liefert einen Fehler, geht die Anfrage automatisch an einen Reserveanbieter — Ihr Agent bleibt nicht wegen einer fremden Störung stehen.
Ein Guthaben für das Unternehmen
Ein Prepaid-Guthaben deckt alle Modelle und alle Umgebungen: kein eigener Vertrag und kein eigenes Kontingent je Anbieter. Die Ausgaben je Schlüssel und Modell sind im Panel sichtbar.
Zugang ohne Formalitäten
Registrierung per E-Mail, Aufladung per Karte oder Krypto, Schlüssel sofort. Kein Abo, kein Mindestbetrag, nichts zu verhandeln.
Medienmodelle mit demselben Schlüssel
Braucht der Agent ein Bild, ein Video oder Musik, ist es derselbe Schlüssel und dasselbe Guthaben. Keine eigene Integration je Generierungstyp.
Die Modelle, auf denen Agenten laufen
Preis je Million Eingabe-Token, günstigste zuerst. Die Tabelle stammt aus dem Live-Katalog und kann daher nicht von dem abweichen, was Ihr Schlüssel tatsächlich aufrufen kann.
| Modell | Anbieter | Preis |
|---|---|---|
| DeepSeek V4 Flash | DeepSeek | $0.168/ 1 Mio. Tokens |
| GPT 5.6 Luna | OpenAI | $0.18/ 1 Mio. Tokens |
| Claude Sonnet 5 | Anthropic | $0.3/ 1 Mio. Tokens |
| Qwen3.7 Plus | Qwen | $0.343/ 1 Mio. Tokens |
| MiniMax M3 | MiniMax | $0.36/ 1 Mio. Tokens |
| DeepSeek V4 Pro | DeepSeek | $0.522/ 1 Mio. Tokens |
| GPT 5.6 Terra | OpenAI | $0.8/ 1 Mio. Tokens |
| Gemini 3.5 Flash | $0.9/ 1 Mio. Tokens | |
| Gemini 3.6 Flash | $0.9/ 1 Mio. Tokens | |
| Gemini 3.7 Flash | $0.9/ 1 Mio. Tokens | |
| GLM 5.2 | Zhipu | $0.979/ 1 Mio. Tokens |
| Kimi K2.7 Code | Moonshot | $1.11/ 1 Mio. Tokens |
| Claude Fable 5 | Anthropic | $1.5/ 1 Mio. Tokens |
| GPT 5.5 | OpenAI | $1.5/ 1 Mio. Tokens |
| Gemini 3.5 Flash (High) | $1.62/ 1 Mio. Tokens | |
| GLM 5.3 | Zhipu | $1.68/ 1 Mio. Tokens |
| Grok 4.5 | xAI | $2.1/ 1 Mio. Tokens |
| Grok 4.6 | xAI | $2.1/ 1 Mio. Tokens |
| Claude Opus 5 | Anthropic | $3/ 1 Mio. Tokens |
| GPT 5.6 Sol | OpenAI | $3/ 1 Mio. Tokens |
| Kimi K3 | Moonshot | $3.15/ 1 Mio. Tokens |
| GPT 6 Astra | OpenAI | $8/ 1 Mio. Tokens |
Was darauf gebaut wird
Vier Muster, mit denen Unternehmen meist anfangen — eine Größenordnung, keine vollständige Liste.
First-Level-Support
Der Agent liest das Ticket, sucht die Antwort in Ihrer Wissensbasis und antwortet; strittige Fälle gehen an einen Menschen. Klassifikation auf einem günstigen Modell, die Antwort an den Kunden auf einem starken.
Dokumentenverarbeitung
Verträge, Rechnungen und Anträge: Der Agent extrahiert die Felder, gleicht sie mit Ihrem System ab und liefert strukturiertes JSON. Modelle mit großem Kontext lesen das Dokument am Stück.
Content und Marketing
Text, Bild und Video in einer Pipeline: Der Agent schreibt das Skript auf einem Chat-Modell und erzeugt Cover oder Clip auf einem Medienmodell — gleicher Schlüssel, gleiches Guthaben.
Analysen und Reports
Der Agent übersetzt eine Frage in eine Abfrage auf Ihren Daten, interpretiert das Ergebnis und schreibt den Bericht in natürlicher Sprache. Lange Gedankenketten sind auf kleineren Modellen günstiger.
So binden Sie einen Agenten an
Die Integration besteht darin, in bereits geschriebenem Code eine Basis-URL und einen Schlüssel zu ändern. Ein eigenes SDK ist nicht nötig: Wir sprechen die Formate von OpenAI und Anthropic, also bleiben Agenten-Framework, Werkzeuge und Prompts, wie sie sind.
1
Schlüssel holen
Registrieren, Guthaben aufladen und im Panel einen API-Schlüssel anlegen. Ein Schlüssel deckt alle Modelle ab — Chat wie Medien.
2
Basis-URL umstellen
Geben Sie dem OpenAI- oder Anthropic-Client unsere Adresse und Ihren Schlüssel. Der Rest des Agenten — Werkzeuge, Gedächtnis, Aufrufketten — bleibt unangetastet.
3
Modelle auf Schritte verteilen
Nennen Sie im Feld model das Modell, das der jeweilige Schritt braucht. Die Ausgaben je Modell und Schlüssel erscheinen in der Statistik des Panels.
OpenAI SDK
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["API_KEY"],
base_url="https://api.api-stock.com/api/v1",
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "..."}],
tools=tools,
)curl
curl https://api.api-stock.com/api/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [{"role": "user", "content": "..."}]
}'Häufige Fragen
Was braucht man, um einen KI-Agenten im Unternehmen zu integrieren?
Dreierlei: ein Modell, auf dem der Agent denkt, Zugriff auf Ihre Daten und Werkzeuge und eine Infrastruktur, die unter Last nicht wegbricht. Das Erste und das Dritte deckt API Stock ab — 22 Chat-Modelle hinter einem Schlüssel, die Protokolle von OpenAI und Anthropic, automatischer Wechsel auf einen Reserveanbieter. Die Logik des Agenten und der Zugriff auf Ihre Systeme bleiben bei Ihnen.
Wie integriert man einen KI-Agenten in Unternehmensprozesse?
Technisch, indem Sie Basis-URL und Schlüssel im OpenAI- oder Anthropic-Client ändern: Ein Agent auf LangChain, LlamaIndex, dem Vercel AI SDK oder dem blanken SDK läuft ohne Änderung seiner Logik über uns. Organisatorisch, indem Sie mit einem Prozess mit messbarem Ergebnis beginnen — First-Level-Support, eingehende Dokumente — und erst danach ausweiten.
Welche Modelle eignen sich für einen KI-Agenten?
Kleine schnelle Modelle für Routing, Klassifikation und Feldextraktion, die großen für Planung, Reasoning und Code. Der Katalog führt 22 Chat-Modelle, und der Wechsel ist ein einziges Feld in der Anfrage — die Modellwahl je Schritt ist ein Experiment, keine Migration.
Braucht es einen Vertrag oder einen Mindestbetrag?
Nein. Registrierung per E-Mail, Aufladung in beliebiger Höhe, Schlüssel sofort. Kein Abo und kein Mindestbetrag — Sie zahlen die tatsächlich verbrauchten Token.
Was kostet ein KI-Agent für ein Unternehmen?
Auf der Infrastrukturseite sind es Token: Sie zahlen das tatsächliche Volumen aus Anfragen und Antworten zum Preis des genutzten Modells, ohne Grundgebühr. Zwischen kleinstem und größtem Modell liegen Faktoren im zweistelligen Bereich — deshalb wird bei Routing und Klassifikation am meisten gespart.
Ready / set / build
Bereit, Ihr erstes Modell zu verbinden?
Erstellen Sie einen API-Schlüssel und senden Sie Ihre erste Anfrage.