
KI-APIs für Entwickler
KI-Chat-API
Erstellen Sie Schreib-, Argumentations- und Codierungsfunktionen mit der PoYo KI-Chat-API. Vergleichen Sie LLM-Modelle, Konversationsprotokolle, unterstützte Eingaben, Antwortkontrollen und Token-Preise.
Passende Modelle
27 Modelle

$2.28 1 Mio. Eingabe
kimi-k3
Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

$0.85 1 Mio. Eingabe
claude-sonnet-5
Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

$0.112 1 Mio. Eingabe
deepseek-v4-flash
DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

$0.348 1 Mio. Eingabe
deepseek-v4-pro
DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

$8.00 1 Mio. Eingabe
gpt-6-astra
GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

$1.60 1 Mio. Eingabe
gpt-6-sol
GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$8.00 1 Mio. Eingabe
claude-fable-5-1
Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

$0.06 1 Mio. Eingabe
gemini-3.7-flash
Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

$0.06 1 Mio. Eingabe
gemini-3.8-flash
Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

$0.056 1 Mio. Eingabe
gpt-5-6-luna
GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

$0.08 1 Mio. Eingabe
gpt-6-luna
GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

$1.60 1 Mio. Eingabe
grok-4.6
xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

$1.60 1 Mio. Eingabe
grok-4.7
Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

$2.00 1 Mio. Eingabe
claude-opus-5
Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

$3.20 1 Mio. Eingabe
claude-opus-5-5
Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

$1.60 1 Mio. Eingabe
claude-sonnet-5-5
Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$0.30 1 Mio. Eingabe
deepseek-flash
DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

$1.60 1 Mio. Eingabe
gpt-6.1-sol
GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$3.00 1 Mio. Eingabe
gpt-5.5
GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

$1.05 1 Mio. Eingabe
gpt-5.4
GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

$0.90 1 Mio. Eingabe
gemini-3.5-flash
Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

$0.438 1 Mio. Eingabe
gpt-5.2
GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

$4.00 1 Mio. Eingabe
claude-opus-4-8
Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

$4.00 1 Mio. Eingabe
claude-opus-4-7
Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

$1.44 1 Mio. Eingabe
claude-sonnet-4-6
Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

$0.80 1 Mio. Eingabe
claude-opus-4-5-20251101
Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

$0.40 1 Mio. Eingabe
gemini-3-flash-preview
Google's Gemini 3 series model — Flash Preview & Pro Preview
Chat Modell-APIs - Preise und Modell-Eignung
Vergleichen Sie Anbieter, unterstützte Eingaben, Ausgabeformate und Preise vor der Modellwahl.
Exakte Task-Übereinstimmung
Modelle erscheinen hier nur, wenn ihre Katalogmetadaten Chat enthalten.
Provider-Vergleich
Vergleichen Sie Modellfamilien mehrerer Provider, ohne das Task-Verzeichnis zu verlassen.
API-fähige Pfade
Jede Modellkarte führt zu PoYo-Preisen, Beispielen, Playground und API-Details.
| Modell | Provider | Task-Typen | Preis |
|---|---|---|---|
| Kimi K3 kimi-k3 | Moonshot AI | Chat | $2.281 Mio. Eingabe |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | Chat | $0.851 Mio. Eingabe |
| DeepSeek V4 Flash deepseek-v4-flash | DeepSeek | Chat | $0.1121 Mio. Eingabe |
| DeepSeek V4 Pro deepseek-v4-pro | DeepSeek | Chat | $0.3481 Mio. Eingabe |
| GPT-6 Astra gpt-6-astra | OpenAI | Chat | $8.001 Mio. Eingabe |
| GPT-6 Sol gpt-6-sol | OpenAI | Chat | $1.601 Mio. Eingabe |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | Chat | $8.001 Mio. Eingabe |
| Gemini 3.7 Flash gemini-3.7-flash | Chat | $0.061 Mio. Eingabe | |
| Gemini 3.8 Flash gemini-3.8-flash | Chat | $0.061 Mio. Eingabe | |
| GPT-5.6 gpt-5-6-luna | OpenAI | Chat | $0.0561 Mio. Eingabe |
| GPT-6 Luna gpt-6-luna | OpenAI | Chat | $0.081 Mio. Eingabe |
| Grok 4.6 grok-4.6 | xAI | Chat | $1.601 Mio. Eingabe |
| Grok 4.7 grok-4.7 | xAI | Chat | $1.601 Mio. Eingabe |
| Claude Opus 5 claude-opus-5 | Anthropic | Chat | $2.001 Mio. Eingabe |
| Claude Opus 5.5 claude-opus-5-5 | Anthropic | Chat | $3.201 Mio. Eingabe |
| Claude Sonnet 5.5 claude-sonnet-5-5 | Anthropic | Chat | $1.601 Mio. Eingabe |
| DeepSeek V4.1 Flash deepseek-flash | DeepSeek | Chat | $0.301 Mio. Eingabe |
| GPT-6.1 Sol gpt-6.1-sol | OpenAI | Chat | $1.601 Mio. Eingabe |
| GPT-5.5 gpt-5.5 | OpenAI | Chat | $3.001 Mio. Eingabe |
| GPT-5.4 gpt-5.4 | OpenAI | Chat | $1.051 Mio. Eingabe |
| Gemini 3.5 Flash gemini-3.5-flash | Chat | $0.901 Mio. Eingabe | |
| GPT-5.2 gpt-5.2 | OpenAI | Chat | $0.4381 Mio. Eingabe |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | Chat | $4.001 Mio. Eingabe |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | Chat | $4.001 Mio. Eingabe |
| Claude 4.6 API claude-sonnet-4-6 | Anthropic | Chat | $1.441 Mio. Eingabe |
| Claude 4.5 Series claude-opus-4-5-20251101 | Anthropic | Chat | $0.801 Mio. Eingabe |
| Gemini 3 Series gemini-3-flash-preview | Chat | $0.401 Mio. Eingabe |
Häufige Fragen
Was ist die KI-Chat-API?
+
Eine KI-Chat-API akzeptiert Konversationsnachrichten und gibt eine Sprachmodellantwort zurück. Es ermöglicht Schreib-, Argumentations-, Codierungs- und Hilfsfunktionen in Ihrer eigenen Anwendung. Die verfügbaren Eingabetypen und Steuerelemente hängen vom ausgewählten Modell und API-Protokoll ab.
Welches LLM-API-Modell soll ich wählen?
+
Bewerten Sie Modelle anhand der Eingabeaufforderungen, Gesprächslängen und Ausgaben, die Ihr Produkt verwendet. Vergleichen Sie Antwortqualität, Befolgung von Anweisungen, Geschwindigkeit und Token-Kosten. Beziehen Sie schwierige und erfolglose Beispiele in die Bewertung ein, anstatt nur aus einer beeindruckenden Antwort auszuwählen.
Verwendet jedes PoYo-Chat-Modell dasselbe Anfrageformat?
+
Nein. Verwenden Sie die Modelldokumentation, um das native Format OpenAI-kompatibler Chat Completions, Claude Messages oder Gemini auszuwählen. Nachrichtenstrukturen, Authentifizierungsdetails und unterstützte Steuerelemente können unterschiedlich sein. Passen Sie die Anfrage an das dokumentierte Protokoll an, anstatt nur den Modellnamen zu ändern.
Wie behalte ich den Konversationskontext mit mehreren Runden bei?
+
Speichern Sie die relevanten Nachrichten in Ihrer Anwendung und senden Sie den für das ausgewählte Protokoll erforderlichen Verlauf. Halten Sie sich an die Grenzen des Modellkontexts und entfernen oder fassen Sie Material zusammen, das für die Aufgabe nicht mehr hilfreich ist. Es sollte nicht davon ausgegangen werden, dass sich eine neue API-Anfrage automatisch an frühere Anfragen erinnert.
Unterstützt die AI-Chat-API Streaming-Antworten?
+
Überprüfen Sie die Streaming-Unterstützung und die Anforderungsoptionen für das ausgewählte Modell und den Endpunkt. Falls verfügbar, behandeln Sie Teilereignisse, Abschlüsse und Fehler in Ihrem Client. Behalten Sie einen Nicht-Streaming-Pfad bei, wenn Ihr Workflow vor der Validierung oder nachgelagerten Verarbeitung eine vollständige Antwort benötigt.
Kann ich Bilder oder andere Medien an ein Chat-Modell senden?
+
Verwenden Sie nur Medientypen und Nachrichtenstrukturen, die für dieses Modell dokumentiert sind. Einige LLM-Endpunkte sind nur textbasiert und andere unterstützen multimodale Eingaben. Überprüfen Sie Größen-, Format- und Inhaltsbeschränkungen, bevor Sie Uploads implementieren, und testen Sie, wie gut das Modell mit Ihren tatsächlichen Medien umgeht.
Kann ich JSON oder eine andere strukturierte Antwort anfordern?
+
Einige Modelle stellen Steuerelemente für strukturierte Ausgaben bereit. andere können sich nur durch Eingabeaufforderungen leiten lassen. Bestätigen Sie den unterstützten Mechanismus, stellen Sie, sofern verfügbar, ein klares Schema bereit und validieren Sie die zurückgegebenen Daten in Ihrer Anwendung. Betrachten Sie eine JSON-Anfrage nicht als Beweis dafür, dass jede Antwort Ihrem Schema entspricht.
Kann ein Chat-Modell automatisch im Internet surfen oder Tools aufrufen?
+
Nur wenn der Endpunkt die Funktion unterstützt und Ihre Anwendung die erforderlichen Tools bereitstellt oder aktiviert. Ein Modell kann einen Werkzeugaufruf beschreiben, ohne ihn auszuführen. Überprüfen Sie das dokumentierte Tool-Protokoll und sorgen Sie dafür, dass Ausführung, Berechtigungen und Ergebnisverarbeitung in Ihrer Integration explizit bleiben.
Wie kann ich ungenaue KI-Chat-Antworten reduzieren?
+
Stellen Sie relevantes Quellenmaterial bereit, präzisieren Sie die Aufgabe und bitten Sie das Modell, fehlende Informationen von bekannten Fakten zu unterscheiden. Validieren Sie wichtige Ausgaben anhand vertrauenswürdiger Daten und testen Sie wiederkehrende Fehlerfälle. Die Auswahl des Modells und die Eingabeaufforderung können die Qualität verbessern, die generierten Antworten müssen jedoch noch angemessen überprüft werden.
Wie werden die Preise für die AI-Chat-API berechnet?
+
Bei der Chat-Preisgestaltung werden Eingabe- und Ausgabe-Token üblicherweise getrennt, und bei einigen Modellen gibt es zusätzliche Stufenunterschiede. Lesen Sie die Preis- und Nutzungsantwort des ausgewählten Modells. Berücksichtigen Sie den Gesprächsverlauf in Ihrer Schätzung, da das wiederholte Senden langer Kontexte die Kosten für jede Runde erhöhen kann.
Was soll ich bei Kontextfehlern, Ratenbegrenzungen oder Zeitüberschreitungen tun?
+
Überprüfen Sie den zurückgegebenen Fehler und die ausgewählten Modellgrenzen. Reduzieren Sie übergroßen Kontext, kontrollieren Sie gleichzeitige Anforderungen und verwenden Sie gegebenenfalls begrenzte Wiederholungsversuche. Zeichnen Sie bei einer teilweisen Streaming-Antwort den Empfang auf und entscheiden Sie, wie Ihre Anwendung wiederhergestellt werden soll, anstatt stillschweigend eine Konversationsrunde zu duplizieren.
Wo finde ich Beispiele für die AI-Chat-API-Integration?
+
Öffnen Sie die Modellseite und die zugehörige API-Dokumentation für den richtigen Endpunkt, die richtige Authentifizierung, den richtigen Nachrichtentext und die richtigen Beispiele. Die modellspezifische Ressource llms.txt identifiziert auch das Protokoll. Behalten Sie die Schlüssel auf dem Server und validieren Sie die Ausgaben, bevor Sie sie in automatisierten Geschäftsaktionen verwenden.
Alle AI-Modelle entdecken
Öffnen Sie den vollständigen Modellmarktplatz, um Bild-, Video-, Audio-, Chat-, 3D- und Tool-Modelle zu vergleichen.
Alle Modelle ansehenMit der API bauen
Öffnen Sie die Modellseite für Parameter, Preise und API-Dokumentation.
API-DokumentationVerwandte Task-Seiten