API de chat con IA

API de IA para desarrolladores

API de chat con IA

Cree funciones de escritura, razonamiento y codificación con la API de chat IA PoYo. Compare modelos LLM, protocolos de conversación, entradas admitidas, controles de respuesta y precios de tokens.

Modelos compatibles

Modelos 27

Kimi K3
Chat

$2.28 entrada de 1M

kimi-k3

Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

Claude Sonnet 5
Chat

$0.85 entrada de 1M

claude-sonnet-5

Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

DeepSeek V4 Flash
Chat

$0.112 entrada de 1M

deepseek-v4-flash

DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

DeepSeek V4 Pro
Chat

$0.348 entrada de 1M

deepseek-v4-pro

DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

GPT-6 Astra
Chat

$8.00 entrada de 1M

gpt-6-astra

GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

GPT-6 Sol
Chat

$1.60 entrada de 1M

gpt-6-sol

GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

Claude Fable 5.1
Chat

$8.00 entrada de 1M

claude-fable-5-1

Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

Gemini 3.7 Flash
Chat

$0.06 entrada de 1M

gemini-3.7-flash

Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

Gemini 3.8 Flash
Chat

$0.06 entrada de 1M

gemini-3.8-flash

Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

GPT-5.6
Chat

$0.056 entrada de 1M

gpt-5-6-luna

GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

GPT-6 Luna
Chat

$0.08 entrada de 1M

gpt-6-luna

GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

Grok 4.6
Chat

$1.60 entrada de 1M

grok-4.6

xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

Grok 4.7
Chat

$1.60 entrada de 1M

grok-4.7

Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

Claude Opus 5
Chat

$2.00 entrada de 1M

claude-opus-5

Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

Claude Opus 5.5
Chat

$3.20 entrada de 1M

claude-opus-5-5

Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

Claude Sonnet 5.5
Chat

$1.60 entrada de 1M

claude-sonnet-5-5

Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

DeepSeek V4.1 Flash
Chat

$0.30 entrada de 1M

deepseek-flash

DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

GPT-6.1 Sol
Chat

$1.60 entrada de 1M

gpt-6.1-sol

GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

GPT-5.5
Chat

$3.00 entrada de 1M

gpt-5.5

GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

GPT-5.4
Chat

$1.05 entrada de 1M

gpt-5.4

GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

Gemini 3.5 Flash
Chat

$0.90 entrada de 1M

gemini-3.5-flash

Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

GPT-5.2
Chat

$0.438 entrada de 1M

gpt-5.2

GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

Claude Opus 4.8
Chat

$4.00 entrada de 1M

claude-opus-4-8

Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

Claude Opus 4.7
Chat

$4.00 entrada de 1M

claude-opus-4-7

Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

Claude 4.6 API
Chat

$1.44 entrada de 1M

claude-sonnet-4-6

Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

Claude 4.5 Series
Chat

$0.80 entrada de 1M

claude-opus-4-5-20251101

Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

Gemini 3 Series
Chat

$0.40 entrada de 1M

gemini-3-flash-preview

Google's Gemini 3 series model — Flash Preview & Pro Preview

APIs de modelos de Chat: precios y ajuste del modelo

Compara proveedores, entradas compatibles, formatos de salida y precios antes de elegir un modelo.

Coincidencia exacta de tareas

Los modelos aparecen aquí solo cuando los metadatos de su catálogo incluyen Chat.

Comparación de proveedores

Revise las familias de modelos de todos los proveedores sin salir del directorio de tareas.

Rutas listas para API

Cada tarjeta de modelo enlaza con los precios de PoYo, ejemplos, controles del área de juegos y detalles de API.

ModeloProveedorTipos de tareasPrecio
Kimi K3

kimi-k3

Moonshot AIChat$2.28entrada de 1M
Claude Sonnet 5

claude-sonnet-5

AnthropicChat$0.85entrada de 1M
DeepSeek V4 Flash

deepseek-v4-flash

DeepSeekChat$0.112entrada de 1M
DeepSeek V4 Pro

deepseek-v4-pro

DeepSeekChat$0.348entrada de 1M
GPT-6 Astra

gpt-6-astra

OpenAIChat$8.00entrada de 1M
GPT-6 Sol

gpt-6-sol

OpenAIChat$1.60entrada de 1M
Claude Fable 5.1

claude-fable-5-1

AnthropicChat$8.00entrada de 1M
Gemini 3.7 Flash

gemini-3.7-flash

GoogleChat$0.06entrada de 1M
Gemini 3.8 Flash

gemini-3.8-flash

GoogleChat$0.06entrada de 1M
GPT-5.6

gpt-5-6-luna

OpenAIChat$0.056entrada de 1M
GPT-6 Luna

gpt-6-luna

OpenAIChat$0.08entrada de 1M
Grok 4.6

grok-4.6

xAIChat$1.60entrada de 1M
Grok 4.7

grok-4.7

xAIChat$1.60entrada de 1M
Claude Opus 5

claude-opus-5

AnthropicChat$2.00entrada de 1M
Claude Opus 5.5

claude-opus-5-5

AnthropicChat$3.20entrada de 1M
Claude Sonnet 5.5

claude-sonnet-5-5

AnthropicChat$1.60entrada de 1M
DeepSeek V4.1 Flash

deepseek-flash

DeepSeekChat$0.30entrada de 1M
GPT-6.1 Sol

gpt-6.1-sol

OpenAIChat$1.60entrada de 1M
GPT-5.5

gpt-5.5

OpenAIChat$3.00entrada de 1M
GPT-5.4

gpt-5.4

OpenAIChat$1.05entrada de 1M
Gemini 3.5 Flash

gemini-3.5-flash

GoogleChat$0.90entrada de 1M
GPT-5.2

gpt-5.2

OpenAIChat$0.438entrada de 1M
Claude Opus 4.8

claude-opus-4-8

AnthropicChat$4.00entrada de 1M
Claude Opus 4.7

claude-opus-4-7

AnthropicChat$4.00entrada de 1M
Claude 4.6 API

claude-sonnet-4-6

AnthropicChat$1.44entrada de 1M
Claude 4.5 Series

claude-opus-4-5-20251101

AnthropicChat$0.80entrada de 1M
Gemini 3 Series

gemini-3-flash-preview

GoogleChat$0.40entrada de 1M

Preguntas frecuentes

¿Qué es una API de chat con IA?

+

Una API de chat de IA acepta mensajes de conversación y devuelve una respuesta de modelo de lenguaje. Permite funciones de escritura, razonamiento, codificación y asistente en su propia aplicación. Los tipos de entrada y controles disponibles dependen del modelo seleccionado y del protocolo API.

¿Qué modelo de API LLM debo elegir?

+

Evalúe modelos con las indicaciones, la duración de las conversaciones y los resultados que utiliza su producto. Compare la calidad de las respuestas, el seguimiento de instrucciones, la velocidad y el costo del token. Incluya ejemplos difíciles y fallidos en la evaluación en lugar de seleccionar una respuesta impresionante.

¿Todos los modelos de chat PoYo utilizan el mismo formato de solicitud?

+

No. Utilice la documentación del modelo para elegir Finalizaciones de chat compatibles con OpenAI, formato nativo Claude Messages o Gemini. Las estructuras de mensajes, los detalles de autenticación y los controles admitidos pueden diferir. Adapte la solicitud al protocolo documentado en lugar de cambiar solo el nombre del modelo.

¿Cómo conservo el contexto de una conversación de varios turnos?

+

Almacena los mensajes relevantes en tu aplicación y envía el historial requerido por el protocolo seleccionado. Manténgase dentro del límite del contexto del modelo y elimine o resuma el material que ya no ayude a la tarea. No se debe suponer que una nueva solicitud de API recuerda automáticamente las solicitudes anteriores.

¿La API de chat de IA admite la transmisión de respuestas?

+

Verifique el soporte de transmisión y las opciones de solicitud para el modelo y punto final elegidos. Si está disponible, maneje eventos parciales, finalización y errores en su cliente. Mantenga una ruta sin transmisión cuando su flujo de trabajo necesite una respuesta completa antes de la validación o el procesamiento posterior.

¿Puedo enviar imágenes u otros medios a un modelo de chat?

+

Utilice únicamente tipos de medios y estructuras de mensajes documentados para ese modelo. Algunos puntos finales de LLM son de solo texto y otros admiten entradas multimodales. Verifique las limitaciones de tamaño, formato y contenido antes de implementar las cargas y pruebe qué tan bien el modelo maneja sus medios reales.

¿Puedo solicitar JSON u otra respuesta estructurada?

+

Algunos modelos exponen controles de salida estructurados; otros sólo pueden guiarse por indicaciones. Confirme el mecanismo admitido, proporcione un esquema claro cuando esté disponible y valide los datos devueltos en su aplicación. No trate una solicitud de JSON como prueba de que cada respuesta satisfará su esquema.

¿Puede un modelo de chat navegar por la web o llamar a herramientas automáticamente?

+

Solo cuando el punto final admite la capacidad y su aplicación proporciona o habilita las herramientas necesarias. Un modelo puede describir una llamada a una herramienta sin ejecutarla. Verifique el protocolo de herramienta documentado y mantenga la ejecución, los permisos y el manejo de resultados explícitos en su integración.

¿Cómo puedo reducir las respuestas inexactas del chat de IA?

+

Proporcione material fuente relevante, haga que la tarea sea precisa y pida al modelo que distinga la información faltante de los hechos conocidos. Valide resultados importantes con datos confiables y pruebe casos de fallas recurrentes. La elección del modelo y las indicaciones pueden mejorar la calidad, pero las respuestas generadas aún necesitan una revisión adecuada.

¿Cómo se calcula el precio de la API de chat IA?

+

Los precios del chat suelen separar los tokens de entrada y de salida, y algunos modelos tienen distinciones de niveles adicionales. Lea el precio del modelo seleccionado y la respuesta de uso. Incluya el historial de conversaciones en su estimación, ya que enviar repetidamente un contexto largo puede aumentar el costo de cada turno.

¿Qué debo hacer con los errores de contexto, límites de velocidad o tiempos de espera?

+

Verifique el error devuelto y los límites del modelo seleccionado. Reduzca el contexto de gran tamaño, controle las solicitudes simultáneas y utilice reintentos limitados cuando corresponda. Para una respuesta de transmisión parcial, registre lo que se recibió y decida cómo debe recuperarse su aplicación en lugar de duplicar silenciosamente un turno de conversación.

¿Dónde puedo encontrar ejemplos de integración de API de chat de IA?

+

Abra la página del modelo y su documentación API para obtener el punto final, la autenticación, el cuerpo del mensaje y los ejemplos correctos. El recurso llms.txt específico del modelo también identifica el protocolo. Mantenga las claves en el servidor y valide los resultados antes de utilizarlos en acciones comerciales automatizadas.