
API de IA para desarrolladores
API de chat con IA
Cree funciones de escritura, razonamiento y codificación con la API de chat IA PoYo. Compare modelos LLM, protocolos de conversación, entradas admitidas, controles de respuesta y precios de tokens.
Modelos compatibles
Modelos 27

$2.28 entrada de 1M
kimi-k3
Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

$0.85 entrada de 1M
claude-sonnet-5
Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

$0.112 entrada de 1M
deepseek-v4-flash
DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

$0.348 entrada de 1M
deepseek-v4-pro
DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

$8.00 entrada de 1M
gpt-6-astra
GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

$1.60 entrada de 1M
gpt-6-sol
GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$8.00 entrada de 1M
claude-fable-5-1
Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

$0.06 entrada de 1M
gemini-3.7-flash
Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

$0.06 entrada de 1M
gemini-3.8-flash
Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

$0.056 entrada de 1M
gpt-5-6-luna
GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

$0.08 entrada de 1M
gpt-6-luna
GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

$1.60 entrada de 1M
grok-4.6
xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

$1.60 entrada de 1M
grok-4.7
Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

$2.00 entrada de 1M
claude-opus-5
Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

$3.20 entrada de 1M
claude-opus-5-5
Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

$1.60 entrada de 1M
claude-sonnet-5-5
Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$0.30 entrada de 1M
deepseek-flash
DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

$1.60 entrada de 1M
gpt-6.1-sol
GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$3.00 entrada de 1M
gpt-5.5
GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

$1.05 entrada de 1M
gpt-5.4
GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

$0.90 entrada de 1M
gemini-3.5-flash
Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

$0.438 entrada de 1M
gpt-5.2
GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

$4.00 entrada de 1M
claude-opus-4-8
Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

$4.00 entrada de 1M
claude-opus-4-7
Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

$1.44 entrada de 1M
claude-sonnet-4-6
Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

$0.80 entrada de 1M
claude-opus-4-5-20251101
Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

$0.40 entrada de 1M
gemini-3-flash-preview
Google's Gemini 3 series model — Flash Preview & Pro Preview
APIs de modelos de Chat: precios y ajuste del modelo
Compara proveedores, entradas compatibles, formatos de salida y precios antes de elegir un modelo.
Coincidencia exacta de tareas
Los modelos aparecen aquí solo cuando los metadatos de su catálogo incluyen Chat.
Comparación de proveedores
Revise las familias de modelos de todos los proveedores sin salir del directorio de tareas.
Rutas listas para API
Cada tarjeta de modelo enlaza con los precios de PoYo, ejemplos, controles del área de juegos y detalles de API.
| Modelo | Proveedor | Tipos de tareas | Precio |
|---|---|---|---|
| Kimi K3 kimi-k3 | Moonshot AI | Chat | $2.28entrada de 1M |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | Chat | $0.85entrada de 1M |
| DeepSeek V4 Flash deepseek-v4-flash | DeepSeek | Chat | $0.112entrada de 1M |
| DeepSeek V4 Pro deepseek-v4-pro | DeepSeek | Chat | $0.348entrada de 1M |
| GPT-6 Astra gpt-6-astra | OpenAI | Chat | $8.00entrada de 1M |
| GPT-6 Sol gpt-6-sol | OpenAI | Chat | $1.60entrada de 1M |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | Chat | $8.00entrada de 1M |
| Gemini 3.7 Flash gemini-3.7-flash | Chat | $0.06entrada de 1M | |
| Gemini 3.8 Flash gemini-3.8-flash | Chat | $0.06entrada de 1M | |
| GPT-5.6 gpt-5-6-luna | OpenAI | Chat | $0.056entrada de 1M |
| GPT-6 Luna gpt-6-luna | OpenAI | Chat | $0.08entrada de 1M |
| Grok 4.6 grok-4.6 | xAI | Chat | $1.60entrada de 1M |
| Grok 4.7 grok-4.7 | xAI | Chat | $1.60entrada de 1M |
| Claude Opus 5 claude-opus-5 | Anthropic | Chat | $2.00entrada de 1M |
| Claude Opus 5.5 claude-opus-5-5 | Anthropic | Chat | $3.20entrada de 1M |
| Claude Sonnet 5.5 claude-sonnet-5-5 | Anthropic | Chat | $1.60entrada de 1M |
| DeepSeek V4.1 Flash deepseek-flash | DeepSeek | Chat | $0.30entrada de 1M |
| GPT-6.1 Sol gpt-6.1-sol | OpenAI | Chat | $1.60entrada de 1M |
| GPT-5.5 gpt-5.5 | OpenAI | Chat | $3.00entrada de 1M |
| GPT-5.4 gpt-5.4 | OpenAI | Chat | $1.05entrada de 1M |
| Gemini 3.5 Flash gemini-3.5-flash | Chat | $0.90entrada de 1M | |
| GPT-5.2 gpt-5.2 | OpenAI | Chat | $0.438entrada de 1M |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | Chat | $4.00entrada de 1M |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | Chat | $4.00entrada de 1M |
| Claude 4.6 API claude-sonnet-4-6 | Anthropic | Chat | $1.44entrada de 1M |
| Claude 4.5 Series claude-opus-4-5-20251101 | Anthropic | Chat | $0.80entrada de 1M |
| Gemini 3 Series gemini-3-flash-preview | Chat | $0.40entrada de 1M |
Preguntas frecuentes
¿Qué es una API de chat con IA?
+
Una API de chat de IA acepta mensajes de conversación y devuelve una respuesta de modelo de lenguaje. Permite funciones de escritura, razonamiento, codificación y asistente en su propia aplicación. Los tipos de entrada y controles disponibles dependen del modelo seleccionado y del protocolo API.
¿Qué modelo de API LLM debo elegir?
+
Evalúe modelos con las indicaciones, la duración de las conversaciones y los resultados que utiliza su producto. Compare la calidad de las respuestas, el seguimiento de instrucciones, la velocidad y el costo del token. Incluya ejemplos difíciles y fallidos en la evaluación en lugar de seleccionar una respuesta impresionante.
¿Todos los modelos de chat PoYo utilizan el mismo formato de solicitud?
+
No. Utilice la documentación del modelo para elegir Finalizaciones de chat compatibles con OpenAI, formato nativo Claude Messages o Gemini. Las estructuras de mensajes, los detalles de autenticación y los controles admitidos pueden diferir. Adapte la solicitud al protocolo documentado en lugar de cambiar solo el nombre del modelo.
¿Cómo conservo el contexto de una conversación de varios turnos?
+
Almacena los mensajes relevantes en tu aplicación y envía el historial requerido por el protocolo seleccionado. Manténgase dentro del límite del contexto del modelo y elimine o resuma el material que ya no ayude a la tarea. No se debe suponer que una nueva solicitud de API recuerda automáticamente las solicitudes anteriores.
¿La API de chat de IA admite la transmisión de respuestas?
+
Verifique el soporte de transmisión y las opciones de solicitud para el modelo y punto final elegidos. Si está disponible, maneje eventos parciales, finalización y errores en su cliente. Mantenga una ruta sin transmisión cuando su flujo de trabajo necesite una respuesta completa antes de la validación o el procesamiento posterior.
¿Puedo enviar imágenes u otros medios a un modelo de chat?
+
Utilice únicamente tipos de medios y estructuras de mensajes documentados para ese modelo. Algunos puntos finales de LLM son de solo texto y otros admiten entradas multimodales. Verifique las limitaciones de tamaño, formato y contenido antes de implementar las cargas y pruebe qué tan bien el modelo maneja sus medios reales.
¿Puedo solicitar JSON u otra respuesta estructurada?
+
Algunos modelos exponen controles de salida estructurados; otros sólo pueden guiarse por indicaciones. Confirme el mecanismo admitido, proporcione un esquema claro cuando esté disponible y valide los datos devueltos en su aplicación. No trate una solicitud de JSON como prueba de que cada respuesta satisfará su esquema.
¿Puede un modelo de chat navegar por la web o llamar a herramientas automáticamente?
+
Solo cuando el punto final admite la capacidad y su aplicación proporciona o habilita las herramientas necesarias. Un modelo puede describir una llamada a una herramienta sin ejecutarla. Verifique el protocolo de herramienta documentado y mantenga la ejecución, los permisos y el manejo de resultados explícitos en su integración.
¿Cómo puedo reducir las respuestas inexactas del chat de IA?
+
Proporcione material fuente relevante, haga que la tarea sea precisa y pida al modelo que distinga la información faltante de los hechos conocidos. Valide resultados importantes con datos confiables y pruebe casos de fallas recurrentes. La elección del modelo y las indicaciones pueden mejorar la calidad, pero las respuestas generadas aún necesitan una revisión adecuada.
¿Cómo se calcula el precio de la API de chat IA?
+
Los precios del chat suelen separar los tokens de entrada y de salida, y algunos modelos tienen distinciones de niveles adicionales. Lea el precio del modelo seleccionado y la respuesta de uso. Incluya el historial de conversaciones en su estimación, ya que enviar repetidamente un contexto largo puede aumentar el costo de cada turno.
¿Qué debo hacer con los errores de contexto, límites de velocidad o tiempos de espera?
+
Verifique el error devuelto y los límites del modelo seleccionado. Reduzca el contexto de gran tamaño, controle las solicitudes simultáneas y utilice reintentos limitados cuando corresponda. Para una respuesta de transmisión parcial, registre lo que se recibió y decida cómo debe recuperarse su aplicación en lugar de duplicar silenciosamente un turno de conversación.
¿Dónde puedo encontrar ejemplos de integración de API de chat de IA?
+
Abra la página del modelo y su documentación API para obtener el punto final, la autenticación, el cuerpo del mensaje y los ejemplos correctos. El recurso llms.txt específico del modelo también identifica el protocolo. Mantenga las claves en el servidor y valide los resultados antes de utilizarlos en acciones comerciales automatizadas.
Explorar todos los modelos de IA
Abra el mercado de modelos completo para comparar modelos de imágenes, videos, audio, chat, 3D y herramientas.
Ver todos los modelosCrear con la API
Abre la página del modelo para ver parámetros, precios y documentación de la API.
Documentos APIPáginas de tareas relacionadas