Gemini 3.5 Flash
gemini-3.5-flash est le modèle Gemini rapide pour les agents de code, l'analyse multimodale long contexte et les applications avec outils. PoYo facture 180 crédits par 1M tokens d'entrée et 1080 crédits par 1M tokens de sortie.Tarification transparente, sans frais cachés. Payez à l'usage.
| Modèle | Spécification | Prix PoYo | Prix officiel | Économie |
|---|---|---|---|---|
Input | $0.900/1M tokens 180 crédits /1M tokens | $1.50/1M tokens Official | 40% | |
Output | $5.40/1M tokens 1080 crédits /1M tokens | $9.00/1M tokens Official | 40% |
* Les frais réels sont basés sur la sortie finale.
Guide complet d'utilisation de API Gemini 3.5 Flash abordable sur PoYo
gemini-3.5-flash est le modèle Gemini rapide pour les agents de code, l'analyse multimodale long contexte et les applications avec outils. PoYo facture 180 crédits par 1M tokens d'entrée et 1080 crédits par 1M tokens de sortie.Gemini 3.5 Flash privilégie la vitesse, le contexte multimodal et les workflows d'agents plutôt que le chat à un seul tour.
01
Google DeepMind décrit Gemini 3.5 Flash comme l'itération suivante de la fondation de raisonnement Gemini 3 Flash, adaptée au code, aux agents et aux processus d'entreprise nécessitant moins de latence.

02
La model card officielle liste les entrées texte, image, audio et vidéo avec une fenêtre de contexte jusqu'à 1M tokens. Utilisez-le pour documents volumineux, analyse audio/vidéo et produits multimodaux.

03
Gemini 3.5 Flash utilise des thinking levels pour contrôler le compromis qualité, coût et latence. Les systèmes répondent vite la plupart du temps et approfondissent seulement les tours difficiles.

04
PoYo prend en charge Gemini 3.5 Flash via l'endpoint Gemini Native Format pour les requêtes Gemini complètes, ainsi que /v1/chat/completions pour les équipes qui préfèrent les clients de chat compatibles OpenAI.

Construisez des agents qui planifient, appellent des outils et itèrent vite avec un coût inférieur aux modèles frontier plus lourds.
Utilisez Gemini 3.5 Flash pour le triage de repo, les plans de debug, l'explication de code et les tâches agentiques avec tours rapides.
Traitez texte, images, audio, vidéo et PDF dans les applications nécessitant plus de contexte que le chat texte.
Résumez de longs dossiers, raisonnez sur des documents internes et automatisez les tâches répétées avec 1M de contexte.
Comparez Gemini 3.5 Flash à deux modèles de raisonnement premium : GPT-5.5 pour les agents de code OpenAI-style et Responses API, et Claude Opus 4.7 pour le raisonnement hybride long contexte, le code et le computer use.
| Fonctionnalité | Gemini 3.5 Flash | GPT-5.5 | Claude Opus 4.7 |
|---|---|---|---|
| Fournisseur | Google DeepMind | OpenAI | Anthropic |
| Meilleur usage | Gemini 3.5 Flash convient aux workflows agentiques rapides, aux tâches de code, à l'analyse multimodale et aux applications long contexte qui exigent un bon rapport vitesse/qualité. | Code difficile, planification, agents riches en outils et raisonnement professionnel à forte valeur. | Raisonnement profond, code et computer use |
| Fenêtre de contexte | 1M | 1M | 1M |
| Sortie maximale | 64K | 128K | 128K |
| Style de raisonnement | Thinking dynamique rapide | Raisonnement GPT xhigh | Raisonnement hybride avec effort X-High |
| Endpoints pris en charge | Chat + Gemini Native | Chat + Responses | Chat + Messages |
| Prix d'entrée PoYo | $0.90 / 1M | $3.00 / 1M | $4.00 / 1M |
| Prix de sortie PoYo | $5.40 / 1M | $18.00 / 1M | $20.00 / 1M |
Les informations Gemini proviennent de la documentation publique Google DeepMind et Google AI vérifiée le 21 mai 2026. Les valeurs GPT-5.5 et Claude Opus 4.7 utilisent la configuration des pages PoYo correspondantes.
Étape 1 : créer une clé API PoYo
Ouvrez le tableau de bord, générez une clé API et ajoutez des crédits pour l'usage chat.
Obtenir une clé API
Étape 2 : choisir un endpoint
Utilisez /v1/chat/completions pour les clients de style OpenAI ou /v1beta/models/gemini-3.5-flash:generateContent pour le format natif Gemini.
Étape 3 : envoyer une requêtecurl --request POST \
--url https://api.poyo.ai/v1/chat/completions \
--header 'Authorization: Bearer YOUR_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "gemini-3.5-flash",
"messages": [{"role": "user", "content": "Plan a fast coding agent."}]
}'
Voir la documentation API
| Compteur | Crédits PoYo | Équivalent USD |
|---|---|---|
| Gemini 3.5 Flash input | 180 credits / 1M tokens | $0.90 / 1M tokens |
| Gemini 3.5 Flash output | 1080 credits / 1M tokens | $5.40 / 1M tokens |
La tarification PoYo est positionnée environ 40 % moins chère que le prix officiel. Aucun abonnement : une clé API, un suivi d'usage et des crédits à la demande.
Commencez à utiliser gemini-3.5-flash sans configuration fournisseur séparée, avec le même dashboard et la même clé API PoYo.
PoYo affiche des tarifs clairs pour les tokens d'entrée et de sortie, avec Gemini 3.5 Flash environ 40 % moins cher que le prix officiel.
Utilisez le chat compatible OpenAI pour migrer vite ou Gemini Native Format pour les payloads propres à Gemini.
Testez les prompts sur la page modèle, surveillez l'usage, puis passez le même model ID en production.