Le 27 juillet 2026, Moonshot AI a publié les poids ouverts de Kimi K3, premier modèle de classe ~3T téléchargeable. Il est déjà disponible via l’API officielle et de nombreux providers d’inférence.
Cet article résume le modèle, l’intérêt de l’open weight, ses forces/faiblesses, des ordres de prix et des recommandations. Pour intégrer Kimi K3, contactez-moi.
Qu’est-ce que Kimi K3 ?
Modèle multimodal MoE (~2.8T paramètres, contexte 1M, vision native) conçu pour le coding agentique de longue durée, les outils et le debug multimodal.
- Portabilité API → self-host.
- Concurrence tarifaire multi-providers.
- Contrôle des données dans votre infra.
- Cache input ~$0.30/M très avantageux.
Points forts
- Coding agentique longue horizon
- Contexte 1M + vision native
- Tool calling itératif
- Disponibilité multi-provider dès le jour 0
Pour et contre
Pour
- Open weight frontier très compétitif
- Tarif liste ~$3 / $15 par 1M tokens
- Moins de vendor lock-in
- Multimodal + très long contexte
Contre
- Self-host = cluster multi-nœuds (1 To+)
- Stack d’inférence encore en stabilisation
- Latence/uptime variables selon l’hôte
- Pas le meilleur partout face aux modèles fermés premium
Prix estimatifs (juillet 2026)
| Provider | Input /M | Output /M | Cache /M | Notes |
|---|---|---|---|---|
| Moonshot AI | $3.00 | $15.00 | $0.30 | Prix officiel |
| Fireworks | $3.00 | $15.00 | $0.30 | Bon équilibre |
| Together | $3.00 | $15.00 | $0.30 | Alternative solide |
| Baseten | $3.00 | $15.00 | $0.30 | Options managed |
| Fireworks Fast | $4.50 | $22.50 | $0.45 | Premium vitesse |
| Modal | token-based | token-based | — | Shared API day-0 |
| OpenRouter | selon hôte | selon hôte | selon hôte | Routage multi-hôtes |
Recommandations
- Idéal pour agents de code à grand contexte.
- À éviter si vous espériez une seule GPU.
- Abstraire les providers + fallback modèle.
- Suivre cache hit, p95 et erreurs d’outils.
Besoin de développer avec Kimi K3 ? Écrivez-moi via la page contact.
À relier avec contact, données & IA et Claude Opus 5 .