DeepSeek-V4 : l'IA open source chinoise défie les géants américains
DeepSeek dévoile DeepSeek-V4-Preview, deux modèles open weight performants à bas coût, rivalisant avec les leaders américains comme Claude Opus 4.6 et GPT-5.4. Leur architecture MoE et leur fenêtre d'1 million de tokens en font des alternatives sérieuses.
« DeepSeek revendique des performances comparables aux meilleurs modèles fermés américains à des tarifs API plusieurs fois inférieurs grâce à une architecture plus légère. » — Numerama
Que faut-il retenir ?
- DeepSeek-V4-Pro a 1 600 milliards de paramètres et active 49 milliards par requête.
- DeepSeek-V4-Flash a 284 milliards de paramètres et 13 milliards actifs en MoE.
- Les modèles ont été entraînés sur 32 000 milliards de tokens.
- DeepSeek-V4-Pro rivalise avec Claude Opus 4.6-Max et GPT-5.4-xHigh.
Pourquoi cette nouvelle compte-t-elle ?
Ces modèles open weight offrent une alternative performante et économique aux solutions propriétaires américaines, réduisant les coûts d'infrastructure et favorisant l'indépendance technologique. Leur architecture MoE permet une utilisation optimisée des ressources, ce qui pourrait influencer les stratégies d'adoption de l'IA.
32 000 milliards de tokens utilisés pour l'entraînement.
Public concerné : développeurs, entreprises