DeepSeek a levé le voile sur DeepSeek-V4 Preview, et les chiffres sont difficiles à ignorer. La société chinoise d'IA propose désormais deux nouveaux modèles, V4 Pro et V4 Flash, tous deux conçus pour des fenêtres de contexte d'un million de tokens, un repère qui met en lumière la gestion de longs documents, l'analyse de code et le raisonnement complexe.
Les modèles sont déjà accessibles via le site de DeepSeek en mode Instant et en mode Expert, tandis que l'API a également été mise à jour et est opérationnelle dès aujourd'hui. Sur un marché où la longueur de contexte est devenue l'un des principaux champs de bataille de l'IA, DeepSeek fait une proposition très directe : offrir des capacités sérieuses sans le tarif premium.
Deux modèles, une promesse de grande envergure
Sur le papier, la différence entre les deux variantes est frappante. DeepSeek-V4 Pro compte 1,6 trillion de paramètres au total avec 49 milliards de paramètres actifs, tandis que V4 Flash est plus léger, à 284 milliards de paramètres au total et 13 milliards de paramètres actifs. Les deux prennent en charge la même longueur de contexte massive d'1M, mais ils ciblent clairement des utilisateurs et des budgets différents.
DeepSeek affirme que le modèle Pro est le poids lourd de la famille. Il a été conçu avec de meilleures capacités agentiques, une connaissance du monde plus étendue et un raisonnement avancé que la société affirme surpasser les modèles open actuels en mathématiques, STEM et programmation. DeepSeek précise également que Pro est compétitif face aux meilleurs systèmes propriétaires, tout en ajoutant une réserve en indiquant qu'il reste derrière Gemini 3.1 Pro dans certains domaines.
Flash, quant à lui, représente le meilleur rapport qualité-prix. DeepSeek le décrit comme offrant un raisonnement proche de celui de Pro, tout en égalant Pro sur les tâches agent simples. L'atout réel est le coût. Flash est présenté comme l'option la plus abordable pour les développeurs qui veulent une IA à long contexte sans épuiser leur budget.
La tarification reflète cette stratégie. Pour Flash, le coût en entrée commence à 0,028 $ en cas de hit de cache et à 0,14 $ en cas de miss, tandis que la sortie est tarifée à 0,28 $. Pro est beaucoup plus élevé, avec une entrée tarifée à 0,145 $ ou 1,74 $ selon l'état du cache, et une sortie à 3,48 $.
Pour les utilisateurs qui souhaitent essayer les modèles immédiatement, DeepSeek a ouvert l'accès à chat.deepseek.com. La société indique également que les poids ouverts sont disponibles, ainsi qu'un rapport technique pour quiconque souhaite approfondir l'architecture, les benchmarks et les détails d'entraînement.
C'est une sortie audacieuse, qui relance la conversation sur le long contexte. DeepSeek ne se contente pas de poursuivre des chiffres impressionnants. L'entreprise cherche à démontrer que des modèles d'IA massifs peuvent rester pratiques, accessibles et abordables.




.webp)
Discussion
Laisser un commentaire
Commentaires
Aucun commentaire pour l'instant. Soyez le premier.