En une phrase
DeepSeek V4 Flash se distingue par sa vitesse de génération de tokens exceptionnelle (141 tokens/seconde) et son coût extrêmement bas, le rendant jusqu'à 100 fois moins cher que ses concurrents tout en offrant des résultats prometteurs.
Points clés
- Vitesse et Efficience : DeepSeek V4 Flash atteint 141 tokens par seconde, soit environ deux fois la vitesse des modèles GPT, grâce à des mécanismes comme "Dispark" et une approche par "sous-agents" qui utilisent seulement une partie des experts du modèle pour chaque requête.
- Coût Révolutionnaire : Le modèle est extrêmement abordable, avec un coût de 0,03€ par million de tokens en input, le rendant jusqu'à 100 fois moins cher que Claude Fable 5 et 30 fois moins cher que Kimika 3.
- Architecture Innovante : Malgré sa taille (presque 300 milliards de paramètres), il utilise une méthode de "sub-agents" et intègre "Dispark" pour un mécanisme de décodage et une sortie ultra-rapides, améliorant l'expérience utilisateur.
- Origines de l'Entreprise : Fondée par Lin Wfeng, DeepSeek est issue de High Flyer, un fonds d'investissement spécialisé dans le trading haute fréquence, qui a pivoté vers l'IA en s'appuyant sur son expertise en machine learning.
- Ambitions Stratégiques : DeepSeek a investi massivement dans les puces Nvidia A100, recrute activement pour doubler ses effectifs dans tous les départements (R&D, deep learning, etc.) et prévoit de développer ses propres puces IA, tout en investissant dans la robotique (Unitree).
- Culture d'Entreprise : La société se caractérise par une structure hiérarchique relativement plate, une priorité à la recherche, et confère d'énormes responsabilités à de jeunes diplômés, favorisant une avancée technique très rapide.
Ressources
- Ollama — exécuter des LLM en local
- Cursor — environnement de développement mentionné
- High Flyer — fonds d'investissement ayant fondé DeepSeek
- Unitree — entreprise de robotique spécialisée dans les humanoïdes
- GLM 5.2 — modèle de langage mentionné
- Kimika 3 — modèle de langage mentionné
- Claude Fable 5 — modèle de langage mentionné
- Grock — modèle de langage mentionné
- Quen — modèle de langage mentionné
- Nvidia A100 — puce graphique utilisée pour l'entraînement de modèles IA