Baseten a levé 13 milliards de dollars en série F et détaille avec Philip Kiely et Ali Taha les méthodes d’inférence à grande échelle.
20 août 2026
Meta publie Muse Glimmer, un modèle de 30 milliards de paramètres sous licence Apache 2.0, conçu pour exécuter des agents locaux sur GPU grand public.
19 août 2026
K-Search améliore les performances des GPU d'Apple Silicon en utilisant les connaissances éprouvées de CUDA, offrant des gains significatifs.
16 août 2026
Kimi K3, le modèle de 2,8 trillions de paramètres, est désormais déployable sur AWS grâce à ses poids ouverts.
31 juillet 2026
Hetzner expérimente une API d'inférence IA compatible OpenAI, utilisant le modèle innovant Qwen3.6-35B-A3B-FP8 avec un contexte de 262K.
24 juillet 2026
Nunchaku permet une inférence 30% plus rapide avec moins de VRAM en intégrant la quantification 4-bit dans Diffusers.
23 juillet 2026
Nvidia s'associe à Lunar Outpost pour déployer ses GPUs Jetson sur un rover lunaire, une première sur la surface de la Lune.
23 juillet 2026
System76 dévoile en 2026 le Thelio Mira Custom, une station de travail Linux haut de gamme, débutant à 1 699 $ pour des performances maximales.
22 juillet 2026
NVIDIA GB300 NVL72 multiplie par 25 la performance par watt face à Hopper, établissant un nouveau standard d'efficacité énergétique pour l'IA.
15 juillet 2026
Des robots auto-améliorants et un cluster de 10k GPUs illustrent les avancées AI en Chine.
2 juillet 2026
Gardez un coup d'avance en business et IA
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés