Hetzner expérimente une API d'inférence IA compatible OpenAI, utilisant le modèle innovant Qwen3.6-35B-A3B-FP8 avec un contexte de 262K.
24 juillet 2026
#llm
Un benchmark révèle que les grands modèles de langage plafonnent en personnalisation dans le secteur des ventes, sans différencier succès et échec.
24 juillet 2026
#llm
BatchDAG optimise l'analyse des données d'entreprise avec un DAG intelligent, réduisant les appels LLM jusqu'à 47 fois.
22 juillet 2026
#llm
BatchDAG transforme l'analyse de 50 000 réunions en moins de 60 secondes, réduisant les appels LLM jusqu'à 47 fois.
22 juillet 2026
#llm
BatchDAG réduit les appels IA par 47x grâce à une orchestration par DAG pour analyser de vastes ensembles de données en entreprise.
22 juillet 2026
#llm
Les chatbots LLM révèlent une instabilité dans les dialogues prolongés, posant des défis pour l'interaction humain-IA.
22 juillet 2026
#llm
Les chatbots basés sur LLM peinent à dialoguer avec un véritable objectif, limitant ainsi l'interaction homme-IA.
22 juillet 2026
#llm
La perte de stabilité des chatbots LLaMA2-chat-70B et GPT-3.5-turbo-16k après 1,6k tokens pose des enjeux de sécurité majeurs.
22 juillet 2026
#llm
NVIDIA optimise les benchmarks de modèles de langage distribués avec srt-slurm, transformant des configurations YAML en workflows SLURM reproductibles.
22 juillet 2026
#llm
SLIC réduit les coûts de calculs de 93,3 % en attribuant les contributions dans les systèmes à agents multiples.
22 juillet 2026
#llm
Quatre projets open source influencent actuellement le fine-tuning des LLM, se distinguant par leurs innovations respectives.
22 juillet 2026
#llm
LenVM d'Apple double la précision des modèles en modélisant la longueur génération de chaque étape de décodage.
22 juillet 2026
#llm
Sam Altman veut un modèle IA type GPT-3 sur matériel grand public pour devancer des concurrents comme Stability et freiner leur expansion.
20 juillet 2026
#llm
DoorDash déploie des jurys LLM et l'IA multimodale pour optimiser les métadonnées alimentaires, renforçant ainsi la précision des informations produits.
14 juillet 2026
#llm
Anthropic utilise le Jacobian lens pour analyser et comprendre les processus internes des modèles de langage IA.
10 juillet 2026
#llm
Le 9 juillet 2026, llm 0.31.1 résout un bug critique affectant les appels d'outils vides avec OpenAI Chat Completion grâce à une mise à jour ciblée.
10 juillet 2026
#llm
La version 0.1 de llm-meta-ai, sortie le 9 juillet 2026, permet d'exécuter des prompts sur le modèle muse-spark-1.1 via l'API Meta AI.
10 juillet 2026
#llm
Lyzr utilise SivaClaw, son agent IA, pour lever 100 millions de dollars, atteignant une valorisation de 500 millions.
10 juillet 2026
#llm
Radical Numerics lève 50 millions de dollars pour développer des IA multimodales transformant l'analyse biologique et la médecine.
10 juillet 2026
#llm
Deux vulnérabilités critiques détectées dans Android 17 permettent de prendre le contrôle de smartphones via Firefox.
9 juillet 2026
#llm
Castellum.AI souligne le rôle croissant de l'IA dans la conformité AML, augmentant l'efficacité tout en demandant des explications précises.
9 juillet 2026
#llm
Les équipes SEO d'entreprise développent de nouvelles méthodes pour tester les stratégies de recherche IA.
9 juillet 2026
#llm
Liquid AI lance Antidoom pour diminuer les boucles infinies dans les modèles de raisonnement, avec une réduction significative des taux de boucles.
8 juillet 2026
#llm
NVIDIA dévoile Audex (Nemotron-Labs-Audex-30B-A3B), un modèle MoE unifiant reconnaissance vocale et texte sans perte notable sur les benchmarks de Nemotron-Cascade-2.
8 juillet 2026
#llm
OpenAI inclut deux nouveaux modèles Realtime dans son API, optimisés pour la latence réduite dans les applications vocales.
7 juillet 2026
#llm
Une extension trompeuse détourne les recherches Chrome, compromettant la confidentialité des utilisateurs.
6 juillet 2026
#llm
Après 20 jours de retrait, les modèles AI d'Anthropic reviennent en ligne suite à un différend avec l'administration Trump.
3 juillet 2026
#llm
Une startup s'attaque au problème d'uniformité des LLM pour éviter la pensée unique dans les IA comme ChatGPT et Gemini.
3 juillet 2026
#llm
L'étude démontre que les systèmes multi-agents LLM échouent souvent, avec 53,5% d'exactitude pour identifier l'agent responsable.
2 juillet 2026
#llm
Les navigateurs IA utilisant des LLM sont vulnérables à des attaques simples qui contournent leurs garde-fous.
2 juillet 2026
#llm
Loop Engineering transforme le développement des AI en passant des prompts directs à des boucles autonomes, révolutionnant la gestion des tâches.
2 juillet 2026
#llm
Une startup cherche à résoudre le biais de groupe des grands modèles de langage en IA, souvent observé dans les réponses générées.
1 juillet 2026
#llm