#llm
10 articles
Mistral lance Mistral Large 3, le modèle européen qui rivalise avec GPT-4o
La pépite française de l'IA lance Mistral Large 3, son modèle le plus puissant, avec des scores qui talonnent GPT-4o sur plusieurs benchmarks. L'Europe a sa licorne IA.
OpenAI o3-mini-high : le raisonnement accessible pour tous les développeurs
OpenAI démocratise son modèle de raisonnement o3 avec o3-mini-high, disponible sur l'API à un prix 5x inférieur à o3. Le point de bascule pour les apps IA raisonnantes.
Claude 4 Opus d'Anthropic : un bond qualitatif sur le raisonnement et le code
Anthropic dévoile Claude 4 Opus, qui surpasse GPT-4o sur la majorité des benchmarks de raisonnement et de coding. La course à l'AGI s'intensifie.
Meta publie Llama 4 Scout et Maverick : les modèles open source qui rivalisent avec GPT-4o
Meta a publié Llama 4 Scout (17 milliards de paramètres actifs, MoE) et Llama 4 Maverick (400 milliards total) en open weights. Les deux surclassent leurs prédécesseurs sur les benchmarks et se rapprochent des modèles propriétaires. État des lieux.
DeepSeek V4 et Kimi K3 : deux poids lourds open-source en une semaine
La semaine du 24 juillet concentre deux sorties majeures de modèles open-weight : DeepSeek V4 Pro en stable release et Kimi K3 à 2,8 trillions de paramètres. La Chine installe durablement son empreinte dans l'IA ouverte.
Claude Opus 5 : Anthropic sort son nouveau flagship à prix inchangé
Lancé le 24 juillet 2026, Claude Opus 5 double les scores d'Opus 4.8 sur Frontier-Bench, atteint 99,5% des performances de Fable 5 sur CursorBench et triple le meilleur score sur ARC-AGI 3. Tarif maintenu à 5 dollars par million de tokens en entrée.
Prompt injection : quand les LLMs deviennent un vecteur d'attaque XSS nouvelle génération
Les agents IA qui lisent du contenu web pour vous sont devenus une surface d'attaque inédite. En cachant des instructions dans une page HTML, un attaquant peut prendre le contrôle de l'agent, exfiltrer des données ou exécuter des actions en votre nom. La prompt injection : le XSS de 2026.
Gemini 3.6 Flash : Google publie son nouveau modèle de travail
Lancé le 21 juillet 2026, Gemini 3.6 Flash est 17% plus économique en tokens que son prédécesseur, avec une fenêtre de contexte d'un million de tokens et un tarif en baisse sur les outputs.
OWASP Top 10 2026 : ce qui a changé et les nouvelles menaces qui font leur entrée
L'OWASP Top 10 2026 vient d'être publié. Deux nouvelles entrées font leur apparition : les vulnérabilités liées aux LLMs intégrés (prompt injection, training data poisoning) et les failles dans les pipelines CI/CD. Analyse des changements par rapport à 2021.
GPT-5.6 Sol, Terra, Luna : OpenAI lance trois modèles et un agent en une journée
Le 9 juillet 2026, OpenAI publie GPT-5.6 en trois tiers tarifaires (Sol, Terra, Luna), accompagnés de ChatGPT Work, un agent conçu pour exécuter des tâches complètes. Sol introduit l'Ultra Mode pour la coordination d'agents parallèles.