EN
en direct
tag

#llm

Gemma 3 sort en open weights sous licence Apache 2.0 — Google abandonne le semi-ouvert et met la pression sur Llama 4

Google DeepMind a publié le 5 août 2026 Gemma 3, un modèle de 27 milliards de paramètres en open weights sous licence Apache 2.0, avec une fenêtre de contexte d’un million de tokens et une version 7B qui surpasse Llama 4 8B sur MMLU-Pro. Si vous hésitez entre Llama et Gemma pour votre prochain déploiement, le choix vient de se simplifier.

AWS lance AgentCore Runtime Instances — le compute persistant élimine le cold start des agents IA en production

Présenté au AWS Summit New York le 7 août 2026, AgentCore Runtime Instances apporte un compute stateful et persistant aux agents Bedrock, supprimant le *cold start* qui pénalisait les déploiements temps réel. Si vos agents IA mettent plus de trois secondes à répondre, le problème vient probablement de votre infrastructure — et AWS vient de le résoudre.

Le homelab 2026 franchit le cap de l’IA locale — les modèles légers rendent l’inférence privée accessible sur un budget Raspberry Pi

En août 2026, l’écosystème du self-hosted vit une mutation silencieuse mais décisive : les modèles de langage compacts (Gemma 3 1B, Llama 4 3B quantifié, Qwen 3 0.5B) permettent désormais de faire tourner une IA conversationnelle locale sur du matériel grand public. Voici ce qui est réaliste aujourd’hui, ce qui ne l’est pas encore, et comment démarrer sans exploser votre facture électrique.

NetworkManager et Linux imposent des politiques anti-IA-slops — l’open source trace la ligne rouge des contributions assistées par LLM

Le 7 août 2026, NetworkManager a adopté une politique formelle encadrant les contributions assistées par IA, rejoignant le mainteneur WiFi Linux qui a instauré une règle de « revue en trois secondes ». Les projets open source ne ferment pas la porte aux LLM, mais ils définissent désormais les conditions d’un usage acceptable — et les sanctions en cas d’abus.

OpenAI rend GPT-5.6 Sol plus fiable et offre GPT-5.6 Luna en illimité aux utilisateurs gratuits

Le 6 août 2026, OpenAI a annoncé une mise à jour majeure de ChatGPT : GPT-5.6 Sol gagne en fiabilité pour les abonnés Plus et Pro, tandis que les utilisateurs gratuits passent en conversations texte illimitées avec GPT-5.6 Luna. Si vous payez encore ChatGPT sans comprendre ce que cette mise à jour change, voici le rapport qualité-prix réel du nouveau tiering.

Qwen3.8 Max d’Alibaba intègre le top 5 mondial des modèles d’IA et relègue Claude Opus 4.8 au sixième rang

Le 5 août 2026, le benchmark indépendant Artificial Analysis a classé Qwen3.8 Max au cinquième rang mondial avec un score de 58,08 sur l’Intelligence Index, devant Claude Opus 4.8 et GPT-5.6 Terra. Pour 0,03 $ par tâche, Alibaba propose une alternative crédible aux modèles américains — mais la question de la confiance réglementaire reste entière.

Un ver IA se propage dans Copilot pour Word — Microsoft ne peut pas le stopper

Le 28 juillet 2026, le chercheur Håkon Måløy a publié la première démonstration publique d’un ver IA document-borne capable d’altérer des rapports financiers et de s’auto-propager dans Copilot pour Word. Après 144 jours de divulgation coordonnée et deux tentatives de correction — dont une montée de version vers GPT-5.6 — la classe de vulnérabilité reste exploitable.

Debian soumet l’usage des LLM au vote de ses développeurs

Le 30 juillet 2026, cinq propositions sont sur la table pour encadrer ou interdire l’IA générative dans les contributions au projet Debian. Le résultat de ce vote influencera l’ensemble de l’écosystème open-source.

Tapez au moins deux caractères.

naviguer ouvrir esc fermer