Habr AI
Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.
Dernières publications

Une trilogie sur le GEO — l’optimisation pour ChatGPT, Claude et d’autres réseaux neuronaux — a été publiée
Une trilogie sur le GEO a été publiée sur Habr : l’expert affirme que l’optimisation de contenu pour ChatGPT et Claude n’est pas une surcouche du SEO, mais une nouvelle branche du marketing.

Les États-Unis ont fermé l’accès à Claude Mythos, la Chine restreint GLM et Qwen : les réseaux neuronaux sont devenus une arme stratégique
Les États-Unis ont retiré Claude Mythos de l’accès ouvert en raison de risques de cybersécurité, tandis que la Chine prépare une interdiction d’exporter GLM, Qwen et DouBao — le début de l’ère de la souveraineté numériqu

Yandex Realtime vs OpenAI Realtime : un développeur a mesuré la latence et basculé la production
Le développeur d'un réceptionniste vocal AI a comparé trois approches speech-to-speech : Yandex Realtime (~330 ms), OpenAI (~740 ms via VPN) et un pipeline obsolète en trois étapes (~4,4 secondes) — puis a choisi un gagn

habrGPT : entraînement d’un LLM 0.5B à partir de zéro sur des articles de Habr — nanochat de Karpathy et comparaison entre fp8 et bf16
Une expérience d’entraînement à partir de zéro d’un modèle de langage de 500 millions de paramètres sur le corpus de Habr : nanochat de Karpathy, un GPU domestique au lieu d’un cluster de 8×H100, et une comparaison entre

Rosselkhozbank publie le deuxième AI digest de l'évangéliste AI de son laboratoire Big Data
Olga Popova, du laboratoire AI de Rosselkhozbank, poursuit la série de digests sur l'intelligence artificielle pour la communauté professionnelle.

Un détecteur d’hallucinations composé de 6 modèles de langage a repéré des erreurs dans l’annotation de référence
Des chercheurs ont assemblé un détecteur d’hallucinations LLM en ensemble à partir de six modèles et ont découvert que le prétendu angle mort des juges correspondait en réalité à des erreurs dans l’annotation de référenc

Citation ou mention : ce qui donne réellement de la visibilité à une marque dans les réponses de ChatGPT et Perplexity
Pendant plusieurs mois, l’auteur a suivi les réponses de ChatGPT, Perplexity et Alice au sujet des marques — et a constaté qu’un lien dans les sources d’une réponse AI n’équivaut pas à une visibilité réelle.

Un an avec des assistants AI en production : l’expérience de VTB, T-Bank et Dodo Engineering
VTB, T-Bank, Dodo Engineering et S7 TechLab ont discuté de ce qui a réellement changé dans les équipes après un an d’usage massif d’assistants AI de programmation et de savoir si l’efficacité a progressé.

Des employés font fuiter des données d’entreprise dans ChatGPT : le volume a été multiplié par 30 en un an
Solar Group a analysé 150 entreprises et a constaté que 60 % d’entre elles ne contrôlent pas le transfert de données vers des services d’AI publics — et cela les expose déjà à des amendes.

Veo 3.1, Kling, Sora 2 et Grok : test de cinq générateurs vidéo AI avec les mêmes prompts
Les auteurs de Habr ont soumis Veo 3.1, Kling v3 Omni, Sora 2 Pro, LTX-2.3 Pro et Grok à sept scénarios identiques — du chevalier au chat paniqué.

Les réseaux neuronaux sont de mauvaises calculatrices : pourquoi les LLM se trompent en arithmétique et comment y remédier
Les modèles de langage prédisent des tokens au lieu de calculer, d'où leurs erreurs assurées au milieu des nombres longs. Nous détaillons le mécanisme et expliquons comment l'industrie le contourne.

Un réseau neuronal de 49 000 paramètres à la place des tests Playwright pour un jeu de stratégie sur navigateur
Un développeur a remplacé une partie des tests E2E d’un jeu de stratégie spatiale sur navigateur par un pilote automatique de 49 000 paramètres — TypeScript sans ONNX, cinq écueils de 67 % à 99,7 % de précision.

Sysdig décrit la première attaque de ransomware autonome par agent IA sans intervention humaine
Les chercheurs de Sysdig ont documenté la première attaque de ransomware entièrement autonome de l'histoire : un agent IA sans intervention humaine a complété tout le cycle de compromission—de la reconnaissance au chiffr

L'IA Fantôme Dévore le Budget et les Données : Comment Choisir une Plateforme d'IA d'Entreprise en 2026
Les grandes entreprises ont découvert des dizaines d'initiatives d'IA non coordonnées sans contrôle des dépenses et des fuites de données — et cherchent une base unique gérée.

Raiffeisenbank : 500 ingénieurs ont adopté l'IA, mais la vitesse de développement n'a pas augmenté
Marat Kinyabulatov de Raiffeisenbank explique pourquoi la vague de 500 ingénieurs utilisant des outils d'IA n'a pas accéléré le développement et ce qu'il faut faire.

NVIDIA Dynamo contre Triton Inference Server : ce qui a changé pour l'inférence d'agents
NVIDIA a lancé le framework open-source Dynamo pour l'inférence LLM agentic avec routage KV-cache — contrairement à Triton, non conçu pour les appels parallèles d'agents.

Les agents IA cachent leurs erreurs : 6 modèles de défaillances silencieuses dans l'automatisation
OTUS sur Habr a analysé 6 modèles de défaillances silencieuses dans les agents IA : le système retourne une réponse convaincante, mais elle cache une action incorrecte ou une perte d'état.

Comment l'IA a écrit tout le code : une plateforme en 2,5 mois au lieu d'années
Deux développeurs ont lancé une plateforme d'analyse géospatiale en 2,5 mois, en renonçant entièrement à écrire du code : l'IA générait tout à partir des spécifications.

MTS Ouvre le Code AVI : Pare-feu Intelligent pour LLM qui Apprend de Nouvelles Règles en Secondes
L'équipe MTS AI a ouvert le code source d'AVI — un pare-feu modulaire externe pour LLM qui filtre les attaques par prompt et les réponses illégales sans réentraîner le modèle lui-même.

"Bidouille d'IA": Développeur de Bot Telegram a Découvert Pourquoi l'Étiquette "IA" Agace l'Audience
Développeur a construit un bot Telegram pendant trois mois, et le premier commentaire principal l'a appelé "bidouille d'IA" — l'auteur a découvert pourquoi ces deux mots agacent les lecteurs techniques.

Comment un développeur a réduit la consommation de tokens de l'agent IA de 4,6 millions par jour : analyse de la fuite
Les tâches cron, les diagnostics et les énormes listes d'outils consomment silencieusement des millions de tokens — un développeur a découvert la fuite et réduit la consommation quotidienne de 4,6 millions de tokens.

Prompts Anthropic contre skill grill-me : test de deux heures d'un non-développeur dans Claude Code
Un utilisateur Habr sans expérience en développement a comparé cinq prompts prêts à l'emploi de la bibliothèque Anthropic et le skill grill-me — et a écrit un parser Habr pendant la session.

Yttri 0.86.0-beta.1: Premier Plugin Obsidian, Moteur MLX et Interface d'Agent Unifiée
Yttri a publié la version 0.86.0-beta.1: l'agent a été déplacé vers section d'interface unifiée, plateforme de plugins lancée avec intégration Obsidian, et moteur MLX local pour Mac disponible.

Hallucinations dans l'IA pour le code : pourquoi les agents sont plus lents que le chercher-remplacer
Un développeur a passé deux heures sur une tâche pour un agent CLI qui se résolvait manuellement en 20 minutes — et a cherché pourquoi des prompts détaillés amplifient les hallucinations des LLM.

Fable contre 10 LLMs : qui maîtrise le mieux le god node d'un agent réel ?
L'auteur a testé 11 modèles de langage—dont Fable et six modèles chinois—sur la tâche de décomposer un god node réel d'un agent LangGraph, en utilisant des évaluations croisées et trois méthodes de vérification de confia

L'IA dans le développement : le vibe coding remplace les développeurs
Katya Obraztsova, de Bitrix24, raconte comment une équipe de cinq personnes a construit en trois mois un service d'entreprise à partir de zéro grâce au vibe coding, et est parvenue à une architecture d'équipe AI-driven.

À l'intérieur de l'IA chinoise : ByteDance, Z.ai, robots humanoides exigeant un passeport et le marché des cartes GPU pour serveurs
Huit jours de négociations avec ByteDance, Z.ai, SiliconFlow et MiniMax en Chine : ce qui sort le 10 juillet, pourquoi Z.ai passe de NVIDIA à Huawei et comment les humanoides sont vendus à Shanghai avec vérification de p

MCP et Sécurité des Agents IA : Comment le Protocole a Créé une Nouvelle Surface d'Attaque
Model Context Protocol a standardisé les connexions des agents IA aux outils — mais chaque serveur MCP est maintenant un point de confiance, vulnérable à l'empoisonnement d'outils et à l'injection de prompts.

VK a créé Discovery AI, une recherche neuronale pour la base de contenu multimilliardaire de Zen et VK Video
Un développeur leader de VK a dévoilé l'architecture de Discovery AI — un système basé sur LLM pour la recherche et les recommandations sur Zen, VKontakte, VK Video et Mail.

Comment construire un harnais IA pour le développement SaaS : la combinaison Orca, Pi Agent et GitHub
Un développeur sur Habr explique pourquoi un harnais bien conçu autour du modèle compte plus que le choix même entre GPT ou Claude — et présente sa configuration de travail.