#LLM
Sélection de matériaux sur «LLM»: sorties, recherche, benchmarks, open-source.

Anthropic et Claude au cœur du débat : un chatbot peut-il aller contre la logique des Big Tech ?
Une chronique sur Claude montre comment la politesse envers un chatbot et les discussions sur une possible conscience de AI soulèvent une qu

Le ChatGPT 5.4 d'OpenAI a surpassé Claude Opus 4.6 et Gemini 3.1 Pro dans une comparaison sur Habr
Habr a publié une comparaison de trois modèles phares sur des tâches courantes : ChatGPT 5.4 a pris la première place au score total, Gemini

OpenAI a Lancé GPT-5.4 Mini et Nano — Qualité Quasi-Flagship à Moindre Coût

Le Pentagone prépare des circuits fermés pour entraîner des modèles d'IA sur des données classifiées

Anthropic a expliqué comment créer des skills pour Claude Code et pourquoi les équipes ont besoin de leur propre marketplace

Claude Opus 4.6 a détecté un piège caché dans un PDF et révélé les nouvelles règles du recrutement

OTUS : pourquoi les modèles de langage hallucinent et quelles mesures réduisent le risque d'erreurs

Obsidian et Claude pour le développement : comment construire une base de connaissances sans perdre le contexte

Doubletapp a expliqué pourquoi des datasets de faible qualité empêchent AI d'améliorer le NPS, le CTR et la conversion

OpenAI renforce la protection des comptes ChatGPT et lance un partenariat avec Yubico
OpenAI a lancé pour ChatGPT le mode Advanced Account Security : connexion uniquement via des passkeys ou des clés de sécurité physiques, san

Mastercard a créé un modèle de fondation tabulaire pour lutter contre la fraude aux paiements
Mastercard a entraîné un modèle tabulaire à grande échelle sur des milliards de transactions par carte afin de détecter la fraude plus préci










