2026
7 718 articles · 100 jours · 10 catégories · moy. 77 par jour

Sunrun proposera à ses clients d’héberger des nœuds de calcul pour l’AI à domicile
L’entreprise énergétique américaine Sunrun lance un projet pilote permettant aux propriétaires de panneaux solaires et de batteries de recev

Australian Payments Plus a accéléré les paiements avec ChatGPT Enterprise et Codex
L’entreprise australienne de paiements a déployé ChatGPT Enterprise et Codex pour automatiser le traitement des paiements, tout en conservan

OpenAI a critiqué le benchmark SWE-Bench Pro pour l'inexactitude de son évaluation

OpenAI lance la famille GPT-5.6 avec trois modèles et un mode ultra

OpenAI double la récompense pour la découverte de jailbreaks biologiques, à 50 000 dollars

OpenAI présente ChatGPT Work — un agent pour des projets de plusieurs heures

AegisDx : un framework d’AI pour un diagnostic sûr a surpassé GPT-5 dans l’évaluation des médecins

Ingénierie Harness : déplacer les garanties des agents LLM des prompts au code

Comment les réseaux de neurones comprennent les valeurs de différents pays : un ensemble de données de 500 000 exemples

Des scientifiques proposent la "plausibilité de l’alignement" comme standard de sécurité pour les LLM en médecine
Une prépublication sur arXiv justifie un standard de sécurité à trois niveaux pour les modèles de langage en santé mentale, par analogie ave

Le débiaisage des modèles NLP crée de nouveaux stéréotypes pour d’autres groupes démographiques
Une étude publiée sur arXiv a montré que les méthodes de prétraitement réduisent les biais pour les groupes cibles, mais les amplifient invo

EspanStereo : un nouveau jeu de données révèle les stéréotypes des LLM dans les cultures hispanophones

DeepSearch-Evolve : un agent web de 9 milliards de paramètres apprend sans supervision et atteint 61 % sur GAIA

Des chercheurs ont décrit comment les agents LLM et les humains sapent la confiance dans les chaînes d’information

Les LLM démontrent des théorèmes, mais ne découvrent pas les mathématiques : des chercheurs décrivent la prochaine étape

LSTM a surpassé Random Forest et Naive Bayes dans l’analyse de sentiment de tweets avec un ROC-AUC de 0,92

Context Graph : des chercheurs ont appris à des agents d’AI d’entreprise à fonctionner sans requêtes

LiST : une nouvelle méthode assure simultanément précision, robustesse et calibration des réseaux neuronaux

Datalab Lift contre concurrents : comment un extracteur 9B fonctionne avec JSON Schema

Anthropic lance le tableau de bord Reflect pour analyser votre utilisation de Claude

Meta a lancé Muse Spark 1.1 — un agent multimodal avec un contexte de 1 million de tokens






















