MarkTechPost
Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.
Dernières publications

Alibaba lance OpenSandbox, un environnement unifié pour le fonctionnement sécurisé des agents AI
Alibaba a publié le code source d'OpenSandbox, un outil qui fournit aux agents AI des sandboxes isolées pour l'exécution de code, la navigation web et l'entraînement de modèles. C'est une tentative d'imposer un standard

Alibaba a lancé Qwen 3.5 Small — des modèles compacts conçus pour fonctionner directement sur les appareils
La nouvelle série de modèles d’Alibaba, de 0,8 à 9 milliards de paramètres, remet en cause la course à la taille. La philosophie du «plus d’intelligence, moins de calcul» pourrait changer la donne pour l’AI mobile.

SHAP-IQ : un nouveau standard de l’AI explicable entre dans l’usage pratique
La bibliothèque SHAP-IQ permet non seulement d’évaluer l’importance des variables d’un modèle, mais aussi de comprendre comment elles interagissent entre elles. Nous expliquons pourquoi cela change l’approche de l’interp

Google présente STATIC : recherche générative 948 fois plus rapide
Google AI a développé un framework basé sur des matrices creuses qui accélère le décodage dans les systèmes de recommandation génératifs de près de 1 000 fois. Cela pourrait changer l'approche des recommandations à l'éch

Alibaba présente CoPaw — une station de travail pour le passage à l’échelle des agents AI
L’équipe d’Alibaba a publié le framework open-source CoPaw, qui transforme la machine locale du développeur en un environnement complet pour exécuter des agents AI autonomes avec mémoire et flux de travail multicanaux.

Unified Latents : Google DeepMind trouve un moyen d'améliorer la génération par AI
Le nouveau framework Unified Latents de Google DeepMind résout le dilemme entre la qualité de la compression des données et la précision des réseaux neuronaux.

Sakana AI a appris à adapter instantanément les modèles de langage sans fine-tuning
Le laboratoire tokyoïte Sakana AI a présenté deux méthodes — Doc-to-LoRA et Text-to-LoRA — qui permettent d’adapter de grands modèles de langage à de nouvelles données en quelques fractions de seconde, sans fine-tuning c

Perplexity lance pplx-embed : des modèles d'embeddings qui changent les règles de la recherche
Perplexity a présenté la famille multilingue de modèles d'embeddings pplx-embed, basée sur Qwen3 avec une attention bidirectionnelle — et affirme établir un nouveau standard de qualité pour la recherche à l'échelle d'int

Liquid AI défie la course aux modèles toujours plus grands : l’architecture hybride de LFM2 change les règles du jeu
La startup Liquid AI a présenté un modèle de 24 milliards de paramètres qui combine le mécanisme d’attention et des convolutions. L’objectif est de résoudre les problèmes de passage à l’échelle auxquels se heurte l’ensem

Composio ouvre le code d'Agent Orchestrator, un outil pour les systèmes multi-agents au-delà de ReAct
La startup Composio a publié en open source un orchestrateur d'agents qui s'attaque au principal problème de l'AI en production : la fragilité des boucles ReAct simples. La nouvelle approche promet des workflows multi-ag

Le mode WebSocket d’OpenAI change les règles du jeu pour l’AI vocale
OpenAI a présenté un mode WebSocket pour la Realtime API qui élimine le principal ennemi des agents vocaux AI : la latence. Trois étapes distinctes du traitement vocal sont désormais condensées en un seul flux.

Taalas défie les GPU : logique câblée plutôt que flexibilité pour 17 000 tokens par seconde
La start-up canadienne Taalas parie sur ce que l'industrie des puces AI considérait comme une hérésie : remplacer les GPU programmables par des puces spécialisées à logique câblée. Résultat : 17 000 tokens par seconde.

TruLens : comment cesser de faire aveuglément confiance aux LLM et commencer à mesurer la qualité
Les modèles de langage restent encore des boîtes noires pour la plupart des développeurs. TruLens propose une boîte à outils qui rend chaque étape du fonctionnement d’un LLM transparente et mesurable — des données d’entr

Google plaide pour penser plus en profondeur, pas plus longtemps — et divise par deux les coûts d'inférence
Des chercheurs de Google et de l'Université de Virginie ont montré qu'une longue chaîne de raisonnement n'est pas forcément meilleure. La nouvelle métrique Deep-Thinking Ratio permet d'améliorer la précision des LLM tout

Google DeepMind a présenté Lyria 3 pour créer de la musique à partir de photos
Le nouveau modèle Lyria 3 de Google DeepMind marque une avancée dans la génération audio. L'AI peut désormais créer des morceaux complets avec voix et paroles à partir de simples photos ou de descriptions textuelles.

Tavus présente Phoenix-4 : des avatars vidéo aux émotions réalistes et à la réponse instantanée
Le nouveau modèle Phoenix-4 surmonte l’effet de la « vallée de l’étrange » en ajoutant une intelligence émotionnelle aux avatars numériques et en ramenant la latence de génération à un niveau record de 600 millisecondes.

Anthropic présente Claude 4.6 Sonnet avec une fenêtre de contexte d’un million de tokens
Anthropic entre dans l’ère des modèles de raisonnement. Claude 4.6 Sonnet dispose d’une fenêtre de contexte d’un million de tokens et d’un système innovant de vérification des faits via l’exécution de code.

Google DeepMind a présenté un framework de délégation intelligente des tâches entre agents d’AI
Les chercheurs ont développé un système pour créer un « agentic web » sûr, dans lequel des programmes autonomes pourront interagir efficacement et passer à l’échelle.

Google a présenté WebMCP : un nouveau standard pour l'interaction des agents d'AI avec le web
Google a présenté le protocole WebMCP, qui permettra aux agents d'AI d'interagir avec les sites directement via la structure du code, en contournant l'analyse de captures d'écran, lente et gourmande en ressources.

Architecture de la mémoire : comment apprendre aux agents AI à retenir l’essentiel et à raisonner de façon logique
Analyse d’un nouveau concept de mémoire pour les réseaux neuronaux : le passage du simple stockage de l’historique des dialogues à des bases de connaissances structurées pour une analyse approfondie des données.

Guide de création d’un pipeline de données synthétiques avec CTGAN et SDV
Découvrez comment construire un système fiable de génération de données tabulaires garantissant une haute précision et la préservation de tous les schémas statistiques pour un entraînement sûr des réseaux de neurones.

Comment entraîner AI aux préférences humaines : guide du DPO et de QLoRA
Un nouveau tutoriel montre comment ajuster efficacement des modèles de langage aux préférences humaines sans recourir à des modèles de récompense lourds, avec un seul GPU.

Google Gemini 3 Deep Think : nouveau record dans les tests d’intelligence générale
Google a présenté Gemini 3 Deep Think. Le modèle a obtenu 84,6 % au test ARC-AGI-2, rapprochant l’industrie de la création de l’AGI grâce à des mécanismes de raisonnement logique approfondi.

OpenAI a présenté GPT-5.3-Codex-Spark : une révolution de la vitesse pour le développement logiciel
OpenAI a lancé un modèle de codage ultra-rapide. Grâce aux puces de Cerebras, il produit 1 000 tokens par seconde, soit 15 fois plus vite que les versions standard.

Comment entraîner des embeddings Matryoshka pour une recherche de données ultra-rapide
Découvrez comment la technologie Matryoshka Representation Learning permet de réduire la taille des vecteurs à 64 dimensions sans perte significative de précision de recherche.

NVIDIA a présenté KVTC : une technologie de compression du cache des LLM qui accélérera de 20 fois le fonctionnement des réseaux neuronaux
Des chercheurs de NVIDIA ont présenté KVTC, une méthode innovante de compression du KV-cache. Cette technologie permet de réduire la consommation de mémoire de 20 fois, en s'attaquant au principal problème de mise à l'éc

Comment simplifier le développement de réseaux neuronaux : guide d'utilisation d'Einops pour les calculs tensoriels
La bibliothèque Einops est en passe de devenir la norme pour travailler avec les tenseurs en deep learning. Nous expliquons comment rendre le code plus propre et éviter les erreurs dans les architectures Vision et Attent

Google a présenté NAI : des interfaces adaptatives basées sur Gemini pour une conception inclusive
Google Research propose de repenser l’accessibilité logicielle. Le framework NAI utilise des agents d’AI Gemini pour adapter instantanément l’interface aux capacités physiques et au contexte de l’utilisateur.

Microsoft a présenté OrbitalBrain : apprentissage distribué de l'IA directement dans l'espace
# Microsoft a Présenté OrbitalBrain : L'Entraînement Distribué de l'Intelligence Artificielle Directement dans l'Espace Les satellites terrestres collectent des pétabytes d'images haute résolution…

OAT : comment la tokenization des actions rapproche les robots des capacités des LLM
La robotique se trouve à la veille d'une nouvelle ère, largement grâce aux avancées dans les modèles de langage volumétrique (LLM).