Éditeur · vérifié par la rédaction

MarkTechPost

Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.

290 articles dans Hamidun·Dernier: 17 juillet· Actif·marktechpost.com ↗

Dernières publications

Alibaba lance OpenSandbox, un environnement unifié pour le fonctionnement sécurisé des agents AI
LLMMarkTechPost

Alibaba lance OpenSandbox, un environnement unifié pour le fonctionnement sécurisé des agents AI

Alibaba a publié le code source d'OpenSandbox, un outil qui fournit aux agents AI des sandboxes isolées pour l'exécution de code, la navigation web et l'entraînement de modèles. C'est une tentative d'imposer un standard

3 mars 2026·3 min
Alibaba a lancé Qwen 3.5 Small — des modèles compacts conçus pour fonctionner directement sur les appareils
LLMMarkTechPost

Alibaba a lancé Qwen 3.5 Small — des modèles compacts conçus pour fonctionner directement sur les appareils

La nouvelle série de modèles d’Alibaba, de 0,8 à 9 milliards de paramètres, remet en cause la course à la taille. La philosophie du «plus d’intelligence, moins de calcul» pourrait changer la donne pour l’AI mobile.

3 mars 2026·3 min
SHAP-IQ : un nouveau standard de l’AI explicable entre dans l’usage pratique
LLMMarkTechPost

SHAP-IQ : un nouveau standard de l’AI explicable entre dans l’usage pratique

La bibliothèque SHAP-IQ permet non seulement d’évaluer l’importance des variables d’un modèle, mais aussi de comprendre comment elles interagissent entre elles. Nous expliquons pourquoi cela change l’approche de l’interp

2 mars 2026·3 min
Google présente STATIC : recherche générative 948 fois plus rapide
LLMMarkTechPost

Google présente STATIC : recherche générative 948 fois plus rapide

Google AI a développé un framework basé sur des matrices creuses qui accélère le décodage dans les systèmes de recommandation génératifs de près de 1 000 fois. Cela pourrait changer l'approche des recommandations à l'éch

2 mars 2026·3 min
Alibaba présente CoPaw — une station de travail pour le passage à l’échelle des agents AI
LLMMarkTechPost

Alibaba présente CoPaw — une station de travail pour le passage à l’échelle des agents AI

L’équipe d’Alibaba a publié le framework open-source CoPaw, qui transforme la machine locale du développeur en un environnement complet pour exécuter des agents AI autonomes avec mémoire et flux de travail multicanaux.

1 mars 2026·2 min
Unified Latents : Google DeepMind trouve un moyen d'améliorer la génération par AI
LLMMarkTechPost

Unified Latents : Google DeepMind trouve un moyen d'améliorer la génération par AI

Le nouveau framework Unified Latents de Google DeepMind résout le dilemme entre la qualité de la compression des données et la précision des réseaux neuronaux.

28 févr. 2026·2 min
Sakana AI a appris à adapter instantanément les modèles de langage sans fine-tuning
LLMMarkTechPost

Sakana AI a appris à adapter instantanément les modèles de langage sans fine-tuning

Le laboratoire tokyoïte Sakana AI a présenté deux méthodes — Doc-to-LoRA et Text-to-LoRA — qui permettent d’adapter de grands modèles de langage à de nouvelles données en quelques fractions de seconde, sans fine-tuning c

27 févr. 2026·3 min
Perplexity lance pplx-embed : des modèles d'embeddings qui changent les règles de la recherche
LLMMarkTechPost

Perplexity lance pplx-embed : des modèles d'embeddings qui changent les règles de la recherche

Perplexity a présenté la famille multilingue de modèles d'embeddings pplx-embed, basée sur Qwen3 avec une attention bidirectionnelle — et affirme établir un nouveau standard de qualité pour la recherche à l'échelle d'int

27 févr. 2026·3 min
Liquid AI défie la course aux modèles toujours plus grands : l’architecture hybride de LFM2 change les règles du jeu
LLMMarkTechPost

Liquid AI défie la course aux modèles toujours plus grands : l’architecture hybride de LFM2 change les règles du jeu

La startup Liquid AI a présenté un modèle de 24 milliards de paramètres qui combine le mécanisme d’attention et des convolutions. L’objectif est de résoudre les problèmes de passage à l’échelle auxquels se heurte l’ensem

25 févr. 2026·3 min
Composio ouvre le code d'Agent Orchestrator, un outil pour les systèmes multi-agents au-delà de ReAct
LLMMarkTechPost

Composio ouvre le code d'Agent Orchestrator, un outil pour les systèmes multi-agents au-delà de ReAct

La startup Composio a publié en open source un orchestrateur d'agents qui s'attaque au principal problème de l'AI en production : la fragilité des boucles ReAct simples. La nouvelle approche promet des workflows multi-ag

24 févr. 2026·3 min
Le mode WebSocket d’OpenAI change les règles du jeu pour l’AI vocale
LLMMarkTechPost

Le mode WebSocket d’OpenAI change les règles du jeu pour l’AI vocale

OpenAI a présenté un mode WebSocket pour la Realtime API qui élimine le principal ennemi des agents vocaux AI : la latence. Trois étapes distinctes du traitement vocal sont désormais condensées en un seul flux.

24 févr. 2026·3 min
Taalas défie les GPU : logique câblée plutôt que flexibilité pour 17 000 tokens par seconde
LLMMarkTechPost

Taalas défie les GPU : logique câblée plutôt que flexibilité pour 17 000 tokens par seconde

La start-up canadienne Taalas parie sur ce que l'industrie des puces AI considérait comme une hérésie : remplacer les GPU programmables par des puces spécialisées à logique câblée. Résultat : 17 000 tokens par seconde.

23 févr. 2026·3 min
TruLens : comment cesser de faire aveuglément confiance aux LLM et commencer à mesurer la qualité
LLMMarkTechPost

TruLens : comment cesser de faire aveuglément confiance aux LLM et commencer à mesurer la qualité

Les modèles de langage restent encore des boîtes noires pour la plupart des développeurs. TruLens propose une boîte à outils qui rend chaque étape du fonctionnement d’un LLM transparente et mesurable — des données d’entr

23 févr. 2026·3 min
Google plaide pour penser plus en profondeur, pas plus longtemps — et divise par deux les coûts d'inférence
LLMMarkTechPost

Google plaide pour penser plus en profondeur, pas plus longtemps — et divise par deux les coûts d'inférence

Des chercheurs de Google et de l'Université de Virginie ont montré qu'une longue chaîne de raisonnement n'est pas forcément meilleure. La nouvelle métrique Deep-Thinking Ratio permet d'améliorer la précision des LLM tout

22 févr. 2026·3 min
Google DeepMind a présenté Lyria 3 pour créer de la musique à partir de photos
LLMMarkTechPost

Google DeepMind a présenté Lyria 3 pour créer de la musique à partir de photos

Le nouveau modèle Lyria 3 de Google DeepMind marque une avancée dans la génération audio. L'AI peut désormais créer des morceaux complets avec voix et paroles à partir de simples photos ou de descriptions textuelles.

19 févr. 2026·2 min
Tavus présente Phoenix-4 : des avatars vidéo aux émotions réalistes et à la réponse instantanée
LLMMarkTechPost

Tavus présente Phoenix-4 : des avatars vidéo aux émotions réalistes et à la réponse instantanée

Le nouveau modèle Phoenix-4 surmonte l’effet de la « vallée de l’étrange » en ajoutant une intelligence émotionnelle aux avatars numériques et en ramenant la latence de génération à un niveau record de 600 millisecondes.

19 févr. 2026·2 min
Anthropic présente Claude 4.6 Sonnet avec une fenêtre de contexte d’un million de tokens
LLMMarkTechPost

Anthropic présente Claude 4.6 Sonnet avec une fenêtre de contexte d’un million de tokens

Anthropic entre dans l’ère des modèles de raisonnement. Claude 4.6 Sonnet dispose d’une fenêtre de contexte d’un million de tokens et d’un système innovant de vérification des faits via l’exécution de code.

18 févr. 2026·2 min
Google DeepMind a présenté un framework de délégation intelligente des tâches entre agents d’AI
LLMMarkTechPost

Google DeepMind a présenté un framework de délégation intelligente des tâches entre agents d’AI

Les chercheurs ont développé un système pour créer un « agentic web » sûr, dans lequel des programmes autonomes pourront interagir efficacement et passer à l’échelle.

16 févr. 2026·2 min
Google a présenté WebMCP : un nouveau standard pour l'interaction des agents d'AI avec le web
LLMMarkTechPost

Google a présenté WebMCP : un nouveau standard pour l'interaction des agents d'AI avec le web

Google a présenté le protocole WebMCP, qui permettra aux agents d'AI d'interagir avec les sites directement via la structure du code, en contournant l'analyse de captures d'écran, lente et gourmande en ressources.

15 févr. 2026·2 min
Architecture de la mémoire : comment apprendre aux agents AI à retenir l’essentiel et à raisonner de façon logique
LLMMarkTechPost

Architecture de la mémoire : comment apprendre aux agents AI à retenir l’essentiel et à raisonner de façon logique

Analyse d’un nouveau concept de mémoire pour les réseaux neuronaux : le passage du simple stockage de l’historique des dialogues à des bases de connaissances structurées pour une analyse approfondie des données.

15 févr. 2026·2 min
Guide de création d’un pipeline de données synthétiques avec CTGAN et SDV
LLMMarkTechPost

Guide de création d’un pipeline de données synthétiques avec CTGAN et SDV

Découvrez comment construire un système fiable de génération de données tabulaires garantissant une haute précision et la préservation de tous les schémas statistiques pour un entraînement sûr des réseaux de neurones.

14 févr. 2026·3 min
Comment entraîner AI aux préférences humaines : guide du DPO et de QLoRA
LLMMarkTechPost

Comment entraîner AI aux préférences humaines : guide du DPO et de QLoRA

Un nouveau tutoriel montre comment ajuster efficacement des modèles de langage aux préférences humaines sans recourir à des modèles de récompense lourds, avec un seul GPU.

13 févr. 2026·2 min
Google Gemini 3 Deep Think : nouveau record dans les tests d’intelligence générale
LLMMarkTechPost

Google Gemini 3 Deep Think : nouveau record dans les tests d’intelligence générale

Google a présenté Gemini 3 Deep Think. Le modèle a obtenu 84,6 % au test ARC-AGI-2, rapprochant l’industrie de la création de l’AGI grâce à des mécanismes de raisonnement logique approfondi.

13 févr. 2026·2 min
OpenAI a présenté GPT-5.3-Codex-Spark : une révolution de la vitesse pour le développement logiciel
LLMMarkTechPost

OpenAI a présenté GPT-5.3-Codex-Spark : une révolution de la vitesse pour le développement logiciel

OpenAI a lancé un modèle de codage ultra-rapide. Grâce aux puces de Cerebras, il produit 1 000 tokens par seconde, soit 15 fois plus vite que les versions standard.

13 févr. 2026·2 min
Comment entraîner des embeddings Matryoshka pour une recherche de données ultra-rapide
LLMMarkTechPost

Comment entraîner des embeddings Matryoshka pour une recherche de données ultra-rapide

Découvrez comment la technologie Matryoshka Representation Learning permet de réduire la taille des vecteurs à 64 dimensions sans perte significative de précision de recherche.

12 févr. 2026·2 min
NVIDIA a présenté KVTC : une technologie de compression du cache des LLM qui accélérera de 20 fois le fonctionnement des réseaux neuronaux
LLMMarkTechPost

NVIDIA a présenté KVTC : une technologie de compression du cache des LLM qui accélérera de 20 fois le fonctionnement des réseaux neuronaux

Des chercheurs de NVIDIA ont présenté KVTC, une méthode innovante de compression du KV-cache. Cette technologie permet de réduire la consommation de mémoire de 20 fois, en s'attaquant au principal problème de mise à l'éc

11 févr. 2026·2 min
Comment simplifier le développement de réseaux neuronaux : guide d'utilisation d'Einops pour les calculs tensoriels
LLMMarkTechPost

Comment simplifier le développement de réseaux neuronaux : guide d'utilisation d'Einops pour les calculs tensoriels

La bibliothèque Einops est en passe de devenir la norme pour travailler avec les tenseurs en deep learning. Nous expliquons comment rendre le code plus propre et éviter les erreurs dans les architectures Vision et Attent

11 févr. 2026·2 min
Google a présenté NAI : des interfaces adaptatives basées sur Gemini pour une conception inclusive
LLMMarkTechPost

Google a présenté NAI : des interfaces adaptatives basées sur Gemini pour une conception inclusive

Google Research propose de repenser l’accessibilité logicielle. Le framework NAI utilise des agents d’AI Gemini pour adapter instantanément l’interface aux capacités physiques et au contexte de l’utilisateur.

11 févr. 2026·2 min
Microsoft a présenté OrbitalBrain : apprentissage distribué de l'IA directement dans l'espace
LLMMarkTechPost

Microsoft a présenté OrbitalBrain : apprentissage distribué de l'IA directement dans l'espace

# Microsoft a Présenté OrbitalBrain : L'Entraînement Distribué de l'Intelligence Artificielle Directement dans l'Espace Les satellites terrestres collectent des pétabytes d'images haute résolution…

10 févr. 2026·2 min
OAT : comment la tokenization des actions rapproche les robots des capacités des LLM
LLMMarkTechPost

OAT : comment la tokenization des actions rapproche les robots des capacités des LLM

La robotique se trouve à la veille d'une nouvelle ère, largement grâce aux avancées dans les modèles de langage volumétrique (LLM).

9 févr. 2026·2 min