MarkTechPost
Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.
Dernières publications

Meta FAIR Publie NeuralSet — Paquet Python pour Connecter les Données Neurales et les Modèles d'IA
Meta FAIR a ouvert NeuralSet — un framework Python qui combine fMRI, M/EEG, spikes et embeddings de Hugging Face dans un seul pipeline PyTorch pour la recherche Neuro-AI.

L'équipe Qwen a lancé FlashQLA : accélération de l'attention linéaire jusqu'à 3× sur NVIDIA Hopper
QwenLM a lancé FlashQLA — une bibliothèque de kernels CUDA pour Gated Delta Network qui offre un gain de performance jusqu'à 3× sur GPU NVIDIA Hopper pour le préentraînement et l'inférence agentive.

OpenAI Privacy Filter : Comment Construire un Pipeline de Production pour la Détection et le Masquage des PII
Le guide OpenAI Privacy Filter détaille un pipeline complet pour détecter et masquer les données personnelles — du chargement du modèle à la rédaction automatique de texte.

DeepSeek, Google et Meta : 10 techniques de compression de KV-cache pour LLM afin de réduire la mémoire en inférence
KV-cache est devenu un gourmand de mémoire GPU dans les grands LLM, et une nouvelle revue présente 10 approches — de H2O et SnapKV à TurboQuant et MLA de DeepSeek — qui réduisent la consommation de mémoire sans restructu

Poolside a lancé Laguna XS.2 et M.1 — des modèles ouverts pour la programmation multi-agents
Poolside a présenté deux modèles Laguna pour le codage multi-agents : le XS.2 ouvert s'exécute localement, tandis que le plus puissant M.1 est conçu pour les tâches longues avec modifications de code, tests et travail en

LlamaIndex ParseBench : comment tester l'analyse de documents via Python et Hugging Face
Un guide pratique montre comment construire un pipeline d'évaluation des analyseurs de documents à l'aide du dataset LlamaIndex ParseBench : charger des PDFs depuis Hugging Face, comparer le texte extrait et mesurer la q

smol-audio de Deep-unlearning : Une collection de notebooks Colab pour l'affinage des modèles audio
Deep-unlearning a lancé smol-audio — une collection de notebooks compatibles avec Colab pour l'affinage de Whisper, Parakeet, Voxtral, Granite Speech et autres modèles audio.

Top 10 des modèles d'IA physique qui contrôlent les robots réels en 2026
En 18 mois, l'écart entre les LLM et la robotique réelle s'est considérablement réduit : les modèles d'IA physique fonctionnent déjà dans les usines, les entrepôts et les laboratoires de recherche.

Hugging Face et Gemma 3 1B: Construire un Pipeline de Génération Prêt pour la Production dans Colab
Une analyse de la manière d'exécuter Gemma 3 1B Instruct dans Colab via Hugging Face Transformers: avec une autorisation sécurisée, des chat templates et un pipeline d'inférence reproductible.

Z.ai lance GLM-5V-Turbo — modèle multimodal natif pour la programmation visuelle
Le laboratoire chinois Z.ai a lancé GLM-5V-Turbo — un modèle qui reconnaît les diagrammes architecturaux et les captures d'écran et génère immédiatement du code fonctionnel pour les systèmes d'ingénierie d'agents.

Google Gemma 4, NVIDIA et OpenClaw : Agents IA locaux sans facturation par token
Google et NVIDIA promeuvent le déploiement local de Gemma 4 sur RTX, Jetson et DGX Spark pour que les agents IA toujours actifs comme OpenClaw fonctionnent plus vite, moins cher et sans frais de token en cloud.

Talkie-1930: Les chercheurs ont lancé un modèle 13B sans connaissance d'Internet et de la Seconde Guerre mondiale
Talkie-1930 est un modèle 13B ouvert, entraîné uniquement sur des textes en anglais jusqu'en 1931, pour étudier la pensée historique, les fuites de données et la capacité de l'IA à généraliser au-delà de son époque.

MarkTechPost montre comment construire un agent VLA léger avec un modèle de monde latent et MPC
Dans un nouveau tutoriel, MarkTechPost explique comment construire un agent incarné simplifié : il fonctionne sur des images RGB, apprend un modèle de monde latent et planifie des actions via MPC.

Arcee AI a Lancé Trinity Large Thinking — Modèle de Raisonnement Ouvert pour Agents IA
Arcee AI a libéré les poids de Trinity Large Thinking sous licence Apache 2.0 et mise sur les scénarios d'agents longs, le raisonnement multi-étapes et l'utilisation sûre d'outils.

NVIDIA a présenté un pipeline complet d'optimisation de modèles avec FastNAS pruning et fine-tuning
NVIDIA a publié un guide pratique pour Model Optimizer : dans un seul notebook Colab sont démontrés l'entraînement de ResNet20, FastNAS pruning sous limite de FLOPs et récupération de qualité via fine-tuning.

TII lance Falcon Perception — modèle 0,6B pour la segmentation et la recherche d'objets par texte
TII a présenté Falcon Perception — un modèle vision-langage compact avec 0,6 milliard de paramètres qui recherche et segmente des objets à partir de requêtes texte simples, surpassant SAM 3 sur les requêtes complexes.

Google DeepMind Permet aux LLM de Réécrire les Algorithmes de la Théorie des Jeux et de Surpasser les Experts
Google DeepMind a démontré qu'AlphaEvolve peut réécrire le code des algorithmes pour les jeux avec information incomplète et trouver des solutions qui surpassent les versions manuelles des experts dans la plupart des tes

Z.AI a montré comment construire des systèmes agentic production-ready sur GLM-5 avec tool calling
Z.AI a lancé un tutoriel détaillé sur GLM-5 : de la configuration du SDK et de l'API compatible avec OpenAI au streaming, tool calling, sortie JSON et agent multi-turn pour la production.

Netflix Lance Void — Modèle pour Supprimer les Objets des Vidéos en Tenant Compte de la Physique de la Scène
L'équipe de Netflix et INSAIT a publié en open source Void — un système qui supprime les objets des vidéos tout en recalculant simultanément les chutes, le soutien des objets et autres conséquences physiques.

Comment l'Intelligence Artificielle Aide les Marques de Mode à Concevoir la Mode du Futur
Les algorithmes aident déjà les marques de mode à créer des collections plus rapidement, à prévoir les tendances, à réduire la surproduction et à personnaliser les achats, mais soulèvent également des questions sur l'aut

Comment Construire un Pipeline Netflix Void pour la Suppression d'Objets dans les Vidéos en Utilisant CogVideoX
Un examen détaillé montre comment déployer le modèle Netflix Void, télécharger les points de contrôle nécessaires, préparer les données d'entrée et exécuter la suppression d'objets vidéo via CogVideoX.

Gladstone Institutes présente MaxToki — un modèle d'IA qui prédit le vieillissement cellulaire
Le modèle MaxToki de Gladstone Institutes apprend à voir non pas un 'instantané' de la cellule, mais sa trajectoire au fil du temps, évalue l'accélération du vieillissement et identifie les cibles d'intervention.

TinyFish Lance une Plateforme Web Unifiée pour Agents IA avec Search, Fetch, Browser et Agent
TinyFish a combiné la recherche, le rendu de pages, les sessions de navigateur et les flux de travail web autonomes dans une plateforme unique pour les agents IA avec une seule clé API et un pool de crédits partagé.

Google a ajouté Skills dans Chrome et transformé les prompts d'IA en scénarios à un clic
Google a lancé la fonctionnalité Skills dans Chrome : les utilisateurs de Gemini pourront enregistrer les prompts fréquemment utilisés comme des scénarios réutilisables et les exécuter dans le navigateur en un seul clic.

Google DeepMind Présente Gemini Robotics-ER 1.6 pour l'Autonomie et la Lecture d'Instruments par les Robots
Google DeepMind a mis à jour Gemini Robotics-ER à la version 1.6 : un modèle pour robots qui comprend mieux l'espace, gère plusieurs flux vidéo et peut lire des instruments industriels complexes.

MarkTechPost a détaillé le cycle complet d'entraînement des grands modèles de langage : des données au déploiement
MarkTechPost a publié une analyse détaillée de la façon dont les LLM sont construits aujourd'hui : du préentraînement sur de grands corpus à SFT, RLHF, optimisation du raisonnement et déploiement en production.

Google a présenté Gemini 3.1 Flash TTS — modèle de parole avec contrôle, dialogues et 70+ langues
Google a lancé Gemini 3.1 Flash TTS en aperçu : le modèle synthétise du texte en 70+ langues, supporte les dialogues avec deux voix et permet de contrôler la livraison via des balises audio.

Mem0 et OpenAI : comment construire une couche universelle de mémoire à long terme pour les agents IA
Un nouveau tutoriel décortique la combinaison de Mem0, des modèles OpenAI et ChromaDB : elle extrait les faits des conversations ordinaires, les stocke par user_id, recherche par sens sémantique et les injecte dans les r

SmolAgents : Comment Construire un Système d'IA Multi-Agent avec Code et Orchestration Dynamique
Une analyse de l'implémentation de SmolAgents montre comment les agents d'IA légers exécutent du code, invoquent des outils, gèrent la mémoire et coordonnent les tâches au sein d'un seul système.

NetKet et JAX : comment construire un modèle Transformer pour les systèmes de spins frustrés
Le guide montre comment construire un pipeline de VMC de recherche en utilisant NetKet, JAX et l'architecture Transformer pour modéliser une chaîne de spin frustrée J1-J2.