Éditeur · vérifié par la rédaction

MarkTechPost

Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.

290 articles dans Hamidun·Dernier: 17 juillet· Actif·marktechpost.com ↗

Dernières publications

Meta FAIR Publie NeuralSet — Paquet Python pour Connecter les Données Neurales et les Modèles d'IA
LLMMarkTechPost

Meta FAIR Publie NeuralSet — Paquet Python pour Connecter les Données Neurales et les Modèles d'IA

Meta FAIR a ouvert NeuralSet — un framework Python qui combine fMRI, M/EEG, spikes et embeddings de Hugging Face dans un seul pipeline PyTorch pour la recherche Neuro-AI.

30 avr. 2026·3 min
L'équipe Qwen a lancé FlashQLA : accélération de l'attention linéaire jusqu'à 3× sur NVIDIA Hopper
LLMMarkTechPost

L'équipe Qwen a lancé FlashQLA : accélération de l'attention linéaire jusqu'à 3× sur NVIDIA Hopper

QwenLM a lancé FlashQLA — une bibliothèque de kernels CUDA pour Gated Delta Network qui offre un gain de performance jusqu'à 3× sur GPU NVIDIA Hopper pour le préentraînement et l'inférence agentive.

30 avr. 2026·2 min
OpenAI Privacy Filter : Comment Construire un Pipeline de Production pour la Détection et le Masquage des PII
LLMMarkTechPost

OpenAI Privacy Filter : Comment Construire un Pipeline de Production pour la Détection et le Masquage des PII

Le guide OpenAI Privacy Filter détaille un pipeline complet pour détecter et masquer les données personnelles — du chargement du modèle à la rédaction automatique de texte.

30 avr. 2026·3 min
DeepSeek, Google et Meta : 10 techniques de compression de KV-cache pour LLM afin de réduire la mémoire en inférence
LLMMarkTechPost

DeepSeek, Google et Meta : 10 techniques de compression de KV-cache pour LLM afin de réduire la mémoire en inférence

KV-cache est devenu un gourmand de mémoire GPU dans les grands LLM, et une nouvelle revue présente 10 approches — de H2O et SnapKV à TurboQuant et MLA de DeepSeek — qui réduisent la consommation de mémoire sans restructu

30 avr. 2026·3 min
Poolside a lancé Laguna XS.2 et M.1 — des modèles ouverts pour la programmation multi-agents
LLMMarkTechPost

Poolside a lancé Laguna XS.2 et M.1 — des modèles ouverts pour la programmation multi-agents

Poolside a présenté deux modèles Laguna pour le codage multi-agents : le XS.2 ouvert s'exécute localement, tandis que le plus puissant M.1 est conçu pour les tâches longues avec modifications de code, tests et travail en

29 avr. 2026·3 min
LlamaIndex ParseBench : comment tester l'analyse de documents via Python et Hugging Face
LLMMarkTechPost

LlamaIndex ParseBench : comment tester l'analyse de documents via Python et Hugging Face

Un guide pratique montre comment construire un pipeline d'évaluation des analyseurs de documents à l'aide du dataset LlamaIndex ParseBench : charger des PDFs depuis Hugging Face, comparer le texte extrait et mesurer la q

29 avr. 2026·3 min
smol-audio de Deep-unlearning : Une collection de notebooks Colab pour l'affinage des modèles audio
LLMMarkTechPost

smol-audio de Deep-unlearning : Une collection de notebooks Colab pour l'affinage des modèles audio

Deep-unlearning a lancé smol-audio — une collection de notebooks compatibles avec Colab pour l'affinage de Whisper, Parakeet, Voxtral, Granite Speech et autres modèles audio.

29 avr. 2026·3 min
Top 10 des modèles d'IA physique qui contrôlent les robots réels en 2026
LLMMarkTechPost

Top 10 des modèles d'IA physique qui contrôlent les robots réels en 2026

En 18 mois, l'écart entre les LLM et la robotique réelle s'est considérablement réduit : les modèles d'IA physique fonctionnent déjà dans les usines, les entrepôts et les laboratoires de recherche.

28 avr. 2026·2 min
Hugging Face et Gemma 3 1B: Construire un Pipeline de Génération Prêt pour la Production dans Colab
LLMMarkTechPost

Hugging Face et Gemma 3 1B: Construire un Pipeline de Génération Prêt pour la Production dans Colab

Une analyse de la manière d'exécuter Gemma 3 1B Instruct dans Colab via Hugging Face Transformers: avec une autorisation sécurisée, des chat templates et un pipeline d'inférence reproductible.

28 avr. 2026·3 min
Z.ai lance GLM-5V-Turbo — modèle multimodal natif pour la programmation visuelle
LLMMarkTechPost

Z.ai lance GLM-5V-Turbo — modèle multimodal natif pour la programmation visuelle

Le laboratoire chinois Z.ai a lancé GLM-5V-Turbo — un modèle qui reconnaît les diagrammes architecturaux et les captures d'écran et génère immédiatement du code fonctionnel pour les systèmes d'ingénierie d'agents.

28 avr. 2026·3 min
Google Gemma 4, NVIDIA et OpenClaw : Agents IA locaux sans facturation par token
LLMMarkTechPost

Google Gemma 4, NVIDIA et OpenClaw : Agents IA locaux sans facturation par token

Google et NVIDIA promeuvent le déploiement local de Gemma 4 sur RTX, Jetson et DGX Spark pour que les agents IA toujours actifs comme OpenClaw fonctionnent plus vite, moins cher et sans frais de token en cloud.

28 avr. 2026·3 min
Talkie-1930: Les chercheurs ont lancé un modèle 13B sans connaissance d'Internet et de la Seconde Guerre mondiale
LLMMarkTechPost

Talkie-1930: Les chercheurs ont lancé un modèle 13B sans connaissance d'Internet et de la Seconde Guerre mondiale

Talkie-1930 est un modèle 13B ouvert, entraîné uniquement sur des textes en anglais jusqu'en 1931, pour étudier la pensée historique, les fuites de données et la capacité de l'IA à généraliser au-delà de son époque.

28 avr. 2026·3 min
MarkTechPost montre comment construire un agent VLA léger avec un modèle de monde latent et MPC
LLMMarkTechPost

MarkTechPost montre comment construire un agent VLA léger avec un modèle de monde latent et MPC

Dans un nouveau tutoriel, MarkTechPost explique comment construire un agent incarné simplifié : il fonctionne sur des images RGB, apprend un modèle de monde latent et planifie des actions via MPC.

28 avr. 2026·2 min
Arcee AI a Lancé Trinity Large Thinking — Modèle de Raisonnement Ouvert pour Agents IA
LLMMarkTechPost

Arcee AI a Lancé Trinity Large Thinking — Modèle de Raisonnement Ouvert pour Agents IA

Arcee AI a libéré les poids de Trinity Large Thinking sous licence Apache 2.0 et mise sur les scénarios d'agents longs, le raisonnement multi-étapes et l'utilisation sûre d'outils.

28 avr. 2026·2 min
NVIDIA a présenté un pipeline complet d'optimisation de modèles avec FastNAS pruning et fine-tuning
LLMMarkTechPost

NVIDIA a présenté un pipeline complet d'optimisation de modèles avec FastNAS pruning et fine-tuning

NVIDIA a publié un guide pratique pour Model Optimizer : dans un seul notebook Colab sont démontrés l'entraînement de ResNet20, FastNAS pruning sous limite de FLOPs et récupération de qualité via fine-tuning.

28 avr. 2026·3 min
TII lance Falcon Perception — modèle 0,6B pour la segmentation et la recherche d'objets par texte
LLMMarkTechPost

TII lance Falcon Perception — modèle 0,6B pour la segmentation et la recherche d'objets par texte

TII a présenté Falcon Perception — un modèle vision-langage compact avec 0,6 milliard de paramètres qui recherche et segmente des objets à partir de requêtes texte simples, surpassant SAM 3 sur les requêtes complexes.

28 avr. 2026·3 min
Google DeepMind Permet aux LLM de Réécrire les Algorithmes de la Théorie des Jeux et de Surpasser les Experts
LLMMarkTechPost

Google DeepMind Permet aux LLM de Réécrire les Algorithmes de la Théorie des Jeux et de Surpasser les Experts

Google DeepMind a démontré qu'AlphaEvolve peut réécrire le code des algorithmes pour les jeux avec information incomplète et trouver des solutions qui surpassent les versions manuelles des experts dans la plupart des tes

28 avr. 2026·3 min
Z.AI a montré comment construire des systèmes agentic production-ready sur GLM-5 avec tool calling
LLMMarkTechPost

Z.AI a montré comment construire des systèmes agentic production-ready sur GLM-5 avec tool calling

Z.AI a lancé un tutoriel détaillé sur GLM-5 : de la configuration du SDK et de l'API compatible avec OpenAI au streaming, tool calling, sortie JSON et agent multi-turn pour la production.

28 avr. 2026·3 min
Netflix Lance Void — Modèle pour Supprimer les Objets des Vidéos en Tenant Compte de la Physique de la Scène
LLMMarkTechPost

Netflix Lance Void — Modèle pour Supprimer les Objets des Vidéos en Tenant Compte de la Physique de la Scène

L'équipe de Netflix et INSAIT a publié en open source Void — un système qui supprime les objets des vidéos tout en recalculant simultanément les chutes, le soutien des objets et autres conséquences physiques.

28 avr. 2026·3 min
Comment l'Intelligence Artificielle Aide les Marques de Mode à Concevoir la Mode du Futur
LLMMarkTechPost

Comment l'Intelligence Artificielle Aide les Marques de Mode à Concevoir la Mode du Futur

Les algorithmes aident déjà les marques de mode à créer des collections plus rapidement, à prévoir les tendances, à réduire la surproduction et à personnaliser les achats, mais soulèvent également des questions sur l'aut

28 avr. 2026·3 min
Comment Construire un Pipeline Netflix Void pour la Suppression d'Objets dans les Vidéos en Utilisant CogVideoX
LLMMarkTechPost

Comment Construire un Pipeline Netflix Void pour la Suppression d'Objets dans les Vidéos en Utilisant CogVideoX

Un examen détaillé montre comment déployer le modèle Netflix Void, télécharger les points de contrôle nécessaires, préparer les données d'entrée et exécuter la suppression d'objets vidéo via CogVideoX.

28 avr. 2026·2 min
Gladstone Institutes présente MaxToki — un modèle d'IA qui prédit le vieillissement cellulaire
LLMMarkTechPost

Gladstone Institutes présente MaxToki — un modèle d'IA qui prédit le vieillissement cellulaire

Le modèle MaxToki de Gladstone Institutes apprend à voir non pas un 'instantané' de la cellule, mais sa trajectoire au fil du temps, évalue l'accélération du vieillissement et identifie les cibles d'intervention.

28 avr. 2026·3 min
TinyFish Lance une Plateforme Web Unifiée pour Agents IA avec Search, Fetch, Browser et Agent
LLMMarkTechPost

TinyFish Lance une Plateforme Web Unifiée pour Agents IA avec Search, Fetch, Browser et Agent

TinyFish a combiné la recherche, le rendu de pages, les sessions de navigateur et les flux de travail web autonomes dans une plateforme unique pour les agents IA avec une seule clé API et un pool de crédits partagé.

28 avr. 2026·3 min
Google a ajouté Skills dans Chrome et transformé les prompts d'IA en scénarios à un clic
LLMMarkTechPost

Google a ajouté Skills dans Chrome et transformé les prompts d'IA en scénarios à un clic

Google a lancé la fonctionnalité Skills dans Chrome : les utilisateurs de Gemini pourront enregistrer les prompts fréquemment utilisés comme des scénarios réutilisables et les exécuter dans le navigateur en un seul clic.

28 avr. 2026·2 min
Google DeepMind Présente Gemini Robotics-ER 1.6 pour l'Autonomie et la Lecture d'Instruments par les Robots
LLMMarkTechPost

Google DeepMind Présente Gemini Robotics-ER 1.6 pour l'Autonomie et la Lecture d'Instruments par les Robots

Google DeepMind a mis à jour Gemini Robotics-ER à la version 1.6 : un modèle pour robots qui comprend mieux l'espace, gère plusieurs flux vidéo et peut lire des instruments industriels complexes.

28 avr. 2026·2 min
MarkTechPost a détaillé le cycle complet d'entraînement des grands modèles de langage : des données au déploiement
LLMMarkTechPost

MarkTechPost a détaillé le cycle complet d'entraînement des grands modèles de langage : des données au déploiement

MarkTechPost a publié une analyse détaillée de la façon dont les LLM sont construits aujourd'hui : du préentraînement sur de grands corpus à SFT, RLHF, optimisation du raisonnement et déploiement en production.

28 avr. 2026·3 min
Google a présenté Gemini 3.1 Flash TTS — modèle de parole avec contrôle, dialogues et 70+ langues
LLMMarkTechPost

Google a présenté Gemini 3.1 Flash TTS — modèle de parole avec contrôle, dialogues et 70+ langues

Google a lancé Gemini 3.1 Flash TTS en aperçu : le modèle synthétise du texte en 70+ langues, supporte les dialogues avec deux voix et permet de contrôler la livraison via des balises audio.

28 avr. 2026·3 min
Mem0 et OpenAI : comment construire une couche universelle de mémoire à long terme pour les agents IA
LLMMarkTechPost

Mem0 et OpenAI : comment construire une couche universelle de mémoire à long terme pour les agents IA

Un nouveau tutoriel décortique la combinaison de Mem0, des modèles OpenAI et ChromaDB : elle extrait les faits des conversations ordinaires, les stocke par user_id, recherche par sens sémantique et les injecte dans les r

28 avr. 2026·2 min
SmolAgents : Comment Construire un Système d'IA Multi-Agent avec Code et Orchestration Dynamique
LLMMarkTechPost

SmolAgents : Comment Construire un Système d'IA Multi-Agent avec Code et Orchestration Dynamique

Une analyse de l'implémentation de SmolAgents montre comment les agents d'IA légers exécutent du code, invoquent des outils, gèrent la mémoire et coordonnent les tâches au sein d'un seul système.

28 avr. 2026·2 min
NetKet et JAX : comment construire un modèle Transformer pour les systèmes de spins frustrés
LLMMarkTechPost

NetKet et JAX : comment construire un modèle Transformer pour les systèmes de spins frustrés

Le guide montre comment construire un pipeline de VMC de recherche en utilisant NetKet, JAX et l'architecture Transformer pour modéliser une chaîne de spin frustrée J1-J2.

28 avr. 2026·3 min