MarkTechPost
Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.
Dernières publications

Meta AI a Présenté Brain2Qwerty v2 — Décodeur de Texte MEG Non Invasif avec 61% de Précision
Meta AI a lancé Brain2Qwerty v2 — un pipeline basé sur la MEG non invasif qui décode les phrases dactylographiées à partir de signaux cérébraux avec 61% de précision par mot et a publié le code d'entraînement.

Sakana AI a Lancé Sakana Marlin — un Agent pour Rapports de 100 Pages avec Diapositives
Sakana AI a Présenté son Premier Produit Commercial — l'Agent Corporatif Marlin, qui Fonctionne de Manière Autonome jusqu'à Huit Heures et Génère des Rapports jusqu'à 100 Pages avec Diapositives

Baidu Développe CUP — Ensemble d'Outils Python pour Pipelines Backend Fiables
MarkTechPost a analysé CUP — un ensemble d'utilitaires Python de Baidu pour la journalisation, la mise en cache, les pools de threads et la surveillance des ressources Linux dans un seul paquet.

Google Research Lance TabFM — Modèle Foundation pour Données Tabulaires avec Zero-Shot
Google Research a présenté TabFM — un modèle foundation pour les tableaux qui effectue la classification zero-shot et la régression sans entraînement pour chaque dataset.

Linq a Lancé iMessage Apps — Paiements, Billets et Jeux pour Agents IA Directement dans la Conversation
Linq a présenté iMessage Apps — des cartes interactives imessage_app pour les paiements, l'achat de billets, la réservation de vols et les jeux dans la messagerie.

Claude Sonnet 5 vs Opus 4.8 : comparaison du codage d'agents et tarification API d'Anthropic
MarkTechPost a comparé Claude Sonnet 5, Sonnet 4.6 et Opus 4.8 d'Anthropic : le nouveau modèle s'approche du navire amiral en codage d'agents avec des prix de token Sonnet plus bas.

Anthropic a repris les operations de Claude Fable 5 apres levee des restrictions d exportation americaines
Anthropic le 1er juillet 2026 a retabli l acces a Claude Fable 5 et a introduit un classificateur qui bloque les techniques de jailbreak.

OpenAI a Lancé GPT-Realtime-2.1 et une Version Mini pour les Agents Vocaux dans l'API
OpenAI a ajouté deux modèles pour les agents vocaux à son API—GPT-Realtime-2.1 et GPT-Realtime-2.1-mini—réduisant la latence p95 d'au moins 25% grâce à la mise en cache.

Tencent a lancé Hy3—un modèle MoE open source avec 295 milliards de paramètres et contexte 256K
Tencent a présenté Hy3—un modèle avec 295 milliards de paramètres, 21 milliards actifs par token, licence Apache 2.0 et un score de 78.0 sur SWE-Bench Verified.

MarkTechPost a montré comment construire un co-chercheur IA QSAR pour trouver des inhibiteurs d'EGFR
Un tutoriel de MarkTechPost explique comment construire un co-chercheur IA autonome utilisant Random Forest QSAR — à partir de données ChEMBL et RDKit jusqu'à des molécules candidates prêtes contre EGFR C797S.

Liquid AI a lancé LFM2.5-350M: modèle efficace de 350M paramètres avec RL à l'échelle
Liquid AI a prouvé que la densité de l'IA est plus importante que le nombre de paramètres: petit modèle peut être mieux entraîné par apprentissage renforcé.

Parallax : attention linéaire locale améliorée avec correction de covariance
Des chercheurs de MarkTechPost ont présenté Parallax — une nouvelle variante du mécanisme d'attention pour les petits LLM avec qualité et vitesse améliorées.

MiniMax M3: Nouveau Modèle avec 1M Tokens, Multimodalité et Computer Use
L'entreprise a présenté l'architecture MiniMax Sparse Attention supportant un million de jetons en contexte et fonctionnant avec la vidéo, les images et le contrôle d'ordinateur.

Les agents IA autonomes fonctionnent 50 fois plus longtemps que la recherche : étude Harvard et Perplexity
Une nouvelle recherche de Harvard et Perplexity montre que les agents IA effectuent 26 minutes de travail indépendant par session, contre 33 secondes pour les assistants de recherche.

Memory OS : Pile de Mémoire Ouverte à 6 Couches pour Hermes Agent
Le nouveau projet Memory OS ajoute une mémoire locale persistante à Hermes Agent via six couches d'architecture, une recherche de mémoire gérée et un wiki intégré.

Google lance Gemini 3.5 Live Translate : modèle parole-à-parole pour 70+ langues
Gemini 3.5 Live Translate traduit la parole en temps réel, synthétisant l'audio avec un délai de quelques secondes. Le modèle est disponible dans Gemini Live API, Google Meet et l'application Google Traduction.

Nous Research a présenté le générateur de profils Hermes Agent
La nouvelle interface Hermes Agent remplace la configuration CLI multi-étapes — les utilisateurs assemblent maintenant les profils d'agents dans un flux unique sur le tableau de bord.

SpaceXAI a Lancé Grok 4.5 — Modèle de Code Classe Opus
SpaceXAI a présenté Grok 4.5, modèle classe Opus entraîné avec Cursor pour codage et tâches d'agent, au prix de $2/$6 par million de tokens.

Ant Group a Présenté LingBot-VLA 2.0 — Modèle Ouvert pour Contrôler des Robots de Tout Design
Son modèle de 6 milliards de paramètres entraîné sur 60 mille heures de vidéo robotique et peut contrôler une douzaine de types de manipulateurs via un espace d'action unifié.

NVIDIA Nemotron-Labs-3-Puzzle-75B : une compression de 37 % du modèle a doublé la vitesse du serveur
NVIDIA a publié une version compressée du LLM Nemotron-3-Super — Nemotron-Labs-3-Puzzle-75B. Grâce à la méthode Puzzle (alternance entre compression et distillation), le modèle est devenu 37 % plus petit et a doublé le d

Google Research a lancé SensorFM — un modèle pour 35 tâches de prévision en santé
Google Research a entraîné le modèle fondamental SensorFM sur 1 trillion de minutes de données provenant de 5 millions d’utilisateurs de Fitbit et Pixel Watch afin de prédire l’état de santé.

Robbyant lance LingBot-World-Infinity, un modèle causal pour des mondes interactifs
Robbyant a dévoilé LingBot-World-Infinity, un modèle vidéo de 14 milliards de paramètres qui fonctionne comme un simulateur interactif et génère des vidéos en 720p à 60 images par seconde.

Datalab Lift contre concurrents : comment un extracteur 9B fonctionne avec JSON Schema
Datalab a comparé son outil Lift 9B avec NuExtract3, LlamaExtract, Marker et Docling — et analysé quand l'approche schema-first l'emporte dans l'extraction de données de PDFs.

Liquid AI Dévoile Antidoom : la Méthode FTPO Réduit les Blocages dans les Modèles de Reasoning
Liquid AI a ouvert le code source d'Antidoom — un outil qui identifie le token-déclencheur des boucles infinies et réentraîne uniquement celui-ci, réduisant la fréquence des doom-loops de 22,9% à 1%.

Google AI Studio a ajouté l’importation de dépôts GitHub au mode de développement Build
Google AI Studio a mis à jour le mode Build : il est désormais possible d’importer directement n’importe quel dépôt GitHub et d’obtenir immédiatement une application modifiable et déployable.

NVIDIA a lancé Audex-30B — un modèle MoE audio-texte unifié basé sur Nemotron-Cascade-2
NVIDIA a réuni la reconnaissance vocale, la traduction, la synthèse vocale et la génération audio dans un modèle MoE unique de 30 milliards de paramètres, tout en préservant les capacités textuelles de Nemotron-Cascade-2

Ant Group ouvre le code source de LingBot-Vision : un modèle 1B pour la perception spatiale des robots
Robbyant, d'Ant Group, a publié LingBot-Vision, un modèle ViT 1B entraîné à reconnaître les contours des objets sans annotation et à surpasser des modèles plus grands sur des tâches de perception spatiale.

IA pour le Traitement des Documents PDF : Guide des Outils 2026
Aperçu des outils open-source pour convertir les PDF d'entreprise et les scans en JSON structuré — essentiel pour que les LLM et les agents IA fonctionnent avec les données d'entreprise réelles.

Meituan Dévoile LongCat-2.0 : Modèle MoE Ouvert avec 1,6 Billions de Paramètres et Contexte de 1 Million de Tokens
L'entreprise chinoise Meituan a présenté LongCat-2.0 — un modèle MoE massif avec fenêtre native d'un million de tokens entraîné sur des ASIC domestiques.

Synthetic Sciences Lance OpenScience — Workbench IA Ouvert pour ML, Biologie, Physique et Chimie
OpenScience de Synthetic Sciences — workbench open-source sous Apache 2.0 avec 250+ compétences, compatible avec n'importe quel modèle IA pour les tâches en ML, biologie, physique et chimie.