MarkTechPost
Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.
Dernières publications

OpenAI a présenté GPT-Rosalind — un modèle d'IA pour la biologie, la génomique et le développement de médicaments
OpenAI a lancé GPT-Rosalind — un modèle spécialisé pour la biologie et la pharmacie qui aide à accélérer le développement de médicaments, l'analyse de données génomiques et la planification des expériences.

Google a présenté Auto-Diagnose — un système d'IA pour identifier les causes des défaillances des tests d'intégration
Google a présenté Auto-Diagnose — un système basé sur Gemini 2.5 Flash qui analyse automatiquement les journaux des tests d'intégration défaillants et identifie la cause racine de la défaillance avec une précision de 90,

OpenAI GPT-OSS : Lancement de Modèles Open-Weight dans Colab avec MXFP4 et Inférence Avancée
Un nouveau guide explique comment lancer openai/gpt-oss-20b dans Google Colab : installer les dépendances pour Transformers, vérifier le GPU, activer la quantification MXFP4 et construire un pipeline d'inférence fonction

Anthropic sort Claude Opus 4.7 pour la programmation d'agents, la vision et les tâches autonomes
Anthropic a présenté Claude Opus 4.7 — une mise à jour du modèle phare avec des améliorations notables en codage d'agents, analyse d'images détaillées et tâches autonomes longues.

PrismML Bonsai : Comment exécuter un modèle 1 bit sur CUDA avec GGUF, JSON et RAG
Dans un nouveau tutoriel PrismML Bonsai, nous avons couvert comment exécuter Bonsai-1.7B sur GPU via CUDA et GGUF, mesurer le débit, configurer le chat, la sortie JSON stricte et un scénario RAG basique.

xAI lance des APIs Grok séparées pour la reconnaissance et la synthèse vocale pour les développeurs d'entreprise
xAI a divisé la pile vocale de Grok en APIs autonomes : Speech-to-Text et Text-to-Speech pour les entreprises avec des prix agressifs, un support multilingue et un focus sur le marché des applications vocales.

NVIDIA a lancé Ising — la première famille ouverte de modèles d'IA pour les systèmes quantiques-classiques
NVIDIA a présenté Ising — une famille ouverte de modèles d'IA pour l'étalonnage des processeurs quantiques et la correction d'erreurs, pour rapprocher les systèmes hybrides quantiques-classiques utiles de la réalité.

Pourquoi LoRA se casse en production et comment RS-LoRA sauve le fine-tuning des modèles
LoRA excelle avec le style et le format, mais perd le signal lors de l'ajustement avec de nouveaux faits ; RS-LoRA résout le problème en changeant la formule d'échelle pour une plus stable.

OpenKB et OpenRouter montrent comment construire une base de connaissances IA locale avec recherche Llama
Un nouveau tutoriel explique comment déployer une base de connaissances locale sur OpenKB, connecter un modèle ouvert via OpenRouter et configurer en toute sécurité la recherche sans coder les clés en dur.

OpenAI et Magika ont montré comment construire un pipeline pour la reconnaissance de fichiers et l'analyse des menaces
Le guide démontre un pipeline pratique où Magika détermine le type réel du fichier à partir des octets, et OpenAI aide à interpréter le résultat et à identifier les risques potentiels.

Meta a présenté Sapiens2 — un modèle unifié de vision par ordinateur pour la pose, la segmentation et la 3D
Meta Reality Labs a lancé Sapiens2 — une famille de modèles de vision pour l'analyse humaine qui résout la pose, la segmentation, la géométrie de surface et la cartographie 3D à partir d'une seule architecture.

OpenMOSS lance MOSS-Audio — un modèle audio ouvert surpassant les alternatives plus volumineux
OpenMOSS a présenté MOSS-Audio — un modèle ouvert qui comprend la parole, la musique et les sons ambiants dans une seule architecture et surpasse les modèles open-source significativement plus volumineux sur les benchmar

Embeddings OpenAI et RL : Comment Construire un Agent avec Mémoire à Long Terme pour des Réponses Précises
Le tutoriel montre comment entraîner un agent RL pour sélectionner les enregistrements pertinents de la mémoire à long terme, afin qu'un LLM réponde avec plus de précision aux questions sur les faits sauvegardés.

Comment Mesurer l'Intelligence Réelle : Les Principaux Benchmarks pour les Agents IA
Les tests classiques ne reflètent plus les capacités réelles des réseaux de neurones. Nous explorons quels benchmarks montrent véritablement si un agent IA est prêt pour les applications commerciales du monde réel.

Mémoire Élastique pour l'IA : Comment kvcached Résout la Pénurie de GPU
La distribution dynamique du cache KV promet de réduire drastiquement le coût d'hébergement des modèles de langage en permettant un partage efficace de la mémoire d'une seule GPU.

Le Modèle Vocal de xAI Surpasse GPT Realtime dans les Tâches Métier
L'entreprise d'Elon Musk, xAI, a présenté grok-voice-think-fast-1.0. Le nouveau modèle a surpassé les solutions d'OpenAI et Google dans la gestion de flux de travail métier complexes.

GitNexus : Comment un nouvel outil a appris aux agents IA à comprendre structurellement le code
Les assistants IA excellent à écrire du code local, mais ne comprennent souvent pas l'architecture globale des projets. Le projet open-source GitNexus résout ce problème en utilisant des graphes de connaissances et le pr

DeepSeek-V4 : Comment les nouveaux algorithmes de compression ont rendu le contexte d'un million de tokens réalité
DeepSeek a présenté la quatrième génération de ses modèles. Grâce à la compression radicale de l'attention, le traitement de volumes massifs de données devient accessible non seulement aux géants technologiques.

L'Architecture Decoupled DiLoCo de DeepMind Résout le Problème de Scalabilité de l'IA
L'entraînement de modèles d'IA avancés a toujours été tenu en otage par les pannes matérielles : la défaillance d'une puce arrêtait tout le cluster. Une nouvelle architecture de Google DeepMind change les règles du jeu.

OpenMythos : reconstruction open-source de l'architecture Claude Mythos en PyTorch avec 770M paramètres
Le développeur Kye Gomez a reconstruit l'architecture présumée Claude Mythos d'Anthropic à partir de zéro — sans fuite, uniquement sur la base de recherches publiques.

OpenAI Déploie GPT-5.4-Cyber pour les Professionnels de la Cybersécurité Vérifiés
OpenAI ouvre un accès large à GPT-5.4-Cyber — une version affinée de GPT-5.4 sans restrictions standard pour des milliers de défenseurs vérifiés.

Moonshot AI lance Kimi K2.6 : un modèle agentique avec un essaim de 300 sous-agents
Le laboratoire chinois Moonshot AI a ouvert le code source de Kimi K2.6, un modèle agentique multimodal capable de coordonner de manière autonome jusqu'à 300 sous-agents et 4 000 étapes.

Phi-4-Mini de Microsoft : implémentation de la quantification, de RAG et de LoRA dans un seul notebook Jupyter
Le tutoriel présente le pipeline complet avec Phi-4-mini-instruct : quantification 4 bits, génération en streaming, raisonnement, appel d'outils, RAG et LoRA fine-tuning dans un seul notebook.

Qwen 3.6-35B-A3B en pratique : multimodalité, MoE et RAG dans un même pipeline
Une analyse détaillée de l’implémentation de Qwen 3.6-35B-A3B, du chargement du modèle à la mise en place de RAG, du tool calling et de la persistance des sessions dans des workflows réels.

NVIDIA a présenté Nemotron 3 Super — un modèle ouvert de 120 milliards de paramètres
Le nouveau modèle hybride combine les architectures Mamba et Attention avec une approche Mixture-of-Experts, offrant un gain de performance multiplié par cinq pour les systèmes multi-agents. L'écart entre les modèles pro

Google a présenté TensorFlow 2.21 et LiteRT pour l'AI mobile
Google a présenté TensorFlow 2.21 et LiteRT, un nouveau standard pour exécuter des réseaux neuronaux sur les smartphones avec prise en charge des NPU et accélération GPU pour les plateformes mobiles.

Google lance Android Bench pour évaluer l'IA dans le développement mobile
Google a rendu Android Bench accessible, le premier outil spécialisé pour évaluer les capacités des grands modèles de langage dans le développement d'applications Android.

OpenAI présente Codex Security pour la détection et la correction automatiques des vulnérabilités dans le code
OpenAI lance Codex Security, un agent intelligent d'analyse de la sécurité du code qui ne se contente pas de trouver les erreurs, mais propose aussi des correctifs prêts à l'emploi pour les résoudre.

Liquid AI a lance un systeme pour executer des agents AI entierement sur l'appareil
Liquid AI a presente le modele LFM2-24B-A2B et l'application LocalCowork — un ensemble pour executer des workflows complexes d'agents AI sans le moindre appel au cloud. La confidentialite devient un principe d'architectu

Yuan 3.0 Ultra : 1 000 milliards de paramètres avec une efficacité record
La société chinoise YuanLab AI a présenté un modèle multimodal ouvert de 1 000 milliards de paramètres, dont seulement 68,8 milliards sont activés. Une réduction d'un tiers du nombre de paramètres avec une hausse de 49 %