Éditeur · vérifié par la rédaction

MarkTechPost

Source d'actualités IA. Les articles sont sélectionnés et adaptés par la rédaction de Hamidun News.

290 articles dans Hamidun·Dernier: 17 juillet· Actif·marktechpost.com ↗

Dernières publications

OpenAI a présenté GPT-Rosalind — un modèle d'IA pour la biologie, la génomique et le développement de médicaments
LLMMarkTechPost

OpenAI a présenté GPT-Rosalind — un modèle d'IA pour la biologie, la génomique et le développement de médicaments

OpenAI a lancé GPT-Rosalind — un modèle spécialisé pour la biologie et la pharmacie qui aide à accélérer le développement de médicaments, l'analyse de données génomiques et la planification des expériences.

28 avr. 2026·3 min
Google a présenté Auto-Diagnose — un système d'IA pour identifier les causes des défaillances des tests d'intégration
LLMMarkTechPost

Google a présenté Auto-Diagnose — un système d'IA pour identifier les causes des défaillances des tests d'intégration

Google a présenté Auto-Diagnose — un système basé sur Gemini 2.5 Flash qui analyse automatiquement les journaux des tests d'intégration défaillants et identifie la cause racine de la défaillance avec une précision de 90,

28 avr. 2026·3 min
OpenAI GPT-OSS : Lancement de Modèles Open-Weight dans Colab avec MXFP4 et Inférence Avancée
LLMMarkTechPost

OpenAI GPT-OSS : Lancement de Modèles Open-Weight dans Colab avec MXFP4 et Inférence Avancée

Un nouveau guide explique comment lancer openai/gpt-oss-20b dans Google Colab : installer les dépendances pour Transformers, vérifier le GPU, activer la quantification MXFP4 et construire un pipeline d'inférence fonction

27 avr. 2026·3 min
Anthropic sort Claude Opus 4.7 pour la programmation d'agents, la vision et les tâches autonomes
LLMMarkTechPost

Anthropic sort Claude Opus 4.7 pour la programmation d'agents, la vision et les tâches autonomes

Anthropic a présenté Claude Opus 4.7 — une mise à jour du modèle phare avec des améliorations notables en codage d'agents, analyse d'images détaillées et tâches autonomes longues.

27 avr. 2026·3 min
PrismML Bonsai : Comment exécuter un modèle 1 bit sur CUDA avec GGUF, JSON et RAG
LLMMarkTechPost

PrismML Bonsai : Comment exécuter un modèle 1 bit sur CUDA avec GGUF, JSON et RAG

Dans un nouveau tutoriel PrismML Bonsai, nous avons couvert comment exécuter Bonsai-1.7B sur GPU via CUDA et GGUF, mesurer le débit, configurer le chat, la sortie JSON stricte et un scénario RAG basique.

27 avr. 2026·2 min
xAI lance des APIs Grok séparées pour la reconnaissance et la synthèse vocale pour les développeurs d'entreprise
LLMMarkTechPost

xAI lance des APIs Grok séparées pour la reconnaissance et la synthèse vocale pour les développeurs d'entreprise

xAI a divisé la pile vocale de Grok en APIs autonomes : Speech-to-Text et Text-to-Speech pour les entreprises avec des prix agressifs, un support multilingue et un focus sur le marché des applications vocales.

27 avr. 2026·3 min
NVIDIA a lancé Ising — la première famille ouverte de modèles d'IA pour les systèmes quantiques-classiques
LLMMarkTechPost

NVIDIA a lancé Ising — la première famille ouverte de modèles d'IA pour les systèmes quantiques-classiques

NVIDIA a présenté Ising — une famille ouverte de modèles d'IA pour l'étalonnage des processeurs quantiques et la correction d'erreurs, pour rapprocher les systèmes hybrides quantiques-classiques utiles de la réalité.

27 avr. 2026·3 min
Pourquoi LoRA se casse en production et comment RS-LoRA sauve le fine-tuning des modèles
LLMMarkTechPost

Pourquoi LoRA se casse en production et comment RS-LoRA sauve le fine-tuning des modèles

LoRA excelle avec le style et le format, mais perd le signal lors de l'ajustement avec de nouveaux faits ; RS-LoRA résout le problème en changeant la formule d'échelle pour une plus stable.

27 avr. 2026·3 min
OpenKB et OpenRouter montrent comment construire une base de connaissances IA locale avec recherche Llama
LLMMarkTechPost

OpenKB et OpenRouter montrent comment construire une base de connaissances IA locale avec recherche Llama

Un nouveau tutoriel explique comment déployer une base de connaissances locale sur OpenKB, connecter un modèle ouvert via OpenRouter et configurer en toute sécurité la recherche sans coder les clés en dur.

27 avr. 2026·2 min
OpenAI et Magika ont montré comment construire un pipeline pour la reconnaissance de fichiers et l'analyse des menaces
LLMMarkTechPost

OpenAI et Magika ont montré comment construire un pipeline pour la reconnaissance de fichiers et l'analyse des menaces

Le guide démontre un pipeline pratique où Magika détermine le type réel du fichier à partir des octets, et OpenAI aide à interpréter le résultat et à identifier les risques potentiels.

27 avr. 2026·2 min
Meta a présenté Sapiens2 — un modèle unifié de vision par ordinateur pour la pose, la segmentation et la 3D
LLMMarkTechPost

Meta a présenté Sapiens2 — un modèle unifié de vision par ordinateur pour la pose, la segmentation et la 3D

Meta Reality Labs a lancé Sapiens2 — une famille de modèles de vision pour l'analyse humaine qui résout la pose, la segmentation, la géométrie de surface et la cartographie 3D à partir d'une seule architecture.

27 avr. 2026·3 min
OpenMOSS lance MOSS-Audio — un modèle audio ouvert surpassant les alternatives plus volumineux
LLMMarkTechPost

OpenMOSS lance MOSS-Audio — un modèle audio ouvert surpassant les alternatives plus volumineux

OpenMOSS a présenté MOSS-Audio — un modèle ouvert qui comprend la parole, la musique et les sons ambiants dans une seule architecture et surpasse les modèles open-source significativement plus volumineux sur les benchmar

27 avr. 2026·2 min
Embeddings OpenAI et RL : Comment Construire un Agent avec Mémoire à Long Terme pour des Réponses Précises
LLMMarkTechPost

Embeddings OpenAI et RL : Comment Construire un Agent avec Mémoire à Long Terme pour des Réponses Précises

Le tutoriel montre comment entraîner un agent RL pour sélectionner les enregistrements pertinents de la mémoire à long terme, afin qu'un LLM réponde avec plus de précision aux questions sur les faits sauvegardés.

27 avr. 2026·2 min
Comment Mesurer l'Intelligence Réelle : Les Principaux Benchmarks pour les Agents IA
LLMMarkTechPost

Comment Mesurer l'Intelligence Réelle : Les Principaux Benchmarks pour les Agents IA

Les tests classiques ne reflètent plus les capacités réelles des réseaux de neurones. Nous explorons quels benchmarks montrent véritablement si un agent IA est prêt pour les applications commerciales du monde réel.

26 avr. 2026·2 min
Mémoire Élastique pour l'IA : Comment kvcached Résout la Pénurie de GPU
LLMMarkTechPost

Mémoire Élastique pour l'IA : Comment kvcached Résout la Pénurie de GPU

La distribution dynamique du cache KV promet de réduire drastiquement le coût d'hébergement des modèles de langage en permettant un partage efficace de la mémoire d'une seule GPU.

26 avr. 2026·3 min
Le Modèle Vocal de xAI Surpasse GPT Realtime dans les Tâches Métier
LLMMarkTechPost

Le Modèle Vocal de xAI Surpasse GPT Realtime dans les Tâches Métier

L'entreprise d'Elon Musk, xAI, a présenté grok-voice-think-fast-1.0. Le nouveau modèle a surpassé les solutions d'OpenAI et Google dans la gestion de flux de travail métier complexes.

26 avr. 2026·2 min
GitNexus : Comment un nouvel outil a appris aux agents IA à comprendre structurellement le code
LLMMarkTechPost

GitNexus : Comment un nouvel outil a appris aux agents IA à comprendre structurellement le code

Les assistants IA excellent à écrire du code local, mais ne comprennent souvent pas l'architecture globale des projets. Le projet open-source GitNexus résout ce problème en utilisant des graphes de connaissances et le pr

26 avr. 2026·3 min
DeepSeek-V4 : Comment les nouveaux algorithmes de compression ont rendu le contexte d'un million de tokens réalité
LLMMarkTechPost

DeepSeek-V4 : Comment les nouveaux algorithmes de compression ont rendu le contexte d'un million de tokens réalité

DeepSeek a présenté la quatrième génération de ses modèles. Grâce à la compression radicale de l'attention, le traitement de volumes massifs de données devient accessible non seulement aux géants technologiques.

26 avr. 2026·3 min
L'Architecture Decoupled DiLoCo de DeepMind Résout le Problème de Scalabilité de l'IA
LLMMarkTechPost

L'Architecture Decoupled DiLoCo de DeepMind Résout le Problème de Scalabilité de l'IA

L'entraînement de modèles d'IA avancés a toujours été tenu en otage par les pannes matérielles : la défaillance d'une puce arrêtait tout le cluster. Une nouvelle architecture de Google DeepMind change les règles du jeu.

26 avr. 2026·2 min
OpenMythos : reconstruction open-source de l'architecture Claude Mythos en PyTorch avec 770M paramètres
LLMMarkTechPost

OpenMythos : reconstruction open-source de l'architecture Claude Mythos en PyTorch avec 770M paramètres

Le développeur Kye Gomez a reconstruit l'architecture présumée Claude Mythos d'Anthropic à partir de zéro — sans fuite, uniquement sur la base de recherches publiques.

23 avr. 2026·2 min
OpenAI Déploie GPT-5.4-Cyber pour les Professionnels de la Cybersécurité Vérifiés
LLMMarkTechPost

OpenAI Déploie GPT-5.4-Cyber pour les Professionnels de la Cybersécurité Vérifiés

OpenAI ouvre un accès large à GPT-5.4-Cyber — une version affinée de GPT-5.4 sans restrictions standard pour des milliers de défenseurs vérifiés.

23 avr. 2026·2 min
Moonshot AI lance Kimi K2.6 : un modèle agentique avec un essaim de 300 sous-agents
LLMMarkTechPost

Moonshot AI lance Kimi K2.6 : un modèle agentique avec un essaim de 300 sous-agents

Le laboratoire chinois Moonshot AI a ouvert le code source de Kimi K2.6, un modèle agentique multimodal capable de coordonner de manière autonome jusqu'à 300 sous-agents et 4 000 étapes.

23 avr. 2026·2 min
Phi-4-Mini de Microsoft : implémentation de la quantification, de RAG et de LoRA dans un seul notebook Jupyter
LLMMarkTechPost

Phi-4-Mini de Microsoft : implémentation de la quantification, de RAG et de LoRA dans un seul notebook Jupyter

Le tutoriel présente le pipeline complet avec Phi-4-mini-instruct : quantification 4 bits, génération en streaming, raisonnement, appel d'outils, RAG et LoRA fine-tuning dans un seul notebook.

23 avr. 2026·2 min
Qwen 3.6-35B-A3B en pratique : multimodalité, MoE et RAG dans un même pipeline
LLMMarkTechPost

Qwen 3.6-35B-A3B en pratique : multimodalité, MoE et RAG dans un même pipeline

Une analyse détaillée de l’implémentation de Qwen 3.6-35B-A3B, du chargement du modèle à la mise en place de RAG, du tool calling et de la persistance des sessions dans des workflows réels.

22 avr. 2026·2 min
NVIDIA a présenté Nemotron 3 Super — un modèle ouvert de 120 milliards de paramètres
LLMMarkTechPost

NVIDIA a présenté Nemotron 3 Super — un modèle ouvert de 120 milliards de paramètres

Le nouveau modèle hybride combine les architectures Mamba et Attention avec une approche Mixture-of-Experts, offrant un gain de performance multiplié par cinq pour les systèmes multi-agents. L'écart entre les modèles pro

11 mars 2026·2 min
Google a présenté TensorFlow 2.21 et LiteRT pour l'AI mobile
LLMMarkTechPost

Google a présenté TensorFlow 2.21 et LiteRT pour l'AI mobile

Google a présenté TensorFlow 2.21 et LiteRT, un nouveau standard pour exécuter des réseaux neuronaux sur les smartphones avec prise en charge des NPU et accélération GPU pour les plateformes mobiles.

7 mars 2026·2 min
Google lance Android Bench pour évaluer l'IA dans le développement mobile
LLMMarkTechPost

Google lance Android Bench pour évaluer l'IA dans le développement mobile

Google a rendu Android Bench accessible, le premier outil spécialisé pour évaluer les capacités des grands modèles de langage dans le développement d'applications Android.

7 mars 2026·2 min
OpenAI présente Codex Security pour la détection et la correction automatiques des vulnérabilités dans le code
LLMMarkTechPost

OpenAI présente Codex Security pour la détection et la correction automatiques des vulnérabilités dans le code

OpenAI lance Codex Security, un agent intelligent d'analyse de la sécurité du code qui ne se contente pas de trouver les erreurs, mais propose aussi des correctifs prêts à l'emploi pour les résoudre.

7 mars 2026·2 min
Liquid AI a lance un systeme pour executer des agents AI entierement sur l'appareil
LLMMarkTechPost

Liquid AI a lance un systeme pour executer des agents AI entierement sur l'appareil

Liquid AI a presente le modele LFM2-24B-A2B et l'application LocalCowork — un ensemble pour executer des workflows complexes d'agents AI sans le moindre appel au cloud. La confidentialite devient un principe d'architectu

6 mars 2026·3 min
Yuan 3.0 Ultra : 1 000 milliards de paramètres avec une efficacité record
LLMMarkTechPost

Yuan 3.0 Ultra : 1 000 milliards de paramètres avec une efficacité record

La société chinoise YuanLab AI a présenté un modèle multimodal ouvert de 1 000 milliards de paramètres, dont seulement 68,8 milliards sont activés. Une réduction d'un tiers du nombre de paramètres avec une hausse de 49 %

5 mars 2026·3 min