MarkTechPost→ original

Token Saver: open-source MCP-расширение режет расход токенов Claude на PDF на 90-99%

Marktechpost 30 июля 2026 года выпустила Token Saver — бесплатное open-source расширение MCP для Claude Desktop. Оно обрабатывает большие PDF прямо на машине через локальный Hybrid RAG и отдаёт модели только нужные фрагменты, не выгружая файл на серверы. Расход токенов падает на 92-99%, а настройка не требует ни Python-окружений, ни терминала.

Traité par IA depuis MarkTechPost ; édité par Hamidun News
Token Saver: open-source MCP-расширение режет расход токенов Claude на PDF на 90-99%
Source : MarkTechPost. Collage: Hamidun News.
◐ Écouter l'article

L'entreprise Marktechpost a lancé le 30 juillet 2026 TokenSaver — une extension gratuite et open source du protocole MCP (Model Context Protocol) pour Claude Desktop qui réduit la consommation de tokens lors de l'analyse de PDF de 92-99% grâce à un Hybrid RAG local, sans envoyer le fichier lui-même sur les serveurs du modèle.

Pourquoi les gros PDF dévorent des tokens

Les gros PDF coûtent cher dans les chats, car tout l'historique de la conversation est renvoyé au modèle à chaque tour — et le document est payé à nouveau à chaque nouvelle question. Selon Marktechpost, par défaut Claude transforme chaque page en image pour préserver les graphiques et la mise en page, et extrait séparément le texte ; le texte seul occupe de 1500 à 3000 tokens par page.

Prompt Caching et Claude Projects atténuent le choc, mais ne résolvent pas la racine du problème : l'ensemble du document traverse quand même la frontière et se retrouve sur les serveurs du fournisseur. Si un manuel de 1000 pages ne nécessite que deux paragraphes, forcer le LLM à passer au crible les 1000 pages est inefficace et augmente le risque d'hallucinations.

Comment fonctionne Local Hybrid RAG

TokenSaver s'exécute comme un serveur MCP local — un programme léger en arrière-plan sur votre machine qui indexe le PDF et ne transmet au modèle que les fragments pertinents. Plutôt que de faire passer les mille pages entières dans le modèle, la recherche hybride trouve ce qu'il faut localement : c'est à la fois moins cher et cela réduit le risque de réponses inventées.

  • Date de sortie — 30 juillet 2026, version v1.0, licence MIT
  • Réduction de la consommation de tokens — 92-99%
  • Développeur — Arnav Rai, étudiant en informatique au Rochester Institute of Technology, dans le cadre d'un stage chez Marktechpost AI Media Inc
  • Superviseurs du projet — Jean-marc Mommessin et Asif Razzaq
  • La configuration ne nécessite ni environnement Python ni travail en terminal

Le fichier ne quitte jamais l'appareil, ce qui fait que la confidentialité est garantie au niveau de l'architecture, et non par de simples promesses. L'extension est distribuée sous licence MIT et est déjà disponible en version v1.0.

«

La consommation de tokens est réduite de 92-99%, la confidentialité est garantie, et la configuration ne nécessite exactement aucun environnement Python ni configuration en terminal », — d'après l'annonce de Marktechpost AI Media.

Ce que cela signifie

Le RAG local devient un moyen pratique de travailler avec de gros documents via des LLM dans le cloud, sans payer trop cher en tokens à chaque question de suivi et sans envoyer les fichiers sources à l'extérieur. Pour les développeurs et chercheurs qui analysent régulièrement des PDF volumineux, c'est une économie directe — à la fois sur la facture du modèle et sur la confidentialité des données.

Questions fréquentes

Qu'est-ce que TokenSaver ?

TokenSaver est une extension MCP open source pour Claude Desktop sous licence MIT (version v1.0). Elle traite les PDF localement et ne transmet au modèle que les fragments nécessaires, réduisant la consommation de tokens de 92-99%.

Faut-il Python pour l'installer ?

Non. Selon Marktechpost, la configuration ne nécessite ni environnement Python ni configuration via terminal — l'extension fonctionne comme un programme en arrière-plan sur la machine.

Combien coûte TokenSaver ?

L'outil est gratuit et ouvert : il est distribué sous licence MIT, et les PDF eux-mêmes sont traités sur l'appareil sans être envoyés vers les serveurs du fournisseur.

ZK
Hamidun News
Actualités IA sans bruit. Sélection éditoriale quotidienne de plus de 50 sources. Produit de Zhemal Khamidun, Head of AI chez Alpina Digital.

Besoin d'une IA qui travaille dans votre entreprise — pas seulement dans votre fil d'actualité?

Je construis de l'IA en production pour les entreprises — CRM sur mesure, outils internes, agents autonomes, automatisation des processus. Vous en êtes propriétaire, adaptée à votre processus, sans coût par utilisateur. Réalisé par Zhemal Khamidun, CPO d'AlpinaGPT (plateforme IA, 6 000+ utilisateurs).

Qu'en pensez-vous ?
Chargement des commentaires…