Aller au contenu
ai101.tools
naviguerouvrirescfermer
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
Paritok 4B logo

Paritok 4B

Compression de jetons pour les agents de programmation IA

0
EnregistrerVisiter le site ↗
Paritok 4B — capture d’écran du site web

Paritok optimise l’utilisation des LLM par les développeurs en interceptant les requêtes envoyées par les agents de programmation aux API de LLM et en compressant leur contexte avant leur transmission. Cette approche par intergiciel réduit le nombre de jetons d’environ 74 % sur des charges de travail courantes, avec jusqu’à 95 % d’économie lors des sessions prolongées.

Points forts

  • Compression de 74 à 95 % des jetons, tout en conservant 86,5 % de qualité de résolution sur SWE-bench Verified
  • Entraîné sur 45 000 parcours réels d’agents de programmation afin de comprendre le travail des développeurs
  • Compression non destructive avec l’outil intégré `expand_context` pour restaurer le contexte si nécessaire
  • Conception adaptée au code, capable de filtrer plus de 70 schémas d’outils grâce à des représentations vectorielles sémantiques
  • Adaptateur LoRA de 4 milliards de paramètres auto-hébergeable sous licence Apache 2.0

Paritok convient aux développeurs qui utilisent des agents de programmation comme Claude Code, Cursor ou OpenHands et souhaitent réduire les coûts d’API et la latence. Il fonctionne gratuitement sur votre propre GPU de 24 Go et propose aussi un service hébergé facultatif facturé à la requête. Aucun abonnement n’est requis.

Commentaires(0)

Connectez-vous pour commenter

Aucun commentaire pour le moment — soyez le premier.

Outils similaires

Voir les alternatives →

Signaler ce commentaire

Pourquoi effectuez-vous ce signalement ?