Zum Inhalt springen
ai101.tools
navigierenöffnenescschließen
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
Paritok 4B logo

Paritok 4B

Token-Komprimierung für KI-Coding-Agenten

0
SpeichernWebsite besuchen ↗
Paritok 4B — Screenshot der Website

Paritok optimiert die LLM-Nutzung für Softwareentwickler, indem es Anfragen von Coding-Agenten an LLM-APIs abfängt und den Eingabekontext vor der Weiterleitung komprimiert. Dieser Middleware-Ansatz reduziert den Token-Verbrauch bei typischen Arbeitslasten um etwa 74 %, in längeren Sitzungen um bis zu 95 %.

Highlights

  • Erreicht eine Token-Komprimierung von 74–95 % und behält dabei 86,5 % der Lösungsqualität auf SWE-bench Verified bei
  • Mit 45.000 realen Verläufen von Coding-Agenten trainiert, um Entwickler-Workflows zu verstehen
  • Nicht destruktive Komprimierung mit integriertem Werkzeug `expand_context`, um Inhalte bei Bedarf wiederherzustellen
  • Codebewusstes Design, das über 70 Werkzeugschemata mithilfe semantischer Einbettungen filtert
  • Selbst hostbarer 4B-LoRA-Adapter unter der Apache-2.0-Lizenz

Geeignet für Entwickler, die Coding-Agenten wie Claude Code, Cursor oder OpenHands einsetzen und API-Kosten sowie Latenz reduzieren möchten. Paritok läuft kostenlos auf einer eigenen GPU mit 24 GB Speicher oder bietet optional eine Abrechnung pro Anfrage über den gehosteten Dienst. Kein Abonnement erforderlich.

Kommentare(0)

Zum Kommentieren anmelden

Noch keine Kommentare — schreibe den ersten.

Diesen Kommentar melden

Warum meldest du das?