Paritok 4B
Token-Komprimierung für KI-Coding-Agenten

Paritok optimiert die LLM-Nutzung für Softwareentwickler, indem es Anfragen von Coding-Agenten an LLM-APIs abfängt und den Eingabekontext vor der Weiterleitung komprimiert. Dieser Middleware-Ansatz reduziert den Token-Verbrauch bei typischen Arbeitslasten um etwa 74 %, in längeren Sitzungen um bis zu 95 %.
Highlights
- Erreicht eine Token-Komprimierung von 74–95 % und behält dabei 86,5 % der Lösungsqualität auf SWE-bench Verified bei
- Mit 45.000 realen Verläufen von Coding-Agenten trainiert, um Entwickler-Workflows zu verstehen
- Nicht destruktive Komprimierung mit integriertem Werkzeug `expand_context`, um Inhalte bei Bedarf wiederherzustellen
- Codebewusstes Design, das über 70 Werkzeugschemata mithilfe semantischer Einbettungen filtert
- Selbst hostbarer 4B-LoRA-Adapter unter der Apache-2.0-Lizenz
Geeignet für Entwickler, die Coding-Agenten wie Claude Code, Cursor oder OpenHands einsetzen und API-Kosten sowie Latenz reduzieren möchten. Paritok läuft kostenlos auf einer eigenen GPU mit 24 GB Speicher oder bietet optional eine Abrechnung pro Anfrage über den gehosteten Dienst. Kein Abonnement erforderlich.
Ähnliche Tools
Alternativen ansehen →Claude
FreemiumAnthropics Assistent für lange Dokumente und Programmierung
Continue
KostenlosOpen-Source-KI-Coding-Assistent für VS Code und JetBrains
Haystack
FreemiumOpen-Source-Framework für KI-Agenten und RAG
Kommentare(0)
Zum Kommentieren anmelden