Paritok 4B
Tokencompressie voor AI-programmeeragents

Paritok optimaliseert LLM-gebruik voor softwareontwikkelaars door verzoeken van programmeeragents aan LLM-API’s te onderscheppen en de invoercontext te comprimeren voordat die wordt doorgestuurd. Deze middleware-aanpak vermindert het tokengebruik bij gangbare werklasten met ongeveer 74%, met besparingen tot 95% tijdens langere sessies.
Hoogtepunten
- Bereikt 74–95% tokencompressie met behoud van 86,5% oplossingskwaliteit op SWE-bench Verified
- Getraind op 45.000 echte trajecten van programmeeragents om ontwikkelprocessen te begrijpen
- Niet-destructieve compressie met ingebouwde tool `expand_context` voor herstel wanneer nodig
- Codebewust ontwerp dat meer dan 70 toolschema’s filtert met semantische embeddings
- Zelf te hosten 4B LoRA-adapter onder de Apache 2.0-licentie
Geschikt voor ontwikkelaars die programmeeragents zoals Claude Code, Cursor of OpenHands gebruiken en hun API-kosten en latentie willen verlagen. Paritok draait gratis op een eigen GPU met 24 GB geheugen en biedt daarnaast een optionele gehoste dienst met betaling per verzoek. Er is geen abonnement vereist.
Vergelijkbare tools
Alternatieven bekijken →Claude
FreemiumAnthropics assistent voor lange documenten en code
Continue
GratisOpen-source AI-codeassistent voor VS Code en JetBrains
Haystack
FreemiumOpen-source AI-orkestratie voor agents en RAG
Reacties(0)
Log in om te reageren