Paritok 4B
Comprimarea tokenurilor pentru agenți AI de programare

Paritok optimizează utilizarea modelelor LLM de către dezvoltatorii software, interceptând solicitările trimise de agenții de programare către API-urile LLM și comprimând contextul de intrare înainte de redirecționare. Această abordare middleware reduce consumul de tokenuri cu aproximativ 74% în sarcinile obișnuite și cu până la 95% în sesiunile prelungite.
Puncte forte
- Obține o compresie de 74–95% a tokenurilor, păstrând o calitate a rezolvării de 86,5% pe SWE-bench Verified
- Antrenat pe 45.000 de trasee reale ale agenților de programare pentru a înțelege fluxurile de lucru ale dezvoltatorilor
- Compresie nedistructivă, cu instrumentul integrat `expand_context` pentru recuperare atunci când este necesar
- Arhitectură adaptată codului, care filtrează peste 70 de scheme de instrumente folosind reprezentări semantice
- Adaptor LoRA de 4B care poate fi găzduit local, disponibil sub licența Apache 2.0
Este potrivit pentru dezvoltatorii care folosesc agenți de programare precum Claude Code, Cursor sau OpenHands și doresc să reducă costurile API și latența. Paritok rulează gratuit pe propriul GPU cu 24 GB și oferă opțional un serviciu găzduit, tarifat per solicitare. Nu necesită abonament.
Instrumente similare
Vezi alternativele →Claude
FreemiumAsistentul Anthropic, excelent cu documente lungi și cod
Continue
GratuitAsistent AI open-source pentru VS Code și JetBrains
Haystack
FreemiumCadru open-source pentru orchestrarea agenților și RAG
Comentarii(0)
Autentifică-te pentru a comenta