Paritok 4B
Compressão de tokens para agentes de programação com IA

Paritok otimiza o uso de LLMs por desenvolvedores de software ao interceptar solicitações enviadas por agentes de programação às APIs de LLM e comprimir o contexto de entrada antes do encaminhamento. Essa abordagem de middleware reduz aproximadamente 74% dos tokens em cargas de trabalho comuns e pode chegar a 95% de economia em sessões prolongadas.
Destaques
- Alcança compressão de 74% a 95% dos tokens, mantendo 86,5% de qualidade de resolução no SWE-bench Verified
- Treinado com 45.000 trajetórias reais de agentes de programação para compreender os fluxos de trabalho dos desenvolvedores
- Compressão não destrutiva com a ferramenta integrada `expand_context` para recuperação quando necessário
- Estrutura que compreende código e filtra mais de 70 esquemas de ferramentas usando embeddings semânticos
- Adaptador LoRA de 4B auto-hospedável sob a licença Apache 2.0
É indicado para desenvolvedores que usam agentes de programação como Claude Code, Cursor ou OpenHands e desejam reduzir custos de API e latência. Paritok pode rodar gratuitamente em uma GPU própria de 24 GB ou ser usado pelo serviço hospedado opcional, com cobrança por requisição. Não exige assinatura.
Comentários(0)
Entre para comentar