lupAI
Novos Apps & Produtos

Fireworks AI apresenta o firerouter com opus, reduzindo os custos de codificação em 57% com mínima perda de precisão

Anthropic + Fireworks AIFonte: AIBase29/09/2026, 01:34
A Fireworks AI lançou o FireRouter com Opus, um modelo de roteamento consciente de cache projetado para otimizar o uso da série Claude Opus. A solução, agora disponível através de um endpoint sem servidor, reduz os custos de codificação em 57% mantendo 98,1% de precisão, uma queda de 1,5 pontos percentuais em comparação com o uso do Opus sozinho. O FireRouter avalia a adequação do modelo para cada tarefa, equilibrando custo e qualidade, e encaminha para a opção mais eficiente. O pool de roteamento inclui Claude Opus5.5, GLM5.3 e GLM5.3Flash, com planos para expansão à medida que novos modelos forem lançados. Testes internos mostraram uma redução de custo de 57%, com os custos de sessão diminuindo de US$ 15,36 para US$ 6,63. A precisão permaneceu alta, com o FireRouter obtendo 78,7% em comparação com 80,2% para o Opus sozinho. As taxas de acerto do cache também diminuíram ligeiramente, com o FireRouter atingindo 94,2% em comparação com 97,8% para o Opus. A Fireworks AI observou que essa compensação é intencional, pois modelos mais baratos podem lidar com tarefas rotineiras, reduzindo significativamente os custos gerais. Os dados de teste foram obtidos do tráfego de codificação interno, com sessões atribuídas aleatoriamente ao grupo FireRouter com Opus ou ao grupo de controle usando o Opus sozinho. Os resultados destacam a eficácia do roteamento consciente de cache no equilíbrio entre desempenho e eficiência de custo.
Fireworks AI apresenta o firerouter com opus, reduzindo os custos de codificação em 57% com mínima perda de precisão — lupAI