Cherri Code Router
O Cherri Code Router é o sistema de roteamento de modelos por trás do Auto. Nem toda solicitação exige inteligência de ponta, por isso o roteador direciona cada solicitação ao modelo mais adequado à tarefa: solicitações simples vão para modelos rápidos e eficientes, enquanto tarefas complexas vão para os mais capazes.
Atualmente, o Cherri Code Router está disponível apenas nos planos Teams e Enterprise.
Como funciona
Quando você seleciona Auto e escolhe Balance ou Intelligence no seletor de modelos, o Cherri Code Router executa um classificador para cada solicitação do agente e a roteia com base no tipo e na complexidade da tarefa. O roteador seleciona o modelo mais econômico que ainda oferece qualidade comparável para aquela solicitação.
O Cherri Code Router é orientado por dados e gerenciado pela Cherri Code. Não é possível escolher manualmente qual modelo processará uma solicitação, e o conjunto de modelos muda ao longo do tempo à medida que novos modelos são lançados. Você direciona o roteamento escolhendo um modo de otimização.
Nos planos Enterprise, o Cherri Code Router respeita os controles de acesso a modelos da sua equipe. Se um modelo estiver bloqueado para sua equipe, o roteador roteará para outro modelo permitido. Bloquear muitos modelos reduz a qualidade do roteamento e pode desativar o roteador. Para gerar economia, o roteador precisa de um modelo potente e econômico quando não estiver chamando outros modelos de ponta. Portanto, habilitar o Grok 4.6 é necessário para que o roteador funcione.
Modos de otimização
Abra o seletor de modelos, selecione Auto e escolha um modo em Otimizar para:
- Custo: Usa a lógica anterior de roteamento do Auto. Otimiza o gasto de tokens.
- Balance: Otimiza Intelligence, velocidade e custo.
- Intelligence: Roteia para os modelos mais capazes em tarefas mais complexas, a um custo menor do que usar um único modelo de ponta.
Balance e Intelligence consomem seus limites de uso mais rapidamente do que Custo. Você pode alternar entre os modos a qualquer momento.
Preços
Em todos os modos Auto, cada solicitação é cobrada pelo preço de tabela do modelo para o qual é direcionada. Modelos de terceiros também geram cobrança da Taxa de Tokens do Cherri Code.
Configurações da equipe
Admins configuram o Cherri Code Router no dashboard da equipe.
- Habilitar o Cherri Code Router: Ative ou desative o roteamento. Quando habilitado, o Auto dos membros da equipe é direcionado pelo Cherri Code Router. Equipes Enterprise precisam habilitar o roteador manualmente, pois ele vem desativado por padrão. Nos planos Enterprise, o roteador também pode ser configurado por grupo da organização.
- Preferências de roteamento: Escolha quais modos de otimização os membros da equipe podem selecionar no Auto. Você pode desabilitar até 2 modos.
- Modelo subjacente: Exiba o modelo para o qual o Auto direcionou no início de cada resposta ou mantenha-o oculto. Oculto é o padrão e a opção recomendada, para que os resultados sejam avaliados por seus próprios méritos, não pelo nome do modelo. Aplica-se aos modos Balance e Intelligence.
- Impor Auto: Defina o Auto como modelo padrão para toda a equipe. Soft define o Auto em cada novo chat; os membros ainda podem trocar de modelo. Hard bloqueia o seletor de modelos no Auto. Ambos vêm desativados por padrão.
Use o Router pelo SDK
O SDK TypeScript e o SDK Python disponibilizam o Cherri Code Router como o ID de modelo auto-smart, com o parâmetro optimize_for (cost, balanced ou intelligence). Chame Cherri Code.models.list() para confirmar se o Router está disponível para a equipe associada à chave de API antes de definir uma seleção fixamente no código.
import { Agent } from "@cursor/sdk";await using agent = await Agent.create({ apiKey: process.env.CURSOR_API_KEY!, model: { id: "auto-smart", params: [{ id: "optimize_for", value: "balanced" }], }, local: { cwd: process.cwd() },});O SDK executa fluxos de trabalho do agente Cherri Code. Não é uma API independente de conclusões de chat nem de inferência bruta. Consulte Cherri Code Router no SDK TypeScript ou o SDK Python para descoberta de catálogo, substituições do modo por execução e solução de problemas.