Skip to main content

Fusion

Para a maioria dos usuários, recomendamos o Fusion — ele oferece inteligência de ponta por um custo menor ao combinar um modelo principal de ponta com um auxiliar de baixo custo.
Alguns modelos são exclusivos do Devin Local, incluindo todas as variantes do GPT-5.6. Eles aparecem desativados no seletor de modelos do Cascade, com uma dica de ferramenta que direciona ao agente Devin Local — alterne o agente para usá-los.
Você pode alternar facilmente entre diferentes modelos de sua preferência. Abaixo da caixa de texto, você verá um menu suspenso de seleção de modelo com os seguintes modelos:
Para ver os preços e a disponibilidade mais recentes, consulte o seletor de modelo no painel do agente.
Sua cota e o uso excedente são cobrados com base no custo por token do modelo selecionado. Você pode visualizar o custo de cada modelo na tabela abaixo.
O SWE-2 é gratuito nos planos self-service até 15 de outubro de 2026. Depois disso, passa a valer o preço de tabela (US3,00/1Mdeentrada,US 3,00/1M de entrada, US 15,00/1M de saída, US0,30/1Mdeentradaemcache).</Note><Note>OGemini3.7FlasheoGemini3.8Flashesta~odisponıˊveiscomprec\copromocionaldelanc\camento(US 0,30/1M de entrada em cache).</Note> <Note>O Gemini 3.7 Flash e o Gemini 3.8 Flash estão disponíveis com preço promocional de lançamento (US 0,75/1M de entrada, US3,75/1Mdesaıˊda)ateˊ31dedezembrode2026.Depoisdisso,passaavaleroprec\conormal(US 3,75/1M de saída) até 31 de dezembro de 2026. Depois disso, passa a valer o preço normal (US 1,50/1M de entrada, US$ 7,50/1M de saída).

SWE-2, swe-grep, swe-check

Nossa família SWE de modelos de ponta desenvolvidos internamente foi criada especificamente para tarefas de engenharia de software. Nosso modelo mais recente, o SWE-2, vem nas variantes de esforço de raciocínio Medium, High e Max. O SWE-1.7 Lightning é executado na Cerebras para uma experiência ainda mais rápida. Nossos modelos internos incluem:
  • SWE-2: O modelo de engenharia de software mais recente da Cognition, disponível com esforço de raciocínio Medium, High e Max.
  • SWE-1.7: Nosso modelo principal de engenharia de software anterior.
  • SWE-1.7 Lightning: Uma versão mais rápida do SWE-1.7 executada na Cerebras, que oferece a mesma inteligência com menor latência.
  • SWE-1.6: Nosso modelo da geração anterior, desenvolvido para agentes de engenharia de software, otimizado tanto para inteligência quanto para a experiência de uso do modelo. Leia nosso anúncio de pesquisa.
  • SWE-1.6 Fast: Uma versão mais rápida do SWE-1.6, disponível para usuários pagantes.
  • SWE-1-mini: Alimenta sugestões passivas na Tab, otimizado para latência em tempo real.
  • swe-grep: Alimenta a recuperação de contexto e o Fast Context
  • swe-check: Alimenta o Quick Review com revisões rápidas e leves, otimizadas para problemas comuns no código.
Para obter os modelos e preços da sua própria conta de forma programática, use a API List Models.