Skip to content
Tech AI Wire

Google e Meta lançaram novos modelos voltados a código nesta semana

O Gemini 3.8 Flash do Google e o Muse Spark 1.3 da Meta chegaram com um dia de diferença, ambos voltados a código e tarefas de agentes, e ambos com preço de nível intermediário.

Por Tech AI Wire Team

2 min de leitura

XLinkedIn
Two smartphones side by side on a desk, each showing a blurred chat interface.

Em números

Gemini 3.8 Flash's per-million-token input/output price through 2026
$0.75 / $3.75
Muse Spark 1.3's per-million-token input/output price
$1.25 / $4.25
token context window both new models share
1M

O Google lançou o Gemini 3.8 Flash em 2 de setembro, e a Meta seguiu em menos de um dia com o Muse Spark 1.3. Ambos miram o mesmo nicho: modelos de nível intermediário precificados para código e trabalho de agentes em alto volume, não apenas para liderar benchmarks.

Gemini 3.8 Flash: barato, e feito para sessões longas de código

O Gemini 3.8 Flash custa US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de saída até o fim de 2026, segundo o próprio anúncio do Google. O Google afirma que ele supera a maioria dos modelos de fronteira maiores no DeepSWE v1.1, um benchmark para resolver do início ao fim problemas longos e complexos de engenharia de software.

No Terminal-Bench 2.1, um teste de conclusão real de tarefas em linha de comando, o DataCamp reporta que o Gemini 3.8 Flash atinge 90,8%, ante 81,6% do 3.7 Flash. O raciocínio geral, medido pelo Humanity's Last Exam, quase não mudou: 45,4% contra 45,7% da versão anterior. O Google está investindo seu orçamento de melhoria em habilidades de código e de agentes, não em conhecimento bruto.

O Google também lançou uma variante Cyber restrita através do seu programa Fairwind, limitada a defensores verificados. O Google relata uma taxa de sucesso acima de 70% em um benchmark interno de descoberta de vulnerabilidades, e 47,2% no CWE-Bench, um benchmark público para corrigir automaticamente falhas de segurança conhecidas.

Muse Spark 1.3: um salto grande, mas não é um modelo aberto

O Muse Spark 1.3 marca 61 pontos no Intelligence Index da Artificial Analysis, segundo o Trending Topics. Isso fica logo atrás do Claude Opus 5 e do GPT-5.6 Sol, e à frente dos 59 pontos que o veículo atribui ao Gemini 3.8 Flash na mesma escala. Os próprios ganhos relatados pela Meta são expressivos: a precisão em tarefas bancárias subiu de 35% para 47%, e a de operações em terminal, de 80% para 85%.

Apesar de como parte da cobertura o apresentou, o Muse Spark 1.3 não é um modelo de pesos abertos. O LLM Stats o descreve como "um modelo de raciocínio multimodal proprietário", disponível apenas pela própria API da Meta. O Trending Topics observa que a Meta havia se comprometido a liberar os pesos do Muse Spark 1.2 anterior, mas ainda não decidiu se os do 1.3 vão seguir o mesmo caminho. Os preços ficam em US$ 1,25 por milhão de tokens de entrada e US$ 4,25 por milhão de saída.

O que isso significa para desenvolvedores

Se você está escolhendo um modelo para um agente que escreve e executa código, compare esses dois entre si na sua própria carga de trabalho. Não se limite a compará-los apenas com os modelos principais dos quais todo mundo fala; ambos foram construídos e precificados exatamente para essa tarefa.

Não presuma que vai conseguir hospedar o Muse Spark 1.3 você mesmo. Diferente dos lançamentos anteriores da linha Muse na Meta, este está disponível só via API por enquanto. Qualquer dependência dele é uma dependência da infraestrutura e da precificação da Meta, não das suas próprias.

Preste atenção ao padrão por trás disso, não só às pontuações isoladas. Dois grandes laboratórios lançando, com um dia de diferença, modelos de nível intermediário otimizados para código, a preços parecidos, mostra para onde a competição real se deslocou: não para o topo do ranking, mas para a faixa que os desenvolvedores realmente usam no dia a dia, em alto volume.

Fontes

  1. Introducing Gemini 3.8 Flash and 3.8 Flash Cyber - Google Blog
  2. Gemini 3.8 Flash: Features, Benchmarks, and Pricing - DataCamp
  3. Muse Spark 1.3: Meta Is Back at the Top, and the Best Open-Weight Model Could Follow - Trending Topics
  4. Muse Spark 1.3 API Pricing, Context Window & Benchmarks - LLM Stats

Artigos relacionados