Arena, o ranking de IA, levanta US$ 200 mi com avaliação de US$ 3,1 bi
A Arena levantou US$ 200 milhões com avaliação de US$ 3,1 bilhões, quase o dobro do preço de janeiro, e apresentou a prévia de um índice que classifica modelos de IA por comportamento inseguro e enganoso.
3 min de leitura

Em números
- raised in the Series B
- $200M
- valuation, up from $1.7B in January
- $3.1B
- annualized revenue, per Arena
- $100M+
- votes cast on the platform
- 62M
A Arena, o site onde as pessoas votam em qual modelo de IA dá a melhor resposta, levantou US$ 200 milhões com avaliação de US$ 3,1 bilhões em 8 de outubro de 2026. A Lightspeed Venture Partners e a Khosla Ventures co-lideraram a série B, informa o TechCrunch. O preço é quase o dobro do que os investidores pagaram cerca de dez meses antes. Com o dinheiro, a Arena está indo além de «qual modelo é o mais inteligente» para avaliar o quão seguro é o comportamento dos modelos.
A rodada
A Arena anunciou o negócio em seu próprio blog. Entre os outros novos investidores estão Salesforce Ventures, 01 Advisors, Dell Technologies Capital e Endeavor Catalyst. Os investidores existentes a16z, Felicis, AMP PBC, QuantumLight e The House Fund também participaram, segundo a Arena.
O valor da empresa subiu rápido:
| Rodada | Data | Valor | Avaliação |
|---|---|---|---|
| Série A | 6 de janeiro de 2026 | US$ 150 milhões | US$ 1,7 bilhão post-money |
| Série B | 8 de outubro de 2026 | US$ 200 milhões | US$ 3,1 bilhões |
A Felicis e a UC Investments lideraram a série A, diz o blog da Arena. O TechCrunch informou a avaliação de US$ 1,7 bilhão em junho. A Arena não disse como vai gastar o novo dinheiro, além de desenvolver seus produtos e contratar.
Como a Arena ganha dinheiro
A Arena começou em 2023 como um projeto de pesquisa na UC Berkeley que montava rankings de modelos de IA por crowdsourcing. Ela se tornou uma empresa em abril de 2025, informou o TechCrunch em junho. Seus cofundadores são o presidente-executivo Anastasios Angelopoulos e o diretor de tecnologia Wei-Lin Chiang. O professor da UC Berkeley Ion Stoica, cofundador da Databricks, assessorou o projeto antes de ele virar empresa.
O ranking público é gratuito. Um usuário digita um prompt, dois modelos respondem, e o usuário escolhe a melhor resposta. A Arena diz que a plataforma registrou 350 milhões de sessões e 62 milhões de votos, de pessoas em mais de 150 países.
O dinheiro vem do AI Evaluations, um serviço pago lançado em setembro de 2025 que oferece análises detalhadas a criadores de modelos e empresas. A Arena agora diz ter passado de US$ 100 milhões em receita anualizada. É um aumento em relação aos US$ 30 milhões da rodada de janeiro, informou o TechCrunch. Angelopoulos já disse que a Arena cobra por «consumo», então o número se baseia em uso, e não em receita recorrente de assinaturas.
A Arena disse ao TechCrunch em junho que não tem concorrentes diretos. Ela diz que disputa «o mesmo dólar» com empresas de dados como Mercor, Surge e Scale AI.
Um novo índice para comportamento inseguro
Junto com a rodada, a Arena lançou uma prévia do Arena Alignment Index. Ele pontua os modelos em três sinais:
- Unauthorized Action
- False Attribution
- Deceptive Completion
Pelos nomes, eles cobrem um modelo que age sem permissão, que credita a fonte errada e que alega ter concluído um trabalho que não terminou. A Arena diz que as definições se baseiam em system cards da OpenAI e da Anthropic, os documentos que os laboratórios publicam sobre os riscos de um modelo. Nos resultados preliminares, os modelos da OpenAI estão no topo, informa o TechCrunch. O Claude Opus 5.5 fica em sexto lugar e o Claude Fable, em nono.
A Arena argumenta que o setor precisa desse tipo de teste. «A IA está avançando mais rápido do que nossa capacidade de avaliá-la», escreveu a empresa. Ela quer ser «uma terceira parte neutra para medir o quão segura e alinhada a IA realmente é».
O que isso significa para os desenvolvedores
- Use o ranking como um sinal, não como a resposta. A Arena classifica os modelos pelo que as multidões preferem. Suas próprias tarefas, dados e custos ainda decidem qual modelo serve.
- Acompanhe o Alignment Index no trabalho com agentes. Se o seu produto deixa um modelo agir por conta própria, ações não autorizadas e falsas mensagens de «concluído» são as falhas que causam dano. Uma pontuação pública para elas é útil, mesmo em prévia.
- Espere que os laboratórios persigam o novo índice. Um ranking público de segurança dá aos criadores de modelos um novo número para melhorar. Verifique se esses ganhos se sustentam nos seus próprios testes.
- Saiba quem paga a Arena. Seu serviço pago de avaliação é vendido a laboratórios de modelos de IA e a empresas. Tenha isso em mente ao ler os rankings.
O próximo sinal de que o índice importa ou não será se os laboratórios passarem a citá-lo nos lançamentos de seus próprios modelos.
Fontes
Artigos relacionados

Healthleap capta US$ 38 milhões para sinalizar pacientes hospitalares em risco
A Healthleap captou US$ 38 milhões para uma IA que lê registros hospitalares durante a noite e sinaliza pacientes em risco de condições não percebidas, como a desnutrição. Ela roda em mais de 50 hospitais.

Mistral capta 3 bi de euros a 21 bi, com liderança da Samsung
A Mistral captou 3 bilhões de euros com avaliação de 21 bilhões, quase o dobro da rodada anterior. Planeja 1 GW de computação europeia até 2030.

Política de Uso de 2026 da Anthropic passa a proibir o abuso de modelos
A Política de Uso de 2026 da Anthropic entra em vigor em 12 de novembro. Ela proíbe a crueldade desnecessária com o Claude, une as regras sobre engano e reescreve os limites de vigilância.