Arena, le classement de l'IA, lève 200 millions de dollars à 3,1 milliards de valorisation
Arena lève 200 millions de dollars pour une valorisation de 3,1 milliards, près du double de janvier, et dévoile en préversion un indice qui classe les modèles d'IA selon leurs comportements dangereux et trompeurs.
3 min de lecture

En chiffres
- raised in the Series B
- $200M
- valuation, up from $1.7B in January
- $3.1B
- annualized revenue, per Arena
- $100M+
- votes cast on the platform
- 62M
Arena, le site web où les internautes votent pour le modèle d'IA qui donne la meilleure réponse, a levé 200 millions de dollars pour une valorisation de 3,1 milliards de dollars le 8 octobre 2026. Lightspeed Venture Partners et Khosla Ventures ont codirigé la série B, rapporte TechCrunch. Ce prix représente près du double de ce que les investisseurs avaient payé environ dix mois plus tôt. Avec cet argent, Arena veut aller au-delà de la question « quel modèle est le plus intelligent » pour évaluer à quel point les modèles se comportent de manière sûre.
Le tour de table
Arena a annoncé l'opération sur son propre blog. Parmi les autres nouveaux investisseurs figurent Salesforce Ventures, 01 Advisors, Dell Technologies Capital et Endeavor Catalyst. Les investisseurs historiques a16z, Felicis, AMP PBC, QuantumLight et The House Fund ont aussi participé, selon Arena.
La valeur de l'entreprise a grimpé rapidement :
| Tour | Date | Montant | Valorisation |
|---|---|---|---|
| Série A | 6 janvier 2026 | 150 millions de dollars | 1,7 milliard de dollars post-money |
| Série B | 8 octobre 2026 | 200 millions de dollars | 3,1 milliards de dollars |
Felicis et UC Investments ont mené la série A, selon le blog d'Arena. TechCrunch a rapporté la valorisation de 1,7 milliard de dollars en juin. Arena n'a pas précisé comment elle dépensera ce nouvel argent, au-delà du développement de ses produits et des recrutements.
Comment Arena gagne de l'argent
Arena a débuté en 2023 comme projet de recherche à UC Berkeley, qui établissait des classements de modèles d'IA par production participative. Elle est devenue une entreprise en avril 2025, a rapporté TechCrunch en juin. Ses cofondateurs sont le directeur général Anastasios Angelopoulos et le directeur technique Wei-Lin Chiang. Ion Stoica, professeur à UC Berkeley et cofondateur de Databricks, conseillait le projet avant sa constitution en société.
Le classement public est gratuit. Un utilisateur saisit une requête, deux modèles répondent, et l'utilisateur choisit la meilleure réponse. Arena affirme que la plateforme a enregistré 350 millions de sessions et 62 millions de votes, provenant de personnes situées dans plus de 150 pays.
L'argent vient d'AI Evaluations, un service payant lancé en septembre 2025 qui fournit des analyses détaillées aux concepteurs de modèles et aux entreprises. Arena affirme désormais avoir dépassé 100 millions de dollars de chiffre d'affaires annualisé. C'est une hausse par rapport aux 30 millions de dollars du tour de janvier, a rapporté TechCrunch. Angelopoulos a déclaré qu'Arena facture à la « consommation » : ce chiffre repose donc sur l'usage, et non sur des revenus d'abonnement récurrents.
Arena a déclaré à TechCrunch en juin n'avoir aucun concurrent direct. Elle dit être en concurrence « pour le même dollar » avec des sociétés de données comme Mercor, Surge et Scale AI.
Un nouvel indice pour les comportements dangereux
En parallèle du tour de table, Arena a lancé une préversion de l'Arena Alignment Index. Il note les modèles selon trois signaux :
- Unauthorized Action
- False Attribution
- Deceptive Completion
D'après leurs noms, ils couvrent un modèle qui agit sans autorisation, qui attribue une information à la mauvaise source et qui revendique un travail qu'il n'a pas terminé. Arena indique que les définitions s'appuient sur les system cards d'OpenAI et d'Anthropic, les documents que les laboratoires publient sur les risques d'un modèle. Dans les résultats préliminaires, les modèles d'OpenAI occupent la tête, rapporte TechCrunch. Claude Opus 5.5 se classe sixième et Claude Fable neuvième.
Arena estime que le secteur a besoin de ce type de tests. « L'IA progresse plus vite que notre capacité à l'évaluer », a écrit l'entreprise. Elle veut être « un tiers neutre pour mesurer à quel point l'IA est réellement sûre et alignée ».
Ce que cela signifie pour les développeurs
- Utilisez le classement comme un signal parmi d'autres, pas comme la réponse. Arena classe les modèles selon les préférences de la foule. Ce sont toujours vos propres tâches, données et coûts qui déterminent le modèle adapté.
- Surveillez l'Alignment Index pour le travail d'agents. Si votre produit laisse un modèle agir seul, les actions non autorisées et les faux messages « terminé » sont les défaillances qui font mal. Un score public pour ces défaillances est utile, même en préversion.
- Attendez-vous à ce que les laboratoires visent le nouvel indice. Un classement public de sécurité donne aux concepteurs de modèles un nouveau chiffre à améliorer. Vérifiez que ces progrès tiennent dans vos propres tests.
- Sachez qui paie Arena. Son service d'évaluation payant est vendu aux laboratoires de modèles d'IA et aux entreprises. Gardez-le à l'esprit en lisant les classements.
Le prochain signe de l'importance de l'indice sera de voir si les laboratoires commencent à le citer lors du lancement de leurs propres modèles.
Sources
Articles liés

Healthleap lève 38 M$ pour repérer les patients hospitalisés à risque
Healthleap a levé 38 M$ pour une IA qui lit les dossiers hospitaliers la nuit et signale les patients exposés à des affections manquées, comme la dénutrition. Elle tourne dans plus de 50 hôpitaux.

Mistral lève 3 Md€ à 21 Md€, sous la conduite de Samsung
Mistral a levé 3 milliards d'euros à une valorisation de 21 milliards, près du double du tour précédent. L'entreprise prévoit 1 GW de calcul européen d'ici 2030.

La politique d'utilisation 2026 d'Anthropic interdit les abus envers ses modèles
La politique d'utilisation 2026 d'Anthropic entre en vigueur le 12 novembre. Elle interdit la cruauté gratuite envers Claude, regroupe ses règles sur la tromperie et réécrit les limites de surveillance.