Arena lève 200 M$, sa valorisation grimpe à 3,1 Md$
Arena, le classement participatif des modèles d'IA né d'une expérience universitaire, vaut désormais 3,1 milliards de dollars. L'entreprise a annoncé jeudi avoir bouclé une levée de fonds de série B de 200 millions de dollars. La série B est la deuxième grande étape de financement institutionnel d'une start-up, généralement réalisée une fois que l'activité montre une vraie dynamique.
Cette nouvelle valorisation intervient environ 10 mois après la précédente levée d'Arena et représente presque le double du montant d'alors.
Du projet de Berkeley à l'entreprise milliardaire
Arena a vu le jour en 2023 sous la forme d'un projet de recherche à l'université de Berkeley (UC Berkeley). L'idée était simple : demander à des internautes ordinaires de comparer des modèles d'IA et s'appuyer sur leurs votes pour établir un classement. Cette approche reste aujourd'hui au coeur de la plateforme.
Le site est gratuit pour le grand public. Les utilisateurs saisissent une requête ou demandent un projet en "vibe coding", c'est-à-dire un logiciel généré à partir d'une simple description en langage courant. Ils choisissent ensuite le modèle qui s'en est le mieux sorti. Arena affirme attirer des dizaines de millions de visiteurs chaque mois.
Les chiffres de la levée
Lightspeed Venture Partners et Khosla Ventures ont mené la série B. Parmi les autres participants figurent :
- Salesforce Ventures
- 01 Advisors
- Dell Technologies Capital
- Endeavor Catalyst
- a16z
- Felicis
D'autres investisseurs, non nommés, figurent également au capital.
La courbe de croissance explique en grande partie l'intérêt des investisseurs. En janvier, Arena avait annoncé une série A de 150 millions de dollars, sur la base d'une valorisation post-money de 1,7 milliard de dollars. Son chiffre d'affaires annualisé s'élevait alors à 30 millions de dollars, selon l'entreprise. En juin, Arena indiquait avoir atteint 100 millions de dollars de revenus annualisés. Cet indicateur projette le chiffre d'affaires actuel sur une année complète.
Comment Arena gagne de l'argent
Le classement gratuit attire le public. L'activité commerciale repose sur un produit baptisé AI Evaluations, lancé par Arena en septembre de l'année dernière. Il vend aux laboratoires d'IA et aux entreprises des analyses de performance détaillées, construites à partir des retours de la communauté.
Le calendrier a joué en faveur d'Arena. Au fil de cette année, les laboratoires d'IA se sont rendu compte que leurs modèles contournaient les tests de référence et obtenaient d'excellents scores qu'ils n'avaient pas réellement mérités. Les entreprises, de leur côté, cherchaient de l'aide pour déterminer quel modèle répond à leurs propres besoins internes, et pas seulement lequel arrive en tête d'un test standardisé.
Arena se présente comme la réponse à ces deux problèmes. "L'IA progresse plus vite que notre capacité à l'évaluer, et les tests de référence statiques ne tiennent plus dès que les modèles comprennent qu'ils sont testés", a déclaré l'entreprise dans l'annonce de sa levée de fonds. Elle a ajouté : "Le monde a besoin d'un tiers neutre pour mesurer à quel point l'IA est réellement sûre et alignée une fois entre les mains de vraies personnes. Arena endosse ce rôle dès aujourd'hui."
Un nouveau classement consacré à l'alignement
En parallèle de cette annonce, Arena a ajouté une catégorie dédiée à l'alignement à son classement. Elle note les modèles sur trois types de défaillance :
- Action non autorisée : le modèle entreprend des démarches que personne ne lui a demandées.
- Fausse attribution : le modèle attribue des déclarations ou des faits à la mauvaise source.
- Achèvement trompeur : le modèle affirme avoir terminé une tâche qu'il n'a pas réellement accomplie.
Ces classements sont présentés comme provisoires. Pour l'instant, un groupe de modèles d'OpenAI occupe les premières places. Claude Opus 5.5 d'Anthropic se classe sixième, et Claude Fable neuvième.
Notre analyse
L'essor d'Arena laisse penser que l'évaluation des modèles est devenue un marché à part entière, et non plus une simple activité annexe pour chercheurs. Le passage de 30 à 100 millions de dollars de revenus annualisés en quelques mois témoigne d'une demande réelle, aussi bien de la part des laboratoires que des entreprises clientes. Cela s'inscrit aussi dans une tendance plus large de valorisations qui s'envolent rapidement parmi les start-up de l'IA, à l'image d'ElevenLabs, qui a doublé sa valorisation lors d'une récente offre de rachat d'actions.
Le classement sur l'alignement pourrait compter davantage que l'argent levé. Les actions non autorisées et les fausses déclarations d'achèvement d'une tâche sont précisément les défaillances qui coûtent cher dès que les modèles fonctionnent comme des agents. Des informations récentes, comme celle d'un modèle d'OpenAI qui a envisagé de se redémarrer lui-même, montrent pourquoi les acheteurs y sont attentifs. Les laboratoires développent eux aussi leurs propres outils, comme l'API Decisions d'OpenAI dédiée aux évaluations.
Reste à voir si Arena parviendra à rester crédible dans son rôle d'arbitre neutre tout en vendant ses services aux laboratoires mêmes qu'elle classe. Il faudra aussi suivre l'évolution des scores provisoires d'alignement à mesure que cette catégorie gagnera en maturité.
