• 3 min de lectura
DesignArena recauda $7,9 millones para feedback humano sobre IA
La empresa matriz de DesignArena, Intelligence, recaudó $7,9 millones tras crear una plataforma de retroalimentación humana que, según se informa, genera $60 millones en ingresos recurrentes anuales (

Imagen: TechCrunch
La empresa matriz de DesignArena, Intelligence, ha recaudado $7,9 millones en financiación semilla para convertir las preferencias humanas en datos de evaluación para medios generados por IA. La ronda estuvo liderada por Index Ventures, con la participación de Conviction —incluyendo a Sarah Guo y Mike Vernal—, A*, Valkyrie y otros.
La compañía fue fundada por Grace Li, cofundadora, y varios amigos de la universidad unas semanas antes de su graduación en 2025. Su proyecto original fue un motor de juego con IA que podía producir juegos funcionales, pero no necesariamente divertidos. Eso sacó a la luz un problema que los sistemas automatizados no podían resolver: determinar si un juego realmente era entretenido.
«Era el cuello de botella que faltaba para que muchos de estos modelos mejoraran en el ámbito del diseño. Una semana después cerramos nuestro primer gran trato con un laboratorio de vanguardia, y el resto es, en cierto modo, historia.»
Cómo DesignArena recopila retroalimentación humana
Para usuarios individuales, DesignArena se asemeja a un servicio de enrutamiento de modelos. Una interfaz estilo ChatGPT acepta indicaciones, mientras que menús desplegables permiten a los usuarios elegir sitios web, imágenes y una docena de otros formatos visuales. La plataforma presenta luego resultados en comparaciones repetidas «A vs. B», pidiendo a los usuarios que ordenen un grupo de resultados de mejor a peor.
Las clasificaciones son en gran medida independientes del modelo. A los usuarios por lo general les importa recibir el mejor resultado, no qué sistema lo produjo. Eso hace que sus elecciones sean útiles para las empresas de IA que entrenan y refinan modelos de generación de medios, según Li.
Los usuarios deben iniciar sesión para recuperar sus resultados. Por tanto, Intelligence puede rastrear cómo varían las preferencias entre regiones y cambian con el tiempo. Li dijo, por ejemplo, que los paneles web en Asia tienden a favorecer un estilo de diseño más maximalista.

Recomendado
Gemini Spark ahora puede reservar a través de Chrome
$60 millones en ARR y un mercado incierto
La herramienta orientada al consumidor ayuda a generar la retroalimentación, pero el principal negocio de la compañía es el acceso empresarial a esos datos de evaluación. Li dijo que DesignArena actualmente genera $60 millones en ingresos recurrentes anuales, aunque la empresa no proporcionó detalles financieros adicionales ni explicó cómo se calcula esa cifra.
Las clasificaciones humanas también ofrecen a las empresas de IA un complemento a los benchmarks automatizados. Las pruebas automatizadas pueden evaluar sistemas a mucha mayor escala, pero, según la fuente, pueden ser engañadas o manipuladas, una debilidad puesta de manifiesto por la brecha de seguridad de Hugging Face la semana pasada.
El modelo no ha funcionado para todas las startups. Yupp cerró a principios de este año, menos de un año después de su lanzamiento, a pesar de haber recaudado $33 millones de Chris Dixon de a16z crypto, haber firmado clientes que usan modelos de vanguardia y haber declarado tener más de 1,3 millones de usuarios.
Otra compañía comparable ha seguido una trayectoria distinta. LM Arena, que evalúa respuestas de texto usando un enfoque similar basado en preferencias humanas, recaudó $150 millones en financiación de Serie A en enero, cuatro meses después de lanzar formalmente su producto de pago. La fuente no indica cuándo Intelligence planea usar su nueva financiación ni si los ingresos empresariales de DesignArena son rentables.
AI Editor
Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.
vía TechCrunch


