El modelo de IA número 1 de OpenAI en junio se cotiza con una probabilidad de mercado del 7%, con un volumen de $2,463 en 24 horas y resolución el 30 de junio. Opera en vivo en Polymarket a través de Polymarket Trade.
Este mercado ha sido archivado. El contenido histórico se conserva a continuación.
OpenAI dominó los rankings de modelos de IA de 2018 a mediados de 2023 con GPT-2, GPT-3 y GPT-4, pero el panorama competitivo ha cambiado dramáticamente. La familia Claude 3 de Anthropic ahora supera frecuentemente a GPT-4 en benchmarks de razonamiento y tareas de contexto extendido. DeepSeek logró resultados competitivos con costos de cómputo dramáticamente menores, mientras que los modelos Llama de código abierto de Meta cerraron brechas de capacidad y Gemini de Google mejoró sustancialmente. La probabilidad del 7% del mercado refleja escepticismo de que OpenAI pueda recuperar la posición de liderazgo en benchmarks para el 30 de junio frente a un campo cada vez más concurrido de competidores bien financiados que lanzan nuevos modelos cada 2-3 meses. OpenAI retiene ventajas de escala de cómputo y bloqueo empresarial, pero los benchmarks se han vuelto más granulares y multidimensionales, haciendo que el estado de "número 1" sea más difícil de mantener. El plazo ajustado de seis meses amplifica la presión competitiva, ya que el ciclo de iteración rápida del desarrollo moderno de IA podría cambiar los rankings múltiples veces antes de la resolución.
La dominación histórica de OpenAI en los rankings de modelos de IA se basó en la innovación algorítmica sostenida combinada con recursos de cómputo masivos y calidad superior de datos de entrenamiento. GPT-4 (marzo de 2023) representó un momento decisivo, manteniendo una superioridad clara en la mayoría de los benchmarks durante casi un año. Sin embargo, la respuesta competitiva ha sido rápida y multifacética. La familia Claude 3 de Anthropic (marzo de 2024) demostró un desempeño revolucionario en ARC-C (razonamiento), MMLU (conocimiento) y benchmarks especializados de STEM, frecuentemente superando a GPT-4 en tareas que requieren razonamiento paso a paso o manejo de casos extremos. Los lanzamientos de DeepSeek demostraron que las innovaciones de eficiencia y los enfoques de entrenamiento novedosos podrían lograr paridad con modelos de frontera a una fracción del costo de cómputo, un hallazgo que desafió la suposición anterior de OpenAI de que la escala bruta era el destino. Llama 3 de Meta y posteriores lograron casi paridad con sistemas propietarios mientras permanecían de código abierto, reduciendo las barreras de entrada para competidores. Google invirtió fuertemente en iteraciones de Gemini en múltiples clases de tamaño, abordando preocupaciones de calidad anteriores. La probabilidad actual del 7% en el mercado implica que los operadores creen que OpenAI se enfrenta a obstáculos estructurales para mantener la posición número 1. Factores que favorecen fuertemente a NO: (1) Granularidad de benchmarks—razonamiento vs. codificación vs. conocimiento vs. contexto extendido crean múltiples tablas de clasificación, y ningún modelo individual domina todos; (2) Velocidad de lanzamiento—los competidores ahora operan en ciclos de 8-12 semanas en lugar de 12-18 meses, creando presión constante para defender; (3) Comoditización—los modelos de código abierto y herramientas especializadas erosionan el valor de la clasificación "de frontera" pura; (4) Dispersión de talento—los principales investigadores dispersos en Anthropic, DeepSeek, Google y startups emergentes, no concentrados en OpenAI. Factores que favorecen SÍ: (1) Los rumores de GPT-5 sugieren que OpenAI se está preparando para un salto importante en capacidad; (2) Los datos empresariales y patrones de uso proporcionan bucles de retroalimentación que los benchmarks académicos pierden; (3) Las metodologías RLHF e IA constitucional que OpenAI pionera siguen siendo difíciles de replicar; (4) El presupuesto de cómputo verificable a escala sigue siendo una ventaja de OpenAI. El plazo del 30 de junio es notablemente inmediato—solo seis meses de aquí a mediados de 2026. Esta valuación de mercado sugiere consenso de que la competencia por el liderazgo en modelos de IA ha cambiado fundamentalmente de carácter: de un duopolio de dos años mantenido por una sola organización a una competencia continua donde ningún actor puede mantener la posición de liderazgo por períodos extendidos.
El mercado se resuelve SÍ si el modelo de OpenAI ocupa la posición número 1 en los principales benchmarks de IA (LMSYS Live Arena, ARC-C, MMLU) antes del 30 de junio de 2026; NO si los competidores mantienen las posiciones principales en la mayoría de las métricas.
Los mercados de predicciones agregan las expectativas de los operadores en estimaciones de probabilidad en tiempo real. En Polymarket Trade, cada pregunta de mercado se resuelve como YES o NO según el resultado específico de un evento; los operadores compran participaciones del lado que creen que se resolverá positivamente. Los precios van desde 0¢ (NO seguro) hasta 100¢ (YES seguro) y reflejan naturalmente la probabilidad implícita por la multitud de que sea YES. Esta página resume el estado del mercado para los lectores que llegan desde búsquedas; para operar en vivo (colocar órdenes, ver la profundidad del libro de órdenes, ejecutar una operación), abre la página interactiva completa enlazada arriba.