Actualizado el 07/09/2026: Notebookcheck confirmó los datos del experimento de GPT-6 Astra en Portal y sumó precisiones sobre el setup técnico.
En pocas palabras: GPT-6 Astra, el modelo de OpenAI, completó todo Portal de Valve sin intervención humana esta semana. El experimento del usuario de X cozyblaze usó unos 3.300 tool calls, duró casi 24 horas de partida real y costó 571,18 dólares en llamadas a la API.
GPT-6 Astra, el modelo más nuevo de OpenAI, completó el videojuego Portal por su cuenta esta semana, sin que nadie tocara el control. El experimento, armado por el usuario de X cozyblaze, terminó costando 571,18 dólares en llamadas a la API y acumuló unos 3.300 tool calls a lo largo de casi 24 horas de partida real.
GPT-6 Astra es el modelo de lenguaje más reciente de OpenAI, lanzado días antes de este experimento y presentado por la compañía como un paso hacia la AGI. Un usuario lo conectó al Portal de Valve a través de un harness que le enviaba capturas de pantalla y coordenadas del jugador, y el modelo resolvió cada cámara de forma autónoma, sin instrucciones humanas durante la partida.
En este artículo:
- En 30 segundos
- ¿Cuánto costó que una IA complete Portal por primera vez?
- ¿Qué es GPT-6 Astra?
- ¿Cómo jugó GPT-6 Astra a Portal sin intervención humana?
- ¿Por qué el video parece un aimbot y por qué dura solo 2 horas?
- ¿Por qué se eligió Portal para este experimento?
- ¿Cuánto cuesta usar GPT-6 Astra?
- ¿Cómo se compara GPT-6 Astra con Claude, Gemini y DeepSeek en agentes de IA?
- ¿Qué precedentes tiene este tipo de experimento con IA jugando videojuegos?
- ¿Qué está confirmado y qué no sobre GPT-6 Astra jugando Portal?
- Errores comunes al leer esta noticia
- Preguntas Frecuentes
- Conclusión
- Fuentes
En 30 segundos
- GPT-6 Astra completó todo Portal sin intervención humana, según relató el usuario de X cozyblaze.
- El experimento acumuló unos 3.300 tool calls y costó 571,18 dólares en tokens de API.
- El video muestra una partida de 2 horas, pero el experimento completo duró casi 24 horas porque el juego se pausaba mientras el modelo “pensaba”.
- Notebookcheck precisó que ese gasto en realidad quedó cubierto por la suscripción Codex Pro de 200 dólares mensuales de cozyblaze, no por un pago aparte de 571 dólares.
- No hay comunicado oficial de OpenAI sobre el experimento de Portal puntual: es una prueba de un usuario, no un anuncio de la empresa.
¿Cuánto costó que una IA complete Portal por primera vez?
571,18 dólares en llamadas a la API, según los datos que publicó VideoCardz a partir del hilo de cozyblaze en X. Esa cifra no es el precio de una suscripción ni algo que vaya a pagar cualquier usuario que abra Portal: es lo que costó mantener a GPT-6 Astra procesando imágenes, decidiendo movimientos y ejecutando acciones durante casi un día entero.
El número sale de sumar unos 3.300 tool calls, cada uno con su costo de tokens de entrada y salida. Ponele que cada llamada implica mandarle al modelo una captura de pantalla, las coordenadas del jugador y el historial reciente de la partida: eso se acumula rápido, sobre todo en un juego que exige razonar sobre física y espacio en cada sala. Ya lo cubrimos antes en si querés profundizar, tenemos una guía completa sobre ChatGPT.
¿Qué es GPT-6 Astra?
GPT-6 Astra es el modelo de lenguaje más nuevo y potente de OpenAI, lanzado apenas días antes de este experimento. La compañía lo posiciona como el modelo que debería acercar sus productos a la llamada AGI (inteligencia artificial general), aunque ese objetivo sigue siendo, como mínimo, discutible. En nuestra guía completa de ChatGPT profundizamos sobre esto.
No hay todavía un comunicado técnico detallado de OpenAI sobre las capacidades específicas de Astra en tareas de razonamiento espacial o control de videojuegos. Lo que existe es este experimento externo, hecho por un usuario particular con acceso a la API, no una demo oficial de la empresa.
¿Cómo jugó GPT-6 Astra a Portal sin intervención humana?
cozyblaze conectó a GPT-6 Astra al juego mediante un harness que le pasaba capturas de pantalla y las coordenadas del jugador, y el modelo respondía ejecutando acciones a través de un toolset conectado.
Notebookcheck detalló que, del lado técnico, el setup fue minimalista: “solo el modelo, un SourcePauseTool modificado y el Model Context Protocol manejando las pulsaciones de botones reales”, sin herramientas externas de asistencia ni guías de resolución cargadas de antemano. El modelo recibía información visual del juego (dónde estaba parado, qué portales tenía abiertos, qué obstáculos tenía adelante) y decidía el siguiente movimiento en base a eso, algo más parecido a una estrategia por turnos que a un reflejo automático.
¿Por qué el video parece un aimbot y por qué dura solo 2 horas?
El juego se pausaba cada vez que GPT-6 Astra tenía que procesar la imagen y decidir qué hacer, y esas pausas se recortaron en la edición del video final. El resultado es un clip donde el modelo se mueve con precisión perfecta y velocidad constante, algo que a simple vista parece un aimbot (aunque, técnicamente, es más bien lo contrario). Esto se conecta con lo que analizamos en repasamos todo sobre los modelos GPT en esta guía.
¿Cuánto duró en realidad el experimento? Casi 24 horas, contando el tiempo que el modelo pasó “pensando” entre acción y acción. El video de 2 horas es una versión comprimida, no un registro en tiempo real de la partida completa.
¿Por qué se eligió Portal para este experimento?
Portal exige resolver acertijos espaciales: entender salas, calcular dónde ubicar cada portal y planificar el movimiento entre superficies conectadas. Es un desafío distinto al de un juego de reflejos, porque necesita razonamiento sobre geometría y secuencia, no solo puntería o velocidad.
Portal es también un juego viejo (salió en 2007) y extensamente documentado en internet, con guías, transcripciones y análisis de cada cámara. Es probable que GPT-6 Astra ya tuviera conocimiento previo de sus mecánicas desde los datos de entrenamiento, lo cual no le resta mérito al logro, pero sí matiza qué tan “desde cero” fue realmente la resolución de cada acertijo.
¿Cuánto cuesta usar GPT-6 Astra?
Los 571,18 dólares del experimento son el costo puntual de esta partida vía API, no el precio de acceso general al modelo. OpenAI no publicó, en el marco de este hecho, una tabla de precios específica para Astra, así que cualquier cifra de suscripción mensual o de costo por token fuera de este experimento queda sin confirmar con la información disponible hasta ahora. En GPT-6 Astra también llegó a GitHub Copilot profundizamos sobre esto.
Lo que sí está confirmado es el patrón de gasto: tareas agénticas largas, con miles de llamadas encadenadas y procesamiento de imágenes en cada paso, escalan el costo rápido. Para un equipo evaluando meter agentes de IA en un flujo de trabajo real, ese es el dato que importa más que el precio de lista: el costo depende de cuántas vueltas necesita el modelo para resolver la tarea, no solo de la tarifa por token.
¿Cómo se compara GPT-6 Astra con Claude, Gemini y DeepSeek en agentes de IA?
Cada laboratorio viene apostando a un ángulo distinto dentro de los agentes de IA, y el experimento de Portal deja a GPT-6 Astra parado en el terreno del razonamiento espacial en entornos 3D físicos, algo que ni Claude ni Gemini ni DeepSeek mostraron públicamente hasta ahora con este nivel de autonomía.
Anthropic viene priorizando el uso de computadora orientado a tareas de oficina y coding agéntico con Claude: moverse por interfaces reales, completar formularios, escribir y testear código de punta a punta. Google apuesta a Gemini como un agente multimodal fuerte en navegación web y comprensión de video, mientras que DeepSeek se metió en la conversación por el lado del razonamiento eficiente y el coding a bajo costo, con modelos de pesos abiertos que compiten en benchmarks técnicos sin necesitar la infraestructura de un gigante.
| Modelo | Fortaleza demostrada en agentes | Caso de uso destacado |
|---|---|---|
| GPT-6 Astra (OpenAI) | Razonamiento espacial en entornos 3D físicos | Completar Portal sin intervención humana |
| Claude (Anthropic) | Computer use y coding agéntico | Automatizar tareas de oficina y desarrollo de software |
| Gemini (Google) | Multimodalidad y navegación web | Agentes que operan navegadores y contenido audiovisual |
| DeepSeek | Razonamiento y coding eficiente | Modelos de pesos abiertos con buen rendimiento a menor costo |
Ojo con sacar conclusiones apuradas de esta comparación: son pruebas hechas en condiciones distintas, con harnesses distintos y sin un benchmark común que las mida a todas por igual. Sirve más como fotografía de hacia dónde apunta cada empresa que como ranking definitivo.
¿Qué precedentes tiene este tipo de experimento con IA jugando videojuegos?
El antecedente más citado es ClaudePlaysPokemon, el canal de Twitch donde Claude intentaba completar un juego de Pokémon hace más o menos un año y medio. En ese momento, según el relato de quien siguió el experimento en XDA Developers, el modelo se trababa seguido y era frustrante ver cómo deshacía su propio progreso una y otra vez.
La comparación entre ambos casos sirve para dimensionar el salto: pasar de un modelo que se atascaba en decisiones simples a otro que resuelve un juego entero de puzzles espaciales sin ayuda es, cuanto menos, una señal de que los agentes de IA mejoraron su capacidad de planificación en tareas largas. Ojo con esto: son juegos distintos, con exigencias distintas, así que la comparación es más ilustrativa que estrictamente científica. Tema relacionado: los usuarios Plus ya pueden probar GPT-5.6 Sol.
cozyblaze evitó, de hecho, llamarlo un “benchmark” formal. Pero el resultado alimenta la narrativa que OpenAI viene construyendo desde hace años sobre lo que Notebookcheck describió como un “agente de gameplay universal”, capaz de resolver juegos distintos con un mismo sistema en lugar de entrenar un modelo específico por título.
| Dato | Detalle confirmado |
|---|---|
| Juego completado | Portal (Valve) |
| Modelo usado | GPT-6 Astra (OpenAI) |
| Costo total en tokens | USD 571,18 |
| Tool calls acumulados | Unos 3.300 |
| Duración real del experimento | Casi 24 horas |
| Duración del video publicado | 2 horas (pausas editadas) |
| Autor del experimento | cozyblaze (X/Twitter) |
| Fecha del experimento | Primera semana de septiembre de 2026 |
| Suscripción usada | Codex Pro (USD 200/mes) |
¿Qué está confirmado y qué no sobre GPT-6 Astra jugando Portal?
Hay datos duros y hay zonas grises en esta historia. Separarlos importa para no repetir afirmaciones que nadie confirmó oficialmente.
- Confirmado: el costo y los tool calls. Los 571,18 dólares y las cerca de 3.300 llamadas surgen directamente del relato de cozyblaze, reproducido por XDA Developers, Notebookcheck y VideoCardz.
- Confirmado: la edición del video. Las fuentes coinciden en que las pausas de “pensamiento” del modelo fueron cortadas del clip final.
- Confirmado: el setup técnico. Notebookcheck detalló que la corrida usó solo el modelo, un SourcePauseTool modificado y el Model Context Protocol, sin herramientas de asistencia externa.
- No confirmado: un comunicado oficial de OpenAI sobre el experimento de Portal. La empresa no publicó, hasta el momento, un anuncio propio sobre esta prueba puntual.
- No confirmado: verificación independiente del experimento. Nadie ajeno a cozyblaze reprodujo públicamente el mismo resultado con otro set de capturas o logs auditados de forma externa.
Errores comunes al leer esta noticia
- Confundir el costo del experimento con el precio de Astra. Los 571 dólares son gasto de API en una tarea agéntica larga, no una tarifa de suscripción, y de hecho quedaron cubiertos por una suscripción Codex Pro de 200 dólares mensuales.
- Pensar que las 2 horas del video son tiempo real. El experimento completo, pausas incluidas, llevó casi 24 horas.
- Asumir que esto es un anuncio de producto de OpenAI. El experimento de Portal es de un usuario con acceso a la API, no un anuncio oficial de la empresa.
- Creer que el modelo resolvió Portal “desde cero”. Al ser un juego viejo y muy documentado, es probable que Astra ya tuviera conocimiento previo de sus cámaras y mecánicas.
Preguntas Frecuentes
¿Qué es GPT-6 Astra?
GPT-6 Astra es el modelo de lenguaje más nuevo y potente de OpenAI, lanzado apenas días antes de este experimento. La compañía lo presenta como un paso hacia la AGI, aunque ese punto sigue sin verificación independiente.
¿GPT-6 Astra jugó Portal sin ayuda humana?
Sí. Según el relato de cozyblaze, el modelo recibió capturas de pantalla y coordenadas a través de un harness, y decidió y ejecutó cada acción por su cuenta hasta completar el juego, sin que un humano tomara el control en ningún momento.
¿Cuánto costó que GPT-6 Astra complete Portal?
571,18 dólares en llamadas a la API, acumulados a lo largo de unos 3.300 tool calls durante el experimento completo. Ese gasto quedó cubierto por la suscripción Codex Pro de 200 dólares mensuales de cozyblaze, no fue un pago aparte de bolsillo.
¿Cuánto tardó la IA en terminar Portal?
Casi 24 horas en total, contando las pausas en las que el modelo procesaba la imagen y decidía el próximo movimiento. El video publicado muestra una versión editada de 2 horas, sin esas pausas.
Conclusión
Lo que cambió con GPT-6 Astra completando Portal no es tanto el hecho de que una IA termine un juego, sino la naturaleza de la tarea: razonamiento espacial sostenido durante casi un día entero, sin trabarse. Comparado con el ClaudePlaysPokemon de hace año y medio, la diferencia en capacidad de planificación es notoria.
El dato que más debería quedar de esta semana ya no es solo el de los 571,18 dólares (que, de hecho, terminó pagando una suscripción de 200 dólares mensuales, no un cargo extra), sino la escala del experimento: un modelo que encadenó miles de decisiones autónomas durante casi un día entero sin intervención humana. Para cualquiera que esté evaluando meter agentes de IA en tareas largas, la lección sigue siendo doble: el costo depende de cuántas vueltas necesita el modelo para resolver la tarea, y la supervisión de ese proceso no es un detalle menor.