TecnoLoco

Locos por la tecnología

Tendencias Digitales

ChatGPT copió a la mitad de la industria de la IA de la noche a la mañana, pero sus demostraciones en vivo a menudo salían mal

Incluso antes de que se celebrara OpenAI , los usuarios ya habían recibido un "aviso de reducción": el plan Pro de 200 dólares al mes se volvería a abrir a nuevos usuarios, pero el crédito disponible se reduciría a la mitad.

El precio sigue siendo el mismo, pero los beneficios han disminuido. Entonces, ¿qué puede ofrecer OpenAI para convencer a la gente de que siga pagando? Esta es una pregunta que la conferencia de desarrolladores de este año debe responder con urgencia.

Imagen

Hace un momento, el CEO OpenAI Sam Altman, anunció una serie de actualizaciones que incluyen Dot, ChatGPT Space, GPT-6.1 Sol, UltraFast, Pro 500, Decisions API, Agents API, la plataforma en la nube Codex y OpenAI Marketplace.

Imagen

Aunque toda la rueda de prensa parecía estar repleta de novedades, el tema principal era muy claro. OpenAI está conectando modelos, agentes inteligentes, espacios colaborativos y distribución comercial, transformando gradualmente ChatGPT de una herramienta para generar respuestas en una plataforma funcional capaz de comprender el contexto, invocar software y realizar tareas a largo plazo.

Sin embargo, este lanzamiento no se trata tanto de definir un nuevo producto, sino más bien de una evaluación comparativa exhaustiva con respecto a sus competidores: OpenAI quiere reinventar los formatos que otros ya han validado, pero de una forma basada en plataformas.

Dot llega y reorganiza la división del trabajo entre humanos e inteligencia artificial.

La figura más destacada de toda la rueda de prensa fue sin duda "Dot".

Los ojos de Ultraman se iluminaron en el escenario al declarar que este era un producto que había estado esperando durante muchos años. Al igual que los populares Muse y Grok Bot, Dots también es un tipo de agente en línea altamente capacitado y disponible las 24 horas del día, los 7 días de la semana.

Imagen

Los usuarios pueden asignarle un nombre, definir sus responsabilidades a largo plazo y autorizarla con las aplicaciones, dispositivos y entornos de trabajo pertinentes. Dot avanzará continuamente en segundo plano y se pondrá en contacto con el usuario de forma proactiva cuando se produzcan cambios importantes, se requieran decisiones o se necesite su autorización.

Imagen

En concreto, los usuarios pueden usar Dot para supervisar continuamente los informes de errores, probar las correcciones y redactar solicitudes de extracción para planificar el presupuesto del próximo año, o migrar todo el código a una nueva API que está a punto de ser descontinuada. Dot analizará las dependencias, modificará el código, ejecutará las pruebas y, a continuación, enviará los resultados al equipo para su revisión.

Imagen

La base para que estas tareas sean posibles es que Dots tiene su propia identidad, un ordenador en la nube y un navegador, y puede escribir y probar código cuando sea necesario. También puede conectarse a portátiles autorizados por el usuario, accediendo directamente a un entorno de trabajo real.

Imagen

El ecosistema de complementos de OpenAI le proporciona conectividad con más de 4000 aplicaciones. Los usuarios pueden comunicarse con él a través de ChatGPT , SMS, Slack, Teams y llamadas de voz, y el contexto entre canales se mantendrá sincronizado.

Imagen

A continuación, Holly, jefa del equipo de producto OpenAI , utilizó la aplicación musical ficticia Blossom para demostrar cómo funciona realmente Dot.

Cuando el equipo se preparaba para lanzar el producto, Dot ya había descubierto que la reunión de revisión de la versión se había reprogramado, había actualizado el calendario, había resumido los comentarios de los usuarios de prueba de la noche anterior y había encontrado el diseño de la página de inicio presentado por el equipo de diseño en el último minuto.

Imagen

Una vez que recibe la orden "Adelante, hazlo", puede llamar a Codex en la computadora para convertir el diseño en una aplicación ejecutable y prepararse para enviar los cambios como una solicitud de extracción. Sin embargo, durante la demostración en vivo, Dot encontró varios fallos. No solo la velocidad de respuesta fue lenta, sino que cuando Dotty llamó a Codex para compilar la aplicación, el hilo de Codex utilizado para mostrar el progreso de la tarea no se invocó correctamente.

Además, Dot se unirá a los chats grupales de Slack y recibirá tareas como un miembro más del equipo. En la demostración, los ingenieros simplemente envían los comentarios del usuario y el ID de la sesión al canal, y Dot puede investigar el problema y enviar una solución.

Imagen

Ah, por cierto, los internautas también descubrieron un pequeño huevo de Pascua: ahora, al iniciar sesión en el sitio web "Dot.com" se le redirigirá directamente a la página promocional de Gork Bot.

Imagen

Como era de esperar, Alex Wang, director de inteligencia artificial Meta , le ofreció sus "mejores deseos".

Imagen

Por supuesto, cuanto más proactivo sea un Dot, más difícil será evitar problemas de permisos y seguridad. OpenAI configura un ordenador en la nube aislado para cada Dot, lo que permite a los usuarios decidir a qué aplicaciones puede acceder y establecer permisos, restricciones o preaprobaciones para diferentes operaciones.

Las operaciones que impliquen cambios en la cuenta o el intercambio de información se revisarán automáticamente, mientras que las tareas delicadas, como el cambio de contraseñas, siempre requerirán que los usuarios las completen manualmente.

Cuando Dot realiza una "investigación activa" en segundo plano, solo puede usar herramientas con permisos limitados para leer las aplicaciones conectadas y no puede enviar mensajes directamente, modificar el contenido de las aplicaciones ni controlar los dispositivos de los usuarios.

Para las empresas, OpenAI también lanzó un Dot específico.

Imagen

Las empresas pueden asignar agentes inteligentes con identidades independientes y responsabilidades claramente definidas a puestos como finanzas, marketing, legal, compras y atención al cliente. Estos agentes son evaluados continuamente y los empleados proporcionan retroalimentación. OpenAI colabora con Microsoft para integrar Dot con Agent 365, lo que permite a las empresas gestionar estos agentes inteligentes utilizando sus sistemas de identidad, permisos y seguridad existentes.

Dot se implementará gradualmente para los usuarios Pro y Business Premium en los mercados elegibles, mientras que los usuarios Enterprise podrán probar la versión beta después de la activación del administrador.

Imagen

El primer Dot está incluido en el paquete correspondiente. Las conversaciones con el Dot no consumen créditos ChatGPT , pero las tareas iniciadas mediante Codex o trabajos ChatGPT se facturarán como de costumbre. En el futuro, los usuarios podrán añadir más Dots o aumentar su velocidad y capacidad de procesamiento.

Los Dots individuales se encargan de comprender a los usuarios y de avanzar continuamente en las tareas, mientras que ChatGPT Spaces se encargan de permitir que los miembros del equipo empresarial y sus respectivos agentes colaboren en el mismo lugar.

Imagen

Space está diseñado específicamente para la colaboración entre humanos y agentes, utilizando páginas como unidad básica. Puede contener texto, documentos, materiales de investigación, imágenes, tablas, gráficos dinámicos y prototipos ejecutables.

Imagen

Los usuarios pueden mencionar a sus colegas con @, al igual que en los documentos colaborativos, y también pueden mencionar un Dot específico en los comentarios para que rastree dependencias, busque datos o actualice el contenido. La página también puede recibir instrucciones continuas, como revisar diariamente un canal de Slack designado y actualizar el documento actual con los nuevos hallazgos.

Imagen

En la rueda de prensa, Holly hizo que Dot convirtiera los comentarios de los usuarios en un gráfico de barras filtrable y lo actualizara automáticamente cada hora; luego, hizo que recuperara los datos de registro mencionados por un ingeniero en los mensajes privados de Slack y los añadiera a las preguntas frecuentes sobre el lanzamiento del producto.

OpenAI también anunció que en el futuro añadirá funcionalidades de presentación a Space, lo que permitirá a los agentes leerlas y modificarlas, y posibilitará que los equipos creen diapositivas junto con varios Dots.

La combinación de Dot y Space también refleja la visión de OpenAI sobre la próxima generación de software de oficina. El chat es simplemente el punto de partida para comunicar intenciones; el contexto persistente, el entorno de software operativo y el espacio colaborativo para la participación humana en las aprobaciones constituyen la verdadera infraestructura para que los agentes inteligentes se integren en el trabajo diario.

Imagen

GPT-6.1 Sol reduce el coste de funcionamiento a largo plazo.

Para que los agentes inteligentes funcionen eficazmente durante periodos prolongados, los modelos deben ofrecer ventajas en cuanto a capacidad, velocidad y coste. Para abordar esta necesidad, OpenAI lanzó GPT-6.1 Sol, posicionándolo como el modelo principal de uso diario tanto para desarrolladores como para agentes inteligentes.

Imagen

Según la información detallada sobre precios, cobra 2 dólares por millón de tokens de entrada y 10 dólares por millón de tokens de salida, ambos una quinta parte del precio correspondiente de GPT-6 Astra; el costo de entrada en caché es de 0,10 dólares por millón de tokens, lo cual es adecuado para tareas que requieren la lectura repetida de datos del proyecto y la reutilización del contexto.

Imagen

La bajada de precios no estuvo acompañada de una reducción significativa de la capacidad.

OpenAI afirma que el nuevo modelo se aproxima al rendimiento de Astra a un menor coste en ingeniería de software compleja, procesamiento profesional de documentos, flujos de trabajo de varios pasos y evaluaciones de operaciones informáticas, mientras que Astra mantiene el límite superior de capacidad para las tareas de investigación científica más exigentes.

En la prueba de rendimiento de ingeniería de software DeepSWE 1.1, GPT-6.1 Sol alcanzó un nivel cercano al de Astra con aproximadamente una quinta parte del coste y superó la puntuación más alta de GPT-6 Sol en 6,4 puntos porcentuales.

Imagen

En GDP.pdf, una prueba de las capacidades de comprensión de archivos PDF complejos, superó a Opus 5.5 con mecanismo de reserva en todas las configuraciones de inferencia, con un coste de tarea única inferior a la mitad del de este último.

En AutomationBench, diseñado para procesos de negocio de varios pasos, GPT-6.1 Sol supera a Opus 5.5 en más de dos puntos porcentuales con una intensidad de inferencia media, a un coste aproximado de un tercio del de este último.

En la prueba de rendimiento OSWorld 2.0, con la mayor intensidad de inferencia, la diferencia entre OSWorld y Astra se redujo a menos de 2,1 puntos porcentuales, y el coste por tarea fue aproximadamente una séptima parte del de Astra.

Imagen

A partir de hoy, los usuarios de Plus, Pro, Business, Enterprise y Edu pueden usar GPT-6.1 Sol en ChatGPT y Codex, pero este modelo aún no está disponible para su selección en el chat normal. Los desarrolladores pueden invocarlo a través de la API usando gpt-6.1-sol.

En torno a Dot y GPT-6.1 Sol, OpenAI también anunció un conjunto de infraestructuras para agentes inteligentes.

El modo UltraFast aumenta la velocidad de inferencia hasta ocho veces en comparación con el modo estándar, alcanzando hasta 300 tokens por segundo. Actualmente está disponible para Astra y posteriormente será compatible con GPT-6.1 Sol.

Imagen

OpenAI también lanzó el plan Pro de 500 dólares, que ofrece aproximadamente 25 veces más crédito de uso que los miembros Plus y acceso ultrarrápido a ChatGPT y Codex, y reabrió el plan Pro de 200 dólares. Al final de la presentación, OpenAI también añadió un restablecimiento del límite de crédito para los usuarios globales.

Imagen

Para escenarios que requieren toma de decisiones en tiempo real, OpenAI también lanzó la API Decisions, comparable a Jev. Esta permite a Luna seleccionar rápidamente resultados de opciones predefinidas, que pueden utilizarse para el enrutamiento de solicitudes, la clasificación de imágenes y la determinación de la siguiente acción de un agente, manteniendo la comprensión visual, las capacidades multilingües y las funciones de seguridad.

Imagen

Codex también se ha migrado completamente a la nube.

Imagen

Los desarrolladores pueden iniciar tareas desde sus teléfonos móviles y seguir visualizándolas en un navegador o en un ordenador de escritorio. Incluso cuando el ordenador está cerrado, el agente inteligente continúa trabajando en la nube. La nueva versión de Codex CLI incorpora comunicación de voz bidireccional, y Codex Security Cloud puede escanear continuamente en busca de vulnerabilidades, eliminar duplicados automáticamente y preparar soluciones de remediación verificadas.

La API de agentes expone a los desarrolladores las capacidades internas de OpenAI utilizadas para Codex y Dot, incluidos los marcos de ejecución, el alojamiento, la memoria, el control multiagente y el uso de recursos informáticos.

Imagen

OpenAI también presentó Private Intelligence, cuyo objetivo es permitir a las empresas acceder a capacidades de modelos de vanguardia sin conservar el contenido mediante la retención cero de datos, el procesamiento privado seguro y la inferencia privada.

Imagen

Más allá de los modelos, OpenAI también quiere controlar el punto de entrada de las aplicaciones.

Una vez desarrollado el producto, OpenAI también quiso controlar el proceso de distribución.

En el futuro, los usuarios podrán iniciar sesión en productos de terceros con sus cuentas ChatGPT y consumir los tokens de sus paquetes de suscripción, lo que permitirá a los desarrolladores reducir el coste para que los usuarios experimenten el producto por primera vez.

Las extensiones de plugins permiten a los desarrolladores integrar editores, paneles de control e incluso espacios de trabajo completos en ChatGPT y Codex; Figma y Adobe ya han mostrado ejemplos de ello.

Imagen

OpenAI se lanzó el mismo día, con más de 30 socios inicialmente. Los clientes empresariales pueden usar sus créditos de contrato OpenAI existentes para comprar productos de terceros, mientras que los desarrolladores obtienen acceso a un canal de distribución con aproximadamente 1200 millones de usuarios activos semanales.

Imagen

Además, durante las conversaciones se recomiendan proactivamente los complementos, por lo que ChatGPT funciona simultáneamente como punto de entrada, entorno de ejecución y tienda de aplicaciones.

Tras presentar los nuevos productos, Altman retomó el tema recurrente de los límites de crédito. Comentó que OpenAI había realizado tantos "reinicios bancarios" que Tibo sugirió, en tono de broma, cambiar el nombre de la empresa a "Reset Company".

Pero lo que más me preocupa es que realmente exista un botón físico para restablecer el límite de crédito.

Imagen

Cabe destacar que, al final de la presentación, Sam Altman describió su futuro ideal para la IA como un "nuevo Renacimiento", en lugar de una nueva revolución industrial.

Espera que la IA empodere a las personas con mayores capacidades de creación, aprendizaje y exploración. Desde una perspectiva empresarial, el objetivo de OpenAI es igualmente claro: transformar ChatGPT de una superaplicación en una plataforma que aloje a usuarios, agentes y software de terceros.

Pero, en última instancia, las grandes metáforas deben ponerse a prueba en la realidad.

La lógica subyacente de los servicios de internet se basa en un conjunto relativamente estable de servidores y reglas. Las páginas web pueden fallar, los sistemas pueden bloquearse y el software puede tener errores, pero en la mayoría de los casos, los usuarios saben a quién le han confiado información y cómo se gestionará.

El cambio que provocan los agentes de IA es que pueden malinterpretar una orden, dejarse influir por contenido externo o tomar una decisión que se desvíe de la intención original del usuario mediante una serie de pasos aparentemente razonables.

Lo más preocupante es que, a medida que Dot, Codex y Private Intelligence asumen más tareas, surge una pregunta crucial: ¿Estamos realmente preparados para entregar tanta información, permisos y juicios a una caja negra sin reservas?

La respuesta es obviamente no, pero ante el atractivo de una eficiencia y comodidad aparentemente máximas, parece que nos hemos olvidado de dudar.