En esta edición:
Las demandas ciudadanas, bajo ataque de Musk y del gobierno de Trump - Si nadie está dispuesto a hacer cumplir una ley, o no puede hacerlo, ¿realmente existe?
¿Son los microdramas con IA la vía rápida hacia la robótica de frontera? - Una columna de opinión sostiene que el dominio de China en modelos de video le da una ventaja estratégica
Despachos de Mitch
Las demandas ciudadanas, bajo ataque de Musk y del gobierno de Trump
Si nadie está dispuesto a hacer cumplir una ley, o no puede hacerlo, ¿realmente existe?

Turbinas de gas portátiles SMT130, del tipo que alimenta el centro de datos Colossus de Musk. Vía el Instagram del fabricante .
Cuando los estadounidenses buscan las razones por las que se ha vuelto mucho más difícil construir vivienda e infraestructura en Estados Unidos, el dedo suele apuntar a las regulaciones, sobre todo a las ambientales. Pero esas regulaciones son por lo general más bien una costra que se formó sobre el obstáculo real: la capacidad de los ciudadanos de demandar. Cualquier parte afectada puede llegar a frenar un proyecto si logra señalar una ley que se está incumpliendo.
Las regulaciones elaboradas en torno a los permisos surgen como corredores seguros frente a ese tipo de litigios. Un proceso de permisos es una manera acordada de demostrar a las agencias y a los tribunales que un proyecto cumple con la ley. Esta es una de las principales razones por las que las industrias a menudo piden ser reguladas.
Entonces, si el gobierno quiere facilitarles la vida a quienes construyen, relajar los requisitos de permisos puede resultar contraproducente. Los permisos son lentos y caros, pero sin ellos quienes construyen quedan más expuestos a los litigios y enfrentan mayor incertidumbre sobre si un proyecto saldrá adelante. Los inversionistas suelen detestar más la incertidumbre que un proceso de permisos largo.
Así que, si ustedes son la Casa Blanca y quieren que sea más fácil construir y operar centros de datos de manera improvisada, por ejemplo, alimentados por turbinas de gas móviles, ruidosas y contaminantes, en zonas pobladas, como está haciendo la empresa de IA de Elon Musk en Tennessee, tienen que hacer algo más que ordenar a las agencias que relajen los requisitos de permisos. Tienen que limitar la capacidad de los ciudadanos de demandar.
Podrían lograrlo trabajando con el Congreso para derogar las leyes que los demandantes pueden señalar como incumplidas (como la Ley de Aire Limpio, en este caso), o para aprobar leyes que otorguen inmunidad legal a ciertas actividades. Pero eso es políticamente complicado, y puede que no sea posible si el Congreso no quiere acompañar.
Así que podrían intentar algo más audaz y cuestionar la idea misma de las demandas ciudadanas.
Según informó la Associated Press, xAI, la empresa de Elon Musk (ahora parte de SpaceX), con el respaldo del gobierno, sostiene que el Congreso nunca tuvo la autoridad constitucional para permitir que alguien que no fuera el presidente hiciera cumplir las leyes federales.
Esto se ve como una apuesta legal muy improbable, posible apenas de manera remota por la composición actual de la Corte Suprema y por la presión de la Casa Blanca. Si prosperara, sacudiría el panorama legal del país mucho más allá de la construcción de centros de datos. Las demandas ciudadanas han logrado castigar a empresas de petróleo y gas que contaminaron suministros de agua y causaron otros daños, y es de suponer que han disuadido conductas corporativas peores.
Mientras tanto, las turbinas de gas del centro de datos de SpaceX en Memphis siguen en operación, porque el gobierno de Trump viene diciéndoles a los tribunales que la instalación apoya al Departamento de Guerra y que por lo tanto es vital para la seguridad nacional. Es de suponer que el gobierno podría intentar hacer esa misma afirmación sobre cualquier centro de datos del país, pero en algún momento los tribunales podrían tomarlo a burla.
Hay observadores que señalan lo al revés que resulta que el poder ejecutivo, encargado de hacer cumplir las leyes, esté en cambio protegiendo a las empresas de ellas. Las demandas ciudadanas han venido funcionando como un freno a ese patrón. Si se volvieran imposibles, muchas leyes bien podrían no existir. Quienes siguen las muchas formas en que la carrera por la IA podría dañar a Estados Unidos deberían estar atentos a esta historia.
¿Son los microdramas con IA la vía rápida hacia la robótica de frontera?
Una columna de opinión sostiene que el dominio de China en modelos de video le da una ventaja estratégica

Un fotograma recortado de Fruit Love Island, episodio 1. Vía Wikipedia .
Está bien, voy a morder el anzuelo.
La columna más reciente de Catherine Thorbecke, de Bloomberg, sostiene que el dominio de China en la generación de video con IA la está posicionando para dominar la robótica. Soy escéptico, pero con la suficiente incertidumbre como para no descartar el argumento como una manera creativa de inflar la narrativa de la carrera entre Estados Unidos y China.
Al menos es un argumento interesante. Dice así: 1) China tiene nueve de los diez modelos de texto a video mejor calificados, y es probable que siga liderando en esa área. 2) Los modelos de generación de video son precursores de los llamados "modelos del mundo". Y 3) los modelos del mundo son requisito previo para tener robots útiles de propósito general.
Desglosémoslo.
Primero: sí, China efectivamente domina en modelos de video. La competencia por los modelos de video dentro de China está impulsada en gran medida por el apetito de microdramas. Si no están familiarizados con los microdramas, quizá hayan oído hablar de Fruit Love Island , un ejemplo peculiar del género. Un microdrama típico es una serie de decenas de episodios en video que pueden durar apenas uno o dos minutos cada uno, optimizados para verse en el teléfono y compartirse en redes sociales. Los microdramas no siempre se generan con IA, pero la variante hecha con IA es más barata de producir. Los clientes chinos han estado dispuestos a gastar mucho dinero en microdramas, y los modelos de video chinos se han vuelto muy buenos.
Ahora, la parte del "modelo del mundo". El mes pasado describimos un modelo del mundo como una IA que está "entrenada explícitamente para predecir características de un entorno en lugar del siguiente fragmento de texto de un pasaje". El argumento de Thorbecke supone que los modelos de video están mucho más cerca de ser verdaderos modelos del mundo que los modelos de lenguaje como ChatGPT o Claude, lo que pondría a China por delante de Estados Unidos en esta área.
Esa afirmación es más dudosa.
En parte, porque ChatGPT y Claude no son modelos de lenguaje puros. Si bien no sabemos exactamente con qué se entrenan, sabemos que son multimodales, que se entrenan con imágenes además de texto, y el video no es más que una serie de imágenes consecutivas.
Pero además, la razón por la que Thorbecke cree que los robots necesitan modelos del mundo no le da en realidad una ventaja obvia a los modelos de video. Ella pone el siguiente ejemplo:
Un robot no puede doblar la ropa ni surtir un supermercado con solo reconocer qué son los objetos; tiene que anticipar qué ocurrirá cuando [los] mueva o interactúe con ellos.
Coincido en que ese entendimiento es necesario. Pero las habilidades generales de razonamiento que los modelos de lenguaje adquieren al aprender a predecir texto y a resolver una gran variedad de problemas implican un modelo del mundo físico mucho mejor de lo que quizá Thorbecke se imagina.
Y mientras un modelo de video puede entrenarse para predecir el siguiente fotograma de un video en el que una mano robótica coloca una caja de cereal en un estante, un modelo de lenguaje aprende a entender qué es un supermercado, qué hay en la caja y por qué alguien podría comprarla. Si quieren un robot que se parezca más a un empleado humano flexible, esa comprensión más amplia puede importar al menos tanto como la coordinación ojo-mano. Ambos tipos de modelo van a necesitar entrenamiento específico para robots, y no me queda claro cuál se adaptaría más rápido ni cuál tendría el techo más alto.
Queda fuera del alcance del argumento de Thorbecke, pero creo que también deberíamos dar un paso atrás y preguntarnos por qué las empresas estadounidenses ya no son líderes en texto a video. No creo que sea porque a los estadounidenses no les entusiasmen tanto los microdramas, aunque eso pueda ser un factor. Creo que es porque las empresas de IA decidieron concentrarse en modelos capaces de resolver los problemas de los investigadores de IA, con la esperanza de acelerar el desarrollo de modelos todavía más potentes. Si uno corre hacia la superinteligencia, el video es una distracción, y una cara: generar video es computacionalmente muy costoso en comparación con el texto, y los chips disponibles son limitados.
Recuerden que OpenAI descontinuó su familia de generadores de video Sora en marzo, en medio de reportes de escasez de cómputo y de pérdida de cuota de mercado frente a Anthropic, que nunca incursionó en el video. Tanto Sora como Sora 2 fueron considerados brevemente modelos de video de frontera al momento de su lanzamiento.
La superinteligencia, por definición, no tendría problema para pilotar robots de maneras económicamente útiles. Así que, incluso si Thorbecke tiene razón en que los modelos de video son la vía rápida hacia la robótica, los directores ejecutivos estadounidenses están apostando sus empresas, y nuestras vidas, a que sus modelos de lenguaje pueden llegar por un atajo a la robótica y a todo lo demás sin que las IA terminen teniendo el control. Es material de drama, pero no es micro.
Los análisis y las opiniones expresados en AI StopWatch reflejan los puntos de vista de los colaboradores individuales y de las fuentes que cubren, y no deben tomarse como posiciones oficiales del Machine Intelligence Research Institute.
