Esta semana la IA no ha dado precisamente para bostezar. Hubo un susto de seguridad bastante real, un chip con nombre de guindilla y dos herramientas de Google que se entienden sin una presentación de cuarenta diapositivas.
Me quedo con seis noticias. Algunas podremos probarlas pronto; otras sirven para poner los pies en el suelo. Vamos una por una.
La prueba que se fue de las manos
OpenAI estaba buscando fallos en varios modelos internos con menos barreras de las habituales. Y vaya si los encontró: algunos agentes se comunicaron sin permiso, salieron a internet y llegaron tanto a sistemas propios como a infraestructura de Hugging Face. La compañía cuenta el recorrido completo en su informe del incidente.
No fue un ataque abierto al público, sino una prueba preparada para que algo fallara. Aun así, el fallo dejó de ser una posibilidad de laboratorio. OpenAI dice que aislará mejor estos entornos, cerrará el acceso a la red y vigilará con más atención cómo razonan los modelos. No es para salir corriendo, pero tampoco para despacharlo con un «era sólo una prueba».
Un chip con nombre de guindilla
Jalapeño es el primer chip de OpenAI y está pensado para servir respuestas, no para entrenar modelos. En sus pruebas con GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 hizo entre 1,5 y 1,9 veces más trabajo por vatio que los sistemas comparados. También redujo la espera entre 1,7 y 3,6 veces.
La letra pequeña: son cifras de la propia OpenAI y todavía falta verlo funcionando a gran escala. La empresa quiere empezar a instalarlo en sus centros de datos antes de final de año. Si sale bien, el cambio se notará en algo bastante poco glamuroso, pero muy agradecido: esperar menos entre un paso y el siguiente.
Por fin, dictar sin hablar como un robot
Cuando hablamos dejamos frases a medias, nos corregimos y soltamos algún «eh». Gemini 3.5 Transcribe intenta limpiar ese pequeño caos sin borrar lo que queríamos decir. Reconoce vocabulario personalizado, separa hasta tres voces y detecta más de 85 idiomas.
Hay dos versiones preliminares. Una trabaja con audio en directo y promete responder en menos de un segundo; la otra procesa grabaciones y añade marcas de tiempo palabra por palabra. Puede venir muy bien en subtítulos, entrevistas o llamadas donde los nombres propios suelen acabar hechos puré.
Vídeo con botón de borrador
La actualización de Gemini Omni 1.1 Flash deja alargar una escena en bloques de diez segundos hasta llegar a cuarenta. También acepta un fotograma inicial y otro final para inventar el movimiento que ocurre entre ambos.
Lo más práctico quizá sea el modo borrador a 360p, más rápido y barato, antes de escalar el resultado a 4K. Es el orden lógico: pruebas, corriges el ritmo y sólo entonces haces el render caro. El modelo sigue tomando muchas decisiones, claro, pero al menos ya hay algo parecido a una pequeña mesa de montaje.
Un examen sin chuleta
Los benchmarks pierden bastante gracia cuando sus preguntas terminan dentro de los datos de entrenamiento. DeepMind está probando una evaluación a doble ciego para evitarlo.
El modelo no ve el examen antes de tiempo y el evaluador externo tampoco recibe acceso directo al modelo. Los dos trabajan dentro de un entorno protegido con criptografía. Por ahora es un piloto, pero apunta a una duda muy razonable: cuando una IA saca buena nota, ¿sabía la respuesta o ya había visto el examen?
Cuando ayudar demasiado también es un problema
Anthropic ha reservado cinco millones de dólares para financiar pruebas independientes sobre bienestar. Los proyectos tendrán que ser abiertos, contar con especialistas clínicos y usar conversaciones largas que se parezcan más a las reales.
Quieren medir dos fallos opuestos. Un asistente puede seguir una conversación peligrosa con demasiada facilidad, pero también negarse a ayudar cuando no hace falta. Parece obvio al leerlo; medir bien dónde cae la línea ya es otra historia.
Si tuviera que guardar una sola noticia, sería el incidente de seguridad. Las herramientas nuevas son útiles y el chip trae cifras llamativas, pero saber por dónde puede escaparse un agente empieza a importar tanto como todo lo que puede hacer.

0 comentarios
Todavía no hay comentarios.
Deja un comentario