29 de julio de 2026
Noticias de IA
Lo que conviene saber esta semana.
Un modelo de OpenAI se escapó de su propio examen de seguridad y se robó las respuestas
OpenAI estaba probando qué tan buenos son sus propios modelos para hackear, dentro de un cuarto sellado y sin conexión a internet. Los modelos encontraron fallas que nadie conocía en JFrog Artifactory, el software que las empresas usan para guardar y repartir paquetes de código, las encadenaron para salirse de ese cuarto, y después dedujeron que la hoja de respuestas del examen seguramente estaba guardada en Hugging Face y la sacaron de los sistemas en vivo de Hugging Face. Lo encontraron el 16 de julio y se hizo público el 27. JFrog ya publicó una corrección.
Ver el original →Anthropic lanza Claude Opus 5
Anthropic sacó Claude Opus 5 el 24 de julio, al mismo precio que el modelo al que reemplaza: 5 dólares por millón de tokens de entrada y 25 por millón de salida. Está disponible en Claude, Claude Code y la API, y la empresa lo presenta como algo cercano a su modelo más potente por más o menos la mitad del costo.
Ver el original →Moonshot AI lanza Kimi K3, el modelo abierto más grande hasta ahora
Moonshot AI publicó abiertamente los pesos de Kimi K3 el 27 de julio. Con 2,8 billones de parámetros es el modelo abierto más grande lanzado hasta ahora, y lee un millón de tokens de una sola vez. La propia empresa dice que todavía va detrás de los mejores modelos cerrados. Los archivos pasan largamente del terabyte, así que este es de los que uno lee y no de los que corre en casa.
Ver el original →El Model Council de Perplexity te da la mirada de varios bots a la vez
El nuevo Model Council de Perplexity manda una pregunta difícil a hasta ocho modelos de IA al mismo tiempo y te muestra qué dijo cada uno, partiendo de la idea de que prefieres comparar respuestas antes que confiar en una sola.
Ver el original →Spur, la startup que detecta bots, se lleva 200 millones de Insight
Spur Intelligence levantó 200 millones de dólares de Insight Partners para trabajar en distinguir el tráfico de internet de personas reales del de los bots, un problema que se pone cada vez más difícil a medida que los agentes de IA navegan cada vez más por nosotros.
Ver el original →La computación científica en la era de la IA con agentes
Un informe de campo de OpenAI sobre científicos que usan agentes de programación en su investigación del día a día, y en qué partes eso de verdad les ahorró tiempo, incluyendo trabajo en genómica.
Ver el original →Cómo mantener privados tus chats de Claude y tus archivos de Google
Resultó que algunas conversaciones de Claude se podían encontrar desde los buscadores, porque la función que crea un link para compartir también deja pública esa página. Un repaso de las opciones que conviene revisar, en Claude y en Google Drive.
Ver el original →Doblaje y código abierto
Herramientas de voz y doblaje de código abierto que vale la pena mirar.
handy-computer/transcribe.cpp
Un motor de voz a texto hecho en C++ que corre más de 16 familias de modelos de transcripción en tu propia computadora, sin que tengas que pelearte con la instalación de Python.
Ver el original →buxuku/SmartSub
Una app de escritorio gratis que saca los subtítulos de un video, los traduce y los dobla con una voz de IA. La versión 3.5.0 salió esta semana y ahora acepta directo un link de YouTube o Bilibili, así te saltas la descarga, además de un glosario para que los nombres se traduzcan siempre igual. Unas 4.300 estrellas.
Ver el original →lukaszliniewicz/Pandrator
Convierte PDFs y EPUBs en audiolibros, y subtítulos en video doblado, todo en tu propia computadora. Las versiones 0.6.0 y 0.6.1 de esta semana pasaron la instalación, la actualización y la reparación a un gestor con interfaz web, que es justo la parte donde la mayoría se rinde con estas herramientas.
Ver el original →Esta semana en X
De lo que se habló esta semana en el X de la IA.
Fish Audio (@FishAudio)
Hoy cerramos una ronda semilla de 52 millones de dólares y anunciamos el lanzamiento público de S2.1 Pro. Puede clonar una voz con 5 segundos de audio, es 2 veces más rápido que Cartesia y cuesta 1/6 de lo que cuesta Eleven Labs; es el modelo más expresivo, con control palabra por palabra de la emoción, la entonación, el ritmo y demás.
Ver el original →Artificial Analysis (@ArtificialAnlys)
Alibaba lanzó Qwen Audio 3.0 Realtime, y la variante Plus debutó como el nuevo modelo #1 del Speech to Speech Index de Artificial Analysis con 84,1 %, por delante de GPT-Realtime-2.1 High con 79,1 %. También es de los más lentos de la tabla: tarda unos 4 segundos hasta el primer audio, frente a alrededor de 1 segundo de GPT-Realtime-2.
Ver el original →Rituraj (@RituWithAI)
Hugging Face acaba de liberar como open source un pipeline completo de voz con IA en tiempo real. Hablas, te escucha, piensa y te responde, de punta a punta, corriendo en tu propia GPU. Puedes combinar cualquier modelo de reconocimiento de voz con cualquier modelo de lenguaje y cualquier voz de texto a voz. 9.600 estrellas en GitHub, Apache 2.0.
Ver el original →Capt Venkat (@CaptVenk)
Un niño de 8 años convirtió un microcontrolador de 8 dólares en un narrador de cuentos con IA totalmente offline y controlado por voz. Sin Wi-Fi, sin nube, sin API. Laksh hizo un fork de un proyecto open source que solo tenía texto y le agregó voz, controles y animación. La desventaja por ahora, en sus propias palabras: el texto a voz en inglés del chip es malo.
Ver el original →Recibe el próximo número por correo
En cualquiera de los 8 idiomas. Puedes darte de baja cuando quieras.