Noticias de IA clasificadas por sector e impacto, con fecha exacta y fuente.
Incluye noticias históricas reales de ese periodo (hitos de Wikipedia con su fuente original, blogs de OpenAI, Google DeepMind y Anthropic, Hacker News y arXiv), con su fecha original y clasificadas con IA. Solo se muestran las más relevantes.
Nivel 6/10: estimación de 6 para diciembre 2025, ajustada −0,1 por 10 noticias relevantes de ese mes (las 3 de mayor impacto promedian 5,8). 5,9 se redondea a 6.
Ese mes: 5 visibles y 5 de menor impacto.
El nivel mide la influencia de la IA en el sector (0 a 10), no el promedio de impacto de las noticias.
5 noticias de menor impacto también cuentan para este nivel.Verlas
Evaluación de la monitorabilidad de la cadena de pensamiento
OpenAI presenta un nuevo marco y conjunto de evaluaciones para la monitorabilidad de la cadena de pensamiento, que abarca 13 evaluaciones en 24 entornos. Nuestros hallazgos muestran que monitorear el razonamiento interno de un modelo es mucho más efectivo que monitorear solo…
Traducción automática · Título original: Evaluating chain-of-thought monitorability
Gemma Scope 2: ayudando a la comunidad de seguridad de IA a profundizar la comprensión del comportamiento complejo de los modelos de lenguaje
Las herramientas de interpretabilidad abiertas para modelos de lenguaje ahora están disponibles en toda la familia Gemma 3 con el lanzamiento de Gemma Scope 2.
Traducción automática · Título original: Gemma Scope 2: helping the AI safety community deepen understanding of complex language model behavior
GPT-5.2 es el modelo más potente de OpenAI hasta la fecha para matemáticas y ciencia, estableciendo nuevos resultados de vanguardia en benchmarks como GPQA Diamond y FrontierMath. Este artículo muestra cómo esas mejoras se traducen en progreso real en la investigación,…
Traducción automática · Título original: Advancing science and math with GPT-5.2