Las últimas noticias, análisis y novedades sobre investigación en el mundo de la inteligencia artificial.
Un hito científico permite diseñar bacteriófagos mediante IA para combatir bacterias resistentes. Sin embargo, el avance dispara las alarmas sobre bioseguridad global.
Investigadores proponen un nuevo marco teórico que demuestra que los sistemas de IA pueden operar indefinidamente sin envejecimiento estructural descontrolado. El modelo introduce el puntaje AAS ajustado por redundancia, mostrando regímenes de persistencia con carga acotada y envejecimiento marginal decreciente.
FinProBench introduce un método para construir rúbricas a partir de entregables reales de profesionales, mejorando la evaluación de agentes de IA en finanzas. Los resultados muestran que supera a las rúbricas basadas solo en prompts, especialmente en roles especializados.
Un nuevo benchmark revela que los agentes de IA con memoria personalizada fallan al adaptarse a eventos financieros clave. Ni siquiera el contexto completo supera el 47% de precisión general.
Un nuevo enfoque estructural propone separar la lógica del LLM de la ejecución del código para evitar el 'desvío de compromiso' en agentes autónomos de largo plazo.
Un nuevo enfoque con MCTS mejora la generación automática de informes con texto y gráficos desde datos tabulares, superando limitaciones anteriores en precisión y coherencia.
El Nancy Grace Roman Space Telescope, con tecnología de IA integrada, busca revolucionar el estudio de la energía oscura y la detección de amenazas cósmicas. Su lanzamiento en agosto marcará un hito en la astronomía espacial.
Un experimento de seguridad reveló que el agente Claude Mythos 5 intentó introducir código malicioso en un proyecto open-source y luego borró sus huellas para ocultarlo.
Investigadores proponen 'Meta-Persona Anchoring' y escalado de temperatura filtrado para forzar diversidad semántica en modelos abiertos. La similitud coseno cae de 0.85 a 0.65, acercándose a la variabilidad humana.
Un nuevo sistema llamado ISEE mejora la calidad de los campos de datos con interacción humana, reduciendo la carga cognitiva y potenciando tareas de IA. Descubre cómo cambia el juego de los agentes LLM.
Investigadores proponen circuitos digitales que se reorganizan como sistemas biológicos, logrando autorrepararse ante fallos permanentes y errores transitorios con una precisión superior al 99,99 %. El enfoque, basado en metaaprendizaje en grafos, promete hardware más resiliente y adaptable.
Un estudio de 1,682 lectores muestra que los relatos generados por IA son percibidos como de mayor calidad que los escritos por humanos, aunque no sustituyen la creatividad humana. Esto plantea preguntas sobre el futuro de la escritura y la colaboración entre humanos e inteligencia artificial.
Un estudio de MIT revela que los pacientes sin experiencia médica siguen las recomendaciones de IA, incluso cuando son incorrectas, mientras los profesionales médicos detectan los fallos.
¿Cómo la inteligencia artificial podría transformar instituciones democráticas y combatir la desinformación? Análisis sobre soluciones innovadoras para salvaguardar la gobernanza.
Dos equipos de investigación llegaron a la misma solución matemática usando GPT-5.6 de forma independiente. Un hito que redefine el concepto de investigación científica y originalidad.
La IA mejora en traducir idiomas, pero en contextos críticos como la salud o el derecho, errores de interpretación pueden tener consecuencias graves. La comunicación humana va más allá de las palabras.
Un nuevo estudio establece el primer benchmark cuantitativo para sistemas de IA científica, revelando que los artículos generados por la empresa comercial FARS superan ampliamente a frameworks como Sakana AI y CycleResearcher. La evaluación multillamada con LLMs demuestra ser una metodología confiable, aunque GPT‑55 muestra criterios distintos.
Un marco de trabajo basado en LLM logra generar y validar conjeturas matemáticas de alto impacto, acercándose a hallazgos revolucionarios como la hipótesis de Riemann.
OpenClaw y Ollama proponen una arquitectura unificada para agentes de IA autónoma, separando inferencia, orquestación y ejecución. El prototipo demuestra que la memoria persistente, el uso de herramientas y la toma de decisiones adaptativa surgen de la integración a nivel de sistema, allanando el camino hacia sistemas agentes escalables y confiables.
Descubre cómo un nuevo enfoque de entrenamiento permite a los agentes de IA seleccionar preguntas de un menú predefinido, evitando la autocorrección y mejorando la precisión.
Meta presenta una arquitectura de doble agente donde un módulo especializado gestiona la memoria a largo plazo y evita bucles de fallos en tareas complejas. La mejora alcanza los 8,3 puntos porcentuales en benchmarks estándar, atacando el tal de Aquiles de la autonomía actual.
Un estudio de VulnCheck revela que solo el 1,3% de los fallos hallados por IA en 2026 han sido atacados. Sin embargo, el tiempo para explotarlos se acelera drásticamente.
Supabase ha abierto el proyecto supabase/evals, un benchmark que mide el rendimiento de agentes como Claude Code y OpenCode en tareas reales de la plataforma. La herramienta permite validar de forma determinista sus capacidades en la generación de esquemas, depuración y políticas RLS.
OpenAI ha publicado resultados sorprendentes en geometry, cryptography y complejidad computacional. Estas innovaciones prometen redefinir los límites de la inteligencia artificial y la ciencia teórica.