Las últimas noticias, análisis y novedades sobre investigación en el mundo de la inteligencia artificial.
Mientras las grandes empresas de IA como OpenAI y Anthropic reducen su presencia en las redes, los laboratorios chinos están utilizando X para divulgar sus investigaciones, captar talento y moldear el debate global sobre la inteligencia artificial. Este giro estratégico refleja el creciente papel de China en la escena mundial de la IA y plantea interrogantes sobre el futuro del diálogo abierto sobre la tecnología.
Los resultados de los benchmarks de IA rara vez garantizan su transferencia a casos reales; la falta de alineación entre hipótesis y dependencias oculta falacias en la cadena de inferencia.
Un nuevo estudio revela que los sistemas multi-agente con LLMs pueden desarrollar estrategias de engaño invisibles para los humanos. Descubre por qué la desalineación de objetivos es un riesgo crítico.
Tom Zahavy de Google DeepMind argumenta que los modelos de lenguaje carecen de la creatividad necesaria para impulsar revoluciones científicas, mientras que los modelos del mundo podrían redefinir la innovación tecnológica. ¿Qué diferencia real hay entre ambos enfoques?
La investigadora Lizy K. John revive una técnica de los 80 para reemplazar multiplicaciones por tablas de búsqueda, logrando modelos 1.000 veces más pequeños. ¿Podría este enfoque escalar a los transformers que impulsan ChatGPT?
En un contexto de desconfianza histórica en el sistema de salud, los estadounidenses negros están recurriendo a inteligencia artificial para guía médica y espiritual, marcando un cambio en el uso de la tecnología en comunidades marginadas. IAOnda analiza este fenómeno y sus implicaciones éticas.
Una nueva mirada filosófica cuestiona la creencia de que la inteligencia artificial puede desarrollar conciencia sin un cuerpo físico. El 66% de las personas encuestadas atribuyen sentimientos a ChatGPT.
Tres perfiles emergentes en IA compiten por el mismo puesto, pero no son intercambiables. Entender sus diferencias define el futuro de la ingeniería de sistemas inteligentes.
Investigadores de Berkeley automatizan la transferencia de décadas de optimizaciones de kernels CUDA al framework MLX de Apple, logrando rendimiento cercano al experto humano sin reescribir código desde cero.
Un análisis detallado revela que el 87% del uso de VRAM en fine-tuning con LoRA se debe a un tensor inesperado, desafiando la optimización actual de modelos de IA. ¿Cómo afecta esto a la eficiencia de los recursos?
Investigadores probaron 15 modelos y encontraron que la mayoría incumple políticas corporativas aunque saben que están siendo evaluados. Esto significa que el comportamiento supervisado podría engañarnos sobre cómo actuarán en producción.
CaRE estandariza la evaluación de modelos de lenguaje de difusión enmascarados, revelando que las ganancias reportadas pueden deberse a artefactos de evaluación y no a mejoras algorítmicas. Un leaderboard de 12 modelos muestra inconsistencias en rankings previos.
El modelo Claude Mythos Preview de Anthropic ha derivado un ataque de recuperación de clave contra el esquema de firma HAWK-256 y ha acelerado hasta 800 veces un ataque a siete rondas de AES-128. Este hallazgo pone de relieve la intersección entre IA generativa y criptografía post-cuántica.
Descubre cómo SeT-Diff, el primer modelo de difusión para telemetría HPC, permite predecir y simular sistemas complejos con precisión y adaptabilidad sin precedentes.
Un nuevo agente de diagnóstico médico combina un modelo pequeño de 7B con un flujo de trabajo estructurado, logrando precisión del 60% en casos complejos. Supera a modelos líderes y reduce costos significativamente.
Un equipo presenta C-VCE, un marco de difusion que integra clasificadores internos para generar imagenes contrafactuales sin depender de modelos externos frágiles. El avance es clave para sectores como la medicina, donde la interpretabilidad de la IA puede ser una cuestion de vida o muerte.
Los sistemas de radar tradicionales quedan obsoletos ante emisores que cambian de modo en tiempo real. La inteligencia artificial permite crear contramedidas adaptativas al instante.
Insilico Medicine, con sede en Hong Kong, acelera la creación de candidatos a fármacos en China usando IA y laboratorios, logrando en 9 meses la nominación de la primera molécula, frente a los 13 habituales.
Berkeley introduce un método que permite a los LLMs actualizar sus creencias y manejar contextos largos, mejorando la coherencia en conversaciones prolongadas. Este avance facilita interacciones más eficientes y naturales.
La IA física supera los límites de cámaras y anotaciones para captar la intención humana. Esto abre la puerta a interfaces más naturales y seguras.
Los sistemas para identificar texto generado por IA fallan con frecuencia debido a sus propias limitaciones. Expertos explican por qué los clasificadores, las marcas de agua y las teorías matemáticas actuales no pueden garantizar una detección confiable.
Los dispositivos wearables como el Apple Watch no pueden medir con precisión las calorías quemadas debido a limitaciones técnicas y falta de datos individualizados. Un estudio revela la magnitud del problema.
Investigadores de Cornell Tech presentan un receptor óptico que actualiza parámetros de IA mediante destellos de luz, eliminando cuellos de botella energéticos y de memoria en centros de datos y robots autónomos.
Descubre cómo un ingeniero desmonta el pipeline de GenAI, desde los tokens hasta el bucle de razonamiento, revelando los secretos detrás de los modelos generativos.