Ribbon

41 materiales

Clasificación
Noticias12 septiembre 2026

Los índices estadounidenses subieron gracias al rebote de los chips antes del informe de Nvidia

El martes, el S&P 500 subió alrededor de un 0,2%, el Nasdaq un 0,5% y el Dow un 0,1%: las acciones de los fabricantes de chips, que habían bajado el día anterior, lideraron las ganancias. Nvidia subió un 2,3% antes de su informe trimestral, y los débiles datos sobre la confianza del consumidor y las ventas de viviendas no impidieron el sentimiento positivo del mercado.

Los índices estadounidenses subieron gracias al rebote de los chips antes del informe de Nvidia
Leer
Noticias11 septiembre 2026

SQL agéntico sin ilusiones: una escala unificada de autonomía y una comparación honesta de los benchmarks de LLM

Los investigadores proponen considerar el área de Text-to-SQL como un leaderboard consolidado, donde los resultados se distribuyen según el grado de autonomía del modelo al generar consultas SQL. Realizan mediciones en Spider y demuestran que los éxitos no siempre se trasladan a otros benchmarks, y que la autonomía aporta robustez, pero requiere recursos computacionales considerables.

SQL agéntico sin ilusiones: una escala unificada de autonomía y una comparación honesta de los benchmarks de LLM
Leer
Noticias10 septiembre 2026

Nuevo benchmark GIM: evaluación de LLM en la intersección de distintas habilidades cognitivas

Los investigadores propusieron un enfoque que evalúa los modelos no por la cantidad de conocimiento ni de forma aislada de la realidad, sino a través de tareas que requieren simultáneamente razonamiento, control del contexto y trabajo con restricciones. El benchmark incluyó 820 tareas originales, y sus autores también estudiaron cómo afectan al resultado los ajustes de «reflexión» y otros parámetros de los modelos.

Nuevo benchmark GIM: evaluación de LLM en la intersección de distintas habilidades cognitivas
Leer
Noticias9 septiembre 2026

Los filtros de seguridad de los LLM fallan fuera del inglés: cómo los modelos refuerzan estereotipos en otros idiomas

Los investigadores han identificado un grave sesgo interlingüístico en la seguridad de los grandes modelos de lenguaje: su alineación está configurada principalmente para el inglés, por lo que en otros idiomas los modelos eluden más fácilmente las restricciones y reproducen prejuicios dañinos. El nuevo benchmark INCLUDE, probado en diez modelos y seis idiomas indios, mostró que el nivel de sesgo varía notablemente según el idioma y el tipo de modelo.

Los filtros de seguridad de los LLM fallan fuera del inglés: cómo los modelos refuerzan estereotipos en otros idiomas
Leer
Noticias9 septiembre 2026

Hélices de drones bajo control: la «edad artificial» metamórfica ayuda a leer los registros de vuelo

Los autores propusieron un prototipo de sistema de apoyo a la toma de decisiones que analiza seis indicadores de los registros de vuelo y los convierte en un índice metamórfico del estado de las hélices. En un experimento retrospectivo con datos de DronePropA, el sistema separó correctamente un caso saludable de tres niveles de falla y sugirió cuándo se requiere inspección o mantenimiento.

Hélices de drones bajo control: la «edad artificial» metamórfica ayuda a leer los registros de vuelo
Leer