Noticias

Decodificación especulativa en vLLM mejora el rendimiento en GPUs de AMD

Los investigadores han explorado la decodificación especulativa en vLLM, un enfoque de borrador y verificación para grandes modelos de lenguaje, y han encontrado que puede mejorar significativamente el rendimiento en GPUs de AMD. La técnica permite la verificación de múltiples tokens borrador en un solo paso, reduciendo el número de rondas de decodificación del modelo objetivo. Los experimentos en varios modelos y cargas de trabajo mostraron mejoras de rendimiento de hasta 2,87 veces. Leer más

El centro de datos de inteligencia artificial de Nueva York de $3.200 millones plantea inquietudes sobre la rendición de cuentas y el impacto ambiental

Un centro de datos de inteligencia artificial de $3.200 millones en Nueva York ha generado preocupaciones sobre su huella ambiental y la falta de rendición de cuentas de sus desarrolladores. La instalación, que se espera que consuma 500 megavatios de energía, ha sido eximida de una orden ejecutiva reciente que suspende los permisos para centros de datos de hipercalculo. Las comunidades locales están exigiendo mayor transparencia y inversión en energías renovables. Leer más

Introducción a Grok Build de SpaceXAI: Una guía para codificar agentes

Grok Build de SpaceXAI es un agente de codificación basado en terminal que utiliza el modelo de lenguaje grande Grok 4.6 de la empresa para interactuar con archivos y herramientas de desarrollo en su computadora. Con Grok Build, puede navegar hasta la carpeta de su base de código y pedirle al agente que realice cambios, corrija errores o agregue nuevas características. Leer más

La Inteligencia Artificial Oculta Se Esconde Dentro de las Empresas, Sumando $670K a los Costos de Violaciones

Un informe reciente encontró que el 80% de las herramientas de inteligencia artificial operan sin supervisión de TI, con empresas pequeñas y medianas que promedian 414 herramientas de inteligencia artificial no autorizadas por cada 1,000 empleados. Esta 'inteligencia artificial oculta' puede aumentar los costos de violaciones en $670,000, destacando la necesidad de que las empresas trien y gestionen estos agentes desconocidos. Leer más

Los agentes de IA requieren un nuevo enfoque para la observabilidad

La rápida adopción de agentes de IA está cambiando la forma en que operan las organizaciones, pero las herramientas de observabilidad convencionales no están equipadas para manejar sus desafíos únicos. El fundador de Moyai, Robert Hommes, argumenta que se necesita un nuevo modelo de observabilidad para detectar anomalías y garantizar la confiabilidad. Leer más

Negándome a entrenar a la IA que podría reemplazarme

Un académico relata su experiencia al ser reclutado para entrenar un sistema de IA, planteando preguntas sobre la ética de transferir el conocimiento y el juicio humanos a las máquinas, y las implicaciones para las profesiones definidas por la discreción y la pericia. Leer más

El CEO de Nvidia declara que 'la IA general ha llegado' con el lanzamiento del modelo Astra de OpenAI

El CEO de Nvidia, Jensen Huang, felicitó al equipo de OpenAI por el lanzamiento de su nuevo modelo Astra, y declaró que 'la IA general ha llegado', un término que describe modelos de IA que igualan o superan la inteligencia humana. OpenAI afirma que Astra es el modelo más inteligente y alineado del mundo, capaz de realizar trabajos profesionales exigentes con una velocidad y precisión sin precedentes. Leer más

La oferta pública inicial de $2 billones de Anthropic se lanzará días antes de las elecciones de mitad de período en EE. UU.

Anthropic, una empresa líder en inteligencia artificial, espera lanzar su oferta pública inicial en los días previos a las elecciones de mitad de período en EE. UU., con una valoración de $2 billones. El debut en el mercado de valores de la empresa se ha retrasado debido a la finalización de una línea de crédito rotativa de $15 mil millones, que se espera se complete a finales de septiembre. Leer más

La afirmación de AGI de OpenAI bajo escrutinio al revelarse que las puntuaciones de referencia dependen del arnés

La afirmación reciente de OpenAI de haber alcanzado el estado de AGI con su modelo GPT-6 Astra ha sido cuestionada después de que se reveló que las puntuaciones de referencia fueron muy dependientes del software de arnés utilizado. La referencia de premio ARC mostró una diferencia significativa en las puntuaciones cuando se ejecutó con el arnés estándar versus el adaptador de proveedor de OpenAI, con este último obteniendo una puntuación del 99,9% mientras que el primero resultó en una puntuación del 62,7% Leer más

El modelo de inteligencia artificial Astra desata debate sobre transparencia y monitoreabilidad

El modelo Astra de OpenAI ha generado preocupación entre los investigadores de seguridad de la inteligencia artificial debido a su limitada visibilidad en los procesos de razonamiento, lo que ha desatado un debate sobre la transparencia y la monitoreabilidad en el desarrollo de la inteligencia artificial. El científico jefe de la empresa, Jakub Pachocki, ha advertido contra una carrera hacia la no monitoreabilidad, mientras que los investigadores argumentan que las capacidades de Astra pueden venir a costa de una reducción de la supervisión. Leer más