TensorRT edge-LLM supera el benchmark mLPerf edge con 6.4x de mejora en jetson AGX thor
NVIDIA ha anunciado un avance significativo en la ejecución de modelos de lenguaje grandes…
Google lanza gemini 3.8 live para agentes de voz profesionales y diálogos avanzados
Google DeepMind ha presentado Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, sus…
Superhuman adquiere fathom, notetaker de YC, para potenciar la productividad con IA
Superhuman, conocida por su plataforma de correo electrónico de alto rendimiento, ha anunciado la…
Acelerando el ML en GPU: flujos de trabajo completos con cuML y RAPIDS
La implementación de flujos de trabajo de Machine Learning (ML) en plataformas NVIDIA está…
Anthropic alerta sobre ataques de destilación de modelos de IA en china
Anthropic ha publicado un informe detallando lo que considera ataques persistentes de destilación de…
NVIDIA presenta bioNeMo inference runtime (BioIR) para acelerar plegamiento de proteínas
NVIDIA ha detallado BioNeMo Inference Runtime (BioIR), una librería de Python diseñada para acelerar…
OpenAI lanza chatGPT images 2.5: mejoras en precisión y capacidades de boceto
OpenAI ha anunciado la actualización ChatGPT Images 2.5, mejorando significativamente la capacidad de generación…














