#LLM
Cobertura curada sobre «LLM»: lanzamientos, investigación, benchmarks, código abierto.

Investigación sobre ChatGPT: ¿afecta la forma gramatical femenina en el prompt a la calidad de resolución de tareas?
Un experimento del autor en LiveCodeBench mostró que en GPT-5.4 mini, la auto-presentación femenina en un prompt en ruso reduce ligeramente

Gramax mostró cómo comparar la calidad de respuestas RAG sin evaluación manual subjetiva
Gramax explicó por qué las métricas de retrieval son insuficientes para RAG y propuso evaluar no los chunks recuperados, sino la respuesta f

Asistentes de IA en 2026: Cómo un Desarrollador Solo Se Volvió Más Rápido que un Equipo de Tres Personas

ecom.tech comparó el ajuste fino evolutivo de Qwen3-4B con SFT y GRPO para pruebas en Kotlin

Yandex Code Assistant probado en manejo de secretos y comparado con Cursor

Cómo Sovcombank Redujo el Trabajo Rutinario del Equipo de Producto en un 50% Usando un Asistente de IA

Tribunal de EE.UU. decidió que la correspondencia del demandado con Claude de Anthropic no está protegida por el secreto profesional

AWS muestra cómo la decodificación especulativa en Trainium2 acelera la generación en vLLM

Críticos llaman a la asociación de OpenAI con McKinsey y Accenture una apuesta por el AI hype

MarkTechPost desglosó el ciclo completo de entrenamiento de grandes modelos de lenguaje: desde datos hasta despliegue
MarkTechPost publicó un desglose detallado de cómo se construyen los LLMs hoy: desde el preentrenamiento en grandes corpus hasta SFT, RLHF,

Google presentó Gemini 3.1 Flash TTS — modelo de habla con control, diálogos e idiomas 70+
Google lanzó Gemini 3.1 Flash TTS en vista previa: el modelo sintetiza texto en 70+ idiomas, soporta diálogos con dos voces y permite contro










