#LLM
Cobertura curada sobre «LLM»: lançamentos, pesquisa, benchmarks, código aberto.

Pesquisa sobre ChatGPT: a forma gramatical feminina no prompt afeta a qualidade da solução de tarefas
Um experimento do autor no LiveCodeBench mostrou que no GPT-5.4 mini, a auto-apresentação feminina em um prompt em russo reduz ligeiramente

Gramax mostrou como comparar a qualidade das respostas RAG sem avaliação manual subjetiva
Gramax explicou por que métricas de retrieval são insuficientes para RAG e propôs avaliar não os chunks recuperados, mas a resposta final do

Assistentes de IA em 2026: Como um Desenvolvedor Solo Ficou Mais Rápido que um Time de Três Pessoas

ecom.tech comparou o ajuste fino evolutivo do Qwen3-4B com SFT e GRPO para testes em Kotlin

Yandex Code Assistant testado em gerenciamento de segredos e comparado com Cursor

Como o Sovcombank Reduziu Tarefas Rotineiras da Equipe de Produto em 50% Usando um Assistente de IA

MarkTechPost desmembrou o ciclo completo de treinamento de grandes modelos de linguagem: dos dados ao deployment
MarkTechPost lançou uma análise detalhada de como os LLMs são construídos hoje: desde o pré-treinamento em grandes corpora até SFT, RLHF, ot

Google apresentou Gemini 3.1 Flash TTS — modelo de fala com controle, diálogos e 70+ idiomas
Google lançou Gemini 3.1 Flash TTS em pré-visualização: o modelo sintetiza texto em 70+ idiomas, suporta diálogos com duas vozes e permite c













