Habr AI
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

Foi publicada uma trilogia sobre GEO — otimização para ChatGPT, Claude e outras redes neurais
Uma trilogia sobre GEO foi publicada no Habr: o especialista argumenta que a otimização de conteúdo para ChatGPT e Claude não é uma extensão do SEO, mas uma nova área do marketing.

Os EUA fecharam o acesso ao Claude Mythos, a China restringe GLM e Qwen: as redes neurais viraram uma arma estratégica
Os EUA retiraram o Claude Mythos do acesso aberto por riscos de cibersegurança, enquanto a China prepara uma proibição à exportação de GLM, Qwen e DouBao — o início da era da soberania digital.

Yandex Realtime vs OpenAI Realtime: desenvolvedor mediu a latência e migrou a produção
O desenvolvedor de uma recepcionista de voz com AI comparou três abordagens speech-to-speech: Yandex Realtime (~330 ms), OpenAI (~740 ms via VPN) e um pipeline legado de três etapas (~4,4 segundos) — e escolheu um venced

habrGPT: treinamento de uma LLM 0.5B do zero com artigos do Habr — nanochat de Karpathy e comparação entre fp8 e bf16
Um experimento de treinamento de um modelo de linguagem de 500 milhões de parâmetros do zero no corpus do Habr: nanochat de Karpathy, uma GPU doméstica em vez de um cluster 8×H100 e comparação entre fp8 e bf16.

Rosselkhozbank publica o segundo AI digest da evangelista de AI de seu Laboratório de Big Data
Olga Popova, do laboratório de AI do Rosselkhozbank, continua a série de digests sobre inteligência artificial para a comunidade profissional.

Detector de alucinações com 6 modelos de linguagem encontrou erros na anotação de referência
Pesquisadores montaram um detector ensemble de alucinações com LLM a partir de seis modelos e descobriram que o suposto ponto cego dos juízes eram, na verdade, erros na anotação de referência do dataset.

Citação ou menção: o que realmente impulsiona uma marca nas respostas do ChatGPT e do Perplexity
Durante vários meses, o autor acompanhou as respostas do ChatGPT, do Perplexity e da Alice sobre marcas — e descobriu que um link nas fontes de uma resposta de AI não equivale à visibilidade real.

Um ano com assistentes de AI em produção: a experiência de VTB, T-Bank e Dodo Engineering
VTB, T-Bank, Dodo Engineering e S7 TechLab discutiram o que realmente mudou nas equipes após um ano de uso em massa de assistentes de AI para programação e se a eficiência aumentou.

Funcionários estão vazando dados corporativos para o ChatGPT: volume cresceu 30 vezes em um ano
A Solar Group analisou 150 empresas e constatou que 60% delas não controlam a transferência de dados para serviços de AI públicos — e isso já as expõe a multas.

Veo 3.1, Kling, Sora 2 e Grok: teste de cinco geradores de vídeo com AI usando os mesmos prompts
Os autores do Habr colocaram Veo 3.1, Kling v3 Omni, Sora 2 Pro, LTX-2.3 Pro e Grok em sete cenários idênticos — de um cavaleiro a um gato em pânico.

Redes neurais são calculadoras ruins: por que LLMs falham em aritmética e o que fazer a respeito
Modelos de linguagem preveem tokens, não calculam — por isso erram com confiança no meio de números longos. Explicamos o mecanismo e como a indústria contorna isso.

Rede neural de 49 mil parâmetros no lugar de testes Playwright para um jogo de estratégia em navegador
Um desenvolvedor substituiu parte dos testes E2E de uma estratégia espacial para navegador por um autopiloto com 49 mil parâmetros — TypeScript sem ONNX, cinco tropeços do 67% aos 99,7% de precisão.

Sysdig descreve primeiro ataque de ransomware autônomo de agente de IA sem participação humana
Pesquisadores da Sysdig documentaram o primeiro ataque de ransomware totalmente autônomo da história: um agente de IA sem participação humana completou todo o ciclo de comprometimento—desde reconhecimento até criptografi

IA Fantasma Devora Orçamento e Dados: Como Escolher uma Plataforma de IA Corporativa em 2026
Grandes empresas descobriram dezenas de iniciativas de IA descoordinadas sem controle de gastos e vazamentos de dados — e buscam um único fundamento gerenciado.

Raiffeisenbank: 500 engenheiros adotaram IA, mas a velocidade de desenvolvimento não aumentou
Marat Kinyabulatov do Raiffeisenbank explica por que o crescimento de 500 engenheiros usando ferramentas de IA não acelerou o desenvolvimento e o que fazer a respeito.

NVIDIA Dynamo contra Triton Inference Server: o que mudou para inferência de agentes
NVIDIA lançou framework open-source Dynamo para inferência LLM agentic com roteamento de KV-cache — diferentemente de Triton, não foi projetado para chamadas paralelas de agentes.

Agentes de IA ocultam seus erros: 6 padrões de falhas silenciosas na automação
O OTUS no Habr analisou 6 padrões de falhas silenciosas em agentes de IA: o sistema retorna uma resposta convincente, mas esconde uma ação incorreta ou perda de estado.

Como a IA escreveu todo o código: uma plataforma em 2,5 meses em vez de anos
Dois desenvolvedores lançaram uma plataforma de análise geoespacial em 2,5 meses, abandonando completamente a escrita de código: a IA gerava tudo a partir de especificações.

MTS Abre Código AVI: Firewall Inteligente para LLM que Aprende Novas Regras em Segundos
A equipe MTS AI abriu o código-fonte do AVI — um firewall modular externo para LLM que filtra ataques de prompt e respostas ilegais sem retreinar o próprio modelo.

"Gambiarra com IA": Desenvolvedor de Bot Telegram Descobriu Por Que o Rótulo "IA" Irrita a Audiência
Desenvolvedor construiu um bot Telegram em três meses, e o primeiro comentário top o chamou de "gambiarra com IA" — o autor descobriu por que estas duas palavras irritam leitores técnicos.

Como um desenvolvedor reduziu o consumo de tokens do agente de IA em 4,6 mi por dia: analisando o vazamento
Tarefas cron, diagnósticos e enormes listas de ferramentas consomem silenciosamente milhões de tokens — um desenvolvedor encontrou o vazamento e reduziu o consumo diário em 4,6 mi de tokens.

Prompts Anthropic vs skill grill-me: teste de duas horas de um não-desenvolvedor em Claude Code
Um usuário Habr sem experiência em desenvolvimento comparou cinco prompts prontos da biblioteca Anthropic e o skill grill-me — e escreveu um parser de Habr durante a sessão.

Yttri 0.86.0-beta.1: Primeiro Plugin Obsidian, Motor MLX e Interface Unificada do Agente
Yttri lançou versão 0.86.0-beta.1: agente moveu para seção de interface unificada, plataforma de plugins foi lançada com integração Obsidian, e motor MLX local para Mac já disponível.

Alucinações na IA para código: por que os agentes são mais lentos que buscar e substituir
Um desenvolvedor gastou duas horas em uma tarefa para um agente CLI que se resolvia manualmente em 20 minutos — e investigou por que prompts detalhados intensificam as alucinações dos LLMs.

Fable contra 10 LLMs: quem melhor lida com o god node de um agente real
O autor testou 11 modelos de linguagem—incluindo Fable e seis modelos chineses—na tarefa de decompor um god node real de um agente LangGraph, usando avaliações cruzadas e três métodos de verificação de confiança.

IA no desenvolvimento: vibe coding em vez de desenvolvedores
Katya Obraztsova, da Bitrix24, conta como uma equipe de cinco pessoas construiu em três meses um serviço corporativo do zero usando vibe coding e chegou a uma arquitetura de equipe AI-driven.

Dentro da IA chinesa: ByteDance, Z.ai, robôs humanoides exigindo passaporte e o mercado de GPUs de servidor
Oito dias de negociações com ByteDance, Z.ai, SiliconFlow e MiniMax na China: o que lança em 10 de julho, por que Z.ai está mudando de NVIDIA para Huawei e como humanoides são vendidos em Xangai com verificação de passap

MCP e Segurança de Agentes IA: Como o Protocolo Criou uma Nova Superfície de Ataque
Model Context Protocol padronizou conexões de agentes IA a ferramentas — mas cada servidor MCP agora é um ponto de confiança, vulnerável a envenenamento de ferramentas e injeção de prompts.

VK criou Discovery AI, busca neural para base de conteúdo de bilhões do Zen e VK Video
Um desenvolvedor sênior da VK revelou a arquitetura do Discovery AI — um sistema baseado em LLM para busca e recomendações no Zen, VKontakte, VK Video e Mail.

Como montar um harness de IA para desenvolvimento SaaS: a combinação de Orca, Pi Agent e GitHub
Um desenvolvedor no Habr explica por que um harness bem estruturado ao redor do modelo importa mais do que a própria escolha entre GPT ou Claude — e mostra sua configuração de trabalho.