Para quem programa
Guias, kits e infraestrutura para desenvolvedores e equipes técnicas. Se você só usa IA, pode pular esta seção.
Sexta-feira, 25 de setembro
- Para quem programa
AWS e Qumulo detalham treino de IA com dados em outra região sem copiar arquivos
Post mostra um teste com SageMaker HyperPod e Qumulo em que um cluster remoto igualou o desempenho do cluster local após aquecimento do cache.

- Para quem programa
Cloudflare detalha Turnstile Spin, que guia agentes de IA na configuração do Turnstile
A proposta é ajudar a instalar ou corrigir o Turnstile com um agente de IA, incluindo a validação no servidor, sem enviar o código da aplicação para a Cloudflare.

Quinta-feira, 24 de setembro
- Para quem programa
AWS detalha implantação do WhisperX no SageMaker AI para transcrição com falantes identificados
Guia da AWS mostra como usar o WhisperX em um Deep Learning Container no SageMaker AI para transcrever áudio com timestamps por palavra e rótulos de falantes.

- Para quem programa
AWS detalha arquitetura multi-conta para agente de IA com AgentCore Gateway e MCP
A publicação mostra como manter dados em contas AWS separadas e ligar tudo por um Gateway central com autenticação, autorização e ferramentas MCP.

- Para quem programa
Aderant automatiza triagem de tickets com Amazon Nova Lite no Bedrock
O sistema analisa tickets em horários definidos, reúne contexto em ferramentas internas e sugere roteamento; nos primeiros 2,5 semanas, revisou 109 chamados com cerca de…

- Para quem programa
NVIDIA detalha tutorial para treinar modelos biológicos MoE com TE e MXFP8
Material da BioNeMo explica como a Transformer Engine reduz gargalos em modelos de especialistas mistos e cita benchmark de até 2,21x em oito GPUs B200.

Quarta-feira, 23 de setembro
- Para quem programa
NVIDIA detalha NVCRE, controlador open source que valida clusters de GPU com testes reais
O Cluster Readiness Engine executa cargas distribuídas no Kubernetes para apontar nós problemáticos antes da produção e organiza o resultado por categoria, teste e nó…

- Para quem programa
NVIDIA detalha como levar simulação do MuJoCo para até 2.048 mundos em GPU com MJWarp
Guia da NVIDIA mostra a migração de uma simulação do braço SO-101 do CPU para GPU, com validação, ajuste de buffers e replicação do estado inicial.

- Para quem programa
HEMA detalha HAL, assistente interno que reúne conhecimento técnico em uma só interface
Construído sobre Amazon Bedrock AgentCore e MCP, o HAL leva respostas internas da HEMA para chat e IDE, com login via Microsoft Entra ID e acesso só de leitura.

- Para quem programa
NVIDIA detalha NodeWright, projeto para atualizar nós Kubernetes sem parar cargas de trabalho
O software de código aberto é apresentado como um gerenciador de host para clusters, com validação integrada, avanço gradual das mudanças e uso em nós com GPU.

- Para quem programa
AWS detalha guia para agente de IA que responde perguntas sobre vídeos
O material mostra uma arquitetura com Strands Agents SDK para consultar vídeos em linguagem natural, combinando Transcribe, Rekognition e Bedrock conforme a pergunta.

- Para quem programa
AWS detalha uso do OpenCode com modelos de peso aberto no Amazon Bedrock
Guia da AWS mostra como combinar o agente de codificação OpenCode com o Bedrock para alternar modelos, manter dados na conta do cliente e pagar conforme o uso.

- Para quem programa
SWE-Serve mostra que patches de agentes de IA podem passar em testes e falhar no servidor real
Criado com ajuda da equipe do SGLang, o benchmark compara a aprovação em verificações comuns e em testes com servidor ativo, onde a taxa cai de 69,4% para 45,9%.

Terça-feira, 22 de setembro
- Para quem programa
Amazon Bedrock passa a oferecer GPT-6 Sol e GPT-6 Luna da OpenAI
Os modelos GPT-6 Sol e GPT-6 Luna ficam disponíveis no Amazon Bedrock, com preços menores que os do GPT-5.6 e recursos para tarefas recorrentes e de alto volume.

- Para quem programa
AWS passa a disponibilizar Claude Opus 5.5 no Bedrock e no Claude Platform on AWS
A publicação da AWS detalha o acesso ao Claude Opus 5.5, primeiro modelo da família Claude 5.5, com foco em eficiência, custo menor por tarefa e mais recusas em temas…

- Para quem programa
NVIDIA detalha como medir o custo da computação confidencial na inferência de IA
Guia técnico mostra como comparar inferência com e sem confidencialidade no TensorRT LLM e relata retenção de 96,1% a 98,2% da taxa de tokens em testes com oito B200.

- Para quem programa
AWS detalha avaliadores que medem escolha e execução de skills em agentes de IA
Strands Evals e Amazon Bedrock AgentCore Evaluations passam a medir, separadamente, se o agente escolheu a skill certa e se seguiu seus passos, em vez de confiar só na…

- Para quem programa
NVIDIA detalha Topograph, guia que publica topologia de clusters para Kubernetes, Slurm e Slinky
O guia mostra como o Topograph descobre a topologia de clusters de GPU e a entrega em formatos que escalonadores conseguem usar para escolher recursos mais próximos.

- Para quem programa
Reactiv detalha uso do Amazon Bedrock AgentCore para automatizar atualizações em apps Shopify
A Reactiv descreve um agendador de IA que atualiza apps nativos de lojistas Shopify em horários definidos e compartilha memória entre uso manual e automático.

Segunda-feira, 21 de setembro
- Para quem programa
NVIDIA detalha TensorRT multi-GPU no Dynamo-Triton 26.07 para geração de vídeo
A empresa publicou uma demonstração que distribui uma rede do TensorRT por várias GPUs e reduz a latência de geração do Cosmos 3 Nano em um teste com oito GPUs.
