Primeira páginaDiário da IA

Para quem programa

Guias, kits e infraestrutura para desenvolvedores e equipes técnicas. Se você só usa IA, pode pular esta seção.

287 notícias · página 3 de 15

Sexta-feira, 25 de setembro

  1. Para quem programa

    AWS e Qumulo detalham treino de IA com dados em outra região sem copiar arquivos

    Post mostra um teste com SageMaker HyperPod e Qumulo em que um cluster remoto igualou o desempenho do cluster local após aquecimento do cache.

    AWS2 min de leitura

  2. Para quem programa

    Cloudflare detalha Turnstile Spin, que guia agentes de IA na configuração do Turnstile

    A proposta é ajudar a instalar ou corrigir o Turnstile com um agente de IA, incluindo a validação no servidor, sem enviar o código da aplicação para a Cloudflare.

    Cloudflare2 min de leitura

Quinta-feira, 24 de setembro

  1. Para quem programa

    AWS detalha implantação do WhisperX no SageMaker AI para transcrição com falantes identificados

    Guia da AWS mostra como usar o WhisperX em um Deep Learning Container no SageMaker AI para transcrever áudio com timestamps por palavra e rótulos de falantes.

    AWS2 min de leitura

  2. Para quem programa

    AWS detalha arquitetura multi-conta para agente de IA com AgentCore Gateway e MCP

    A publicação mostra como manter dados em contas AWS separadas e ligar tudo por um Gateway central com autenticação, autorização e ferramentas MCP.

    AWS1 min de leitura

  3. Para quem programa

    Aderant automatiza triagem de tickets com Amazon Nova Lite no Bedrock

    O sistema analisa tickets em horários definidos, reúne contexto em ferramentas internas e sugere roteamento; nos primeiros 2,5 semanas, revisou 109 chamados com cerca de…

    AWS2 min de leitura

  4. Para quem programa

    NVIDIA detalha tutorial para treinar modelos biológicos MoE com TE e MXFP8

    Material da BioNeMo explica como a Transformer Engine reduz gargalos em modelos de especialistas mistos e cita benchmark de até 2,21x em oito GPUs B200.

    NVIDIA2 min de leitura

Quarta-feira, 23 de setembro

  1. Para quem programa

    NVIDIA detalha NVCRE, controlador open source que valida clusters de GPU com testes reais

    O Cluster Readiness Engine executa cargas distribuídas no Kubernetes para apontar nós problemáticos antes da produção e organiza o resultado por categoria, teste e nó…

    NVIDIA2 min de leitura

  2. Para quem programa

    NVIDIA detalha como levar simulação do MuJoCo para até 2.048 mundos em GPU com MJWarp

    Guia da NVIDIA mostra a migração de uma simulação do braço SO-101 do CPU para GPU, com validação, ajuste de buffers e replicação do estado inicial.

    Hugging Face2 min de leitura

  3. Para quem programa

    HEMA detalha HAL, assistente interno que reúne conhecimento técnico em uma só interface

    Construído sobre Amazon Bedrock AgentCore e MCP, o HAL leva respostas internas da HEMA para chat e IDE, com login via Microsoft Entra ID e acesso só de leitura.

    AWS2 min de leitura

  4. Para quem programa

    NVIDIA detalha NodeWright, projeto para atualizar nós Kubernetes sem parar cargas de trabalho

    O software de código aberto é apresentado como um gerenciador de host para clusters, com validação integrada, avanço gradual das mudanças e uso em nós com GPU.

    NVIDIA2 min de leitura

  5. Para quem programa

    AWS detalha guia para agente de IA que responde perguntas sobre vídeos

    O material mostra uma arquitetura com Strands Agents SDK para consultar vídeos em linguagem natural, combinando Transcribe, Rekognition e Bedrock conforme a pergunta.

    AWS2 min de leitura

  6. Para quem programa

    AWS detalha uso do OpenCode com modelos de peso aberto no Amazon Bedrock

    Guia da AWS mostra como combinar o agente de codificação OpenCode com o Bedrock para alternar modelos, manter dados na conta do cliente e pagar conforme o uso.

    AWS2 min de leitura

  7. Para quem programa

    SWE-Serve mostra que patches de agentes de IA podem passar em testes e falhar no servidor real

    Criado com ajuda da equipe do SGLang, o benchmark compara a aprovação em verificações comuns e em testes com servidor ativo, onde a taxa cai de 69,4% para 45,9%.

    NVIDIA2 min de leitura

Terça-feira, 22 de setembro

  1. Para quem programa

    Amazon Bedrock passa a oferecer GPT-6 Sol e GPT-6 Luna da OpenAI

    Os modelos GPT-6 Sol e GPT-6 Luna ficam disponíveis no Amazon Bedrock, com preços menores que os do GPT-5.6 e recursos para tarefas recorrentes e de alto volume.

    AWS2 min de leitura

  2. Para quem programa

    AWS passa a disponibilizar Claude Opus 5.5 no Bedrock e no Claude Platform on AWS

    A publicação da AWS detalha o acesso ao Claude Opus 5.5, primeiro modelo da família Claude 5.5, com foco em eficiência, custo menor por tarefa e mais recusas em temas…

    AWS2 min de leitura

  3. Para quem programa

    NVIDIA detalha como medir o custo da computação confidencial na inferência de IA

    Guia técnico mostra como comparar inferência com e sem confidencialidade no TensorRT LLM e relata retenção de 96,1% a 98,2% da taxa de tokens em testes com oito B200.

    NVIDIA2 min de leitura

  4. Para quem programa

    AWS detalha avaliadores que medem escolha e execução de skills em agentes de IA

    Strands Evals e Amazon Bedrock AgentCore Evaluations passam a medir, separadamente, se o agente escolheu a skill certa e se seguiu seus passos, em vez de confiar só na…

    AWS2 min de leitura

  5. Para quem programa

    NVIDIA detalha Topograph, guia que publica topologia de clusters para Kubernetes, Slurm e Slinky

    O guia mostra como o Topograph descobre a topologia de clusters de GPU e a entrega em formatos que escalonadores conseguem usar para escolher recursos mais próximos.

    NVIDIA2 min de leitura

  6. Para quem programa

    Reactiv detalha uso do Amazon Bedrock AgentCore para automatizar atualizações em apps Shopify

    A Reactiv descreve um agendador de IA que atualiza apps nativos de lojistas Shopify em horários definidos e compartilha memória entre uso manual e automático.

    AWS2 min de leitura

Segunda-feira, 21 de setembro

  1. Para quem programa

    NVIDIA detalha TensorRT multi-GPU no Dynamo-Triton 26.07 para geração de vídeo

    A empresa publicou uma demonstração que distribui uma rede do TensorRT por várias GPUs e reduz a latência de geração do Cosmos 3 Nano em um teste com oito GPUs.

    NVIDIA2 min de leitura