Primeira páginaDiário da IA

Para quem programa

Guias, kits e infraestrutura para desenvolvedores e equipes técnicas. Se você só usa IA, pode pular esta seção.

287 notícias · página 4 de 15

Segunda-feira, 21 de setembro

  1. Para quem programa

    NVIDIA detalha como avaliar agentes de IA pela conclusão de tarefas, não por chamadas isoladas

    Guia técnico da NVIDIA defende medir agentes pelo resultado final e pelo rastreamento por etapa, com exemplos como BFCL, E2E e o benchmark PinchBench.

    NVIDIA2 min de leitura

  2. Para quem programa

    xAI disponibiliza Grok 4.6 no Amazon Bedrock com 500 mil tokens de contexto

    O modelo passa a estar acessível no Bedrock com quatro níveis de raciocínio, suporte ao Converse e acesso via bedrock-mantle e bedrock-runtime, além de inferência entre…

    AWS1 min de leitura

  3. Para quem programa

    BMW Group detalha detecção diária de anomalias de custo em 14 mil contas na nuvem

    A plataforma CLEA usa Prophet e AWS Step Functions para comparar gastos previstos e reais e alertar responsáveis quando há desvio relevante.

    AWS2 min de leitura

  4. Para quem programa

    Posit detalha como rodar o Positron no Amazon SageMaker AI

    Guia mostra um fluxo no SageMaker Studio com Athena, R, Python, um endpoint em tempo real e relatório em Quarto, tudo em um espaço controlado.

    AWS2 min de leitura

  5. Para quem programa

    Benchling detalha arquitetura na AWS para isolar código de IA em milhares de clientes

    Guia mostra como a Benchling usa o Amazon Bedrock AgentCore Code Interpreter em VPC, DNS Firewall e políticas de endpoint para limitar acesso a dados e bloquear…

    AWS2 min de leitura

  6. Para quem programa

    EXL detalha solução de IA na AWS para revisar sinistros médicos mais rápido

    A EXL mostra como sua solução Medical IDP na AWS extrai, resume e consulta registros médicos, com validação humana para resultados de baixa confiança.

    AWS2 min de leitura

  7. Para quem programa

    NVIDIA detalha como usar o Earth-2 para ajustar previsões do tempo com observações locais

    O guia mostra como incorporar medições de satélites, radares e sensores próprios em modelos do Earth2Studio para atualizar previsões regionais e globais.

    NVIDIA2 min de leitura

  8. Para quem programa

    Cloudflare torna geral o suporte a Python no Workers

    A plataforma passa a aceitar Python de forma oficial e integrada a serviços como Workers AI, R2, D1 e Hyperdrive, além de frameworks web populares.

    Cloudflare1 min de leitura

Domingo, 20 de setembro

  1. Para quem programa

    Hugging Face detalha tokenizers v1, com encode 3 a 30 vezes mais rápido que a v0.23

    A versão candidata do tokenizers v1 mantém os mesmos IDs de saída da v0.23 e traz ganhos de desempenho medidos em testes no Apple M4 Max.

    Hugging Face2 min de leitura

Sexta-feira, 18 de setembro

  1. Para quem programa

    SageMaker AI detalha 13 capacidades de inferência

    Em um post de revisão, a Amazon descreve 13 capacidades de inferência adicionadas ao SageMaker AI em 2026, entre endpoints gerenciados e HyperPod Inference.

    AWS2 min de leitura

  2. Para quem programa

    NVIDIA detalha o AIPerf, sucessor do GenAI-Perf, para medir LLMs em servidores

    O guia explica como o AIPerf mede latência e vazão sem virar o gargalo do teste e compara um cenário fixo com outro em que as requisições variam.

    NVIDIA2 min de leitura

  3. Para quem programa

    AWS detalha a disponibilidade do Kimi K3 da Moonshot AI no Amazon Bedrock

    Modelo aberto chega ao Bedrock com visão nativa, 1 milhão de tokens de contexto e cache explícito de prompts; há perfis global e para os EUA.

    AWS1 min de leitura

  4. Para quem programa

    AWS mostra como migrar agente de IA multi-modelo para o Bedrock AgentCore

    Guia da AWS detalha a migração de um agente de saúde do ECS com Fargate para o Bedrock AgentCore runtime, mantendo a lógica e a divisão entre três modelos.

    AWS2 min de leitura

  5. Para quem programa

    AWS detalha novo runtime do AgentCore com inicialização mais previsível e memória sob demanda

    O Amazon Bedrock AgentCore runtime passa a recuperar memória quando a sessão libera recursos e mantém o tempo de inicialização mais estável, segundo a AWS.

    AWS2 min de leitura

  6. Para quem programa

    AWS detalha seis habilidades para agentes de código implantarem modelos Hugging Face no SageMaker AI

    Em uma publicação, a AWS mostra como seis skills open source ajudam agentes como Kiro e Claude Code a escolher o contêiner certo, aplicar padrões de produção e evitar…

    AWS2 min de leitura

  7. Para quem programa

    AWS detalha SageMaker HyperPod Inference Gateway para rotear inferência em EKS

    O add-on usa sinais de GPU em tempo real para encaminhar requisições ao pod mais adequado e, segundo a AWS, pode reduzir em até 82% a latência do primeiro token.

    AWS2 min de leitura

Quinta-feira, 17 de setembro

  1. Para quem programa

    Amazon detalha o Connect Talent, ferramenta de IA para entrevistas e avaliações em escala

    A empresa diz que o Connect Talent ajuda equipes de recrutamento a conduzir entrevistas e avaliações com IA, enquanto o recrutador mantém a decisão final sobre a…

    AWS1 min de leitura

  2. Para quem programa

    AWS detalha escolha de vetor para Bedrock Knowledge Bases e compara três opções

    Post usa benchmarks no OpenSearch Serverless para mostrar como latência, custo e qualidade variam entre OpenSearch, Aurora PostgreSQL com pgvector e S3 Vectors.

    AWS2 min de leitura

  3. Para quem programa

    AWS detalha guia para métricas de Git no QuickSight com pipeline serverless

    O material mostra como montar um pipeline serverless para coletar métricas de GitHub e GitLab e exibi-las em dashboards do Amazon QuickSight, com apoio ao acompanhamento…

    AWS1 min de leitura

  4. Para quem programa

    Wood Mackenzie detalha APEX, plataforma compartilhada de agentes sobre Amazon Bedrock AgentCore

    A empresa mostra como unificou em uma só base identidade, observabilidade, memória e governança para três aplicações internas, evitando que cada time monte sua própria…

    AWS2 min de leitura