Arquivo
Todas as notícias, da mais recente para a mais antiga.
Segunda-feira, 21 de setembro
- Para quem programa
Posit detalha como rodar o Positron no Amazon SageMaker AI
Guia mostra um fluxo no SageMaker Studio com Athena, R, Python, um endpoint em tempo real e relatório em Quarto, tudo em um espaço controlado.

- Para quem programa
Benchling detalha arquitetura na AWS para isolar código de IA em milhares de clientes
Guia mostra como a Benchling usa o Amazon Bedrock AgentCore Code Interpreter em VPC, DNS Firewall e políticas de endpoint para limitar acesso a dados e bloquear…

- Para quem programa
EXL detalha solução de IA na AWS para revisar sinistros médicos mais rápido
A EXL mostra como sua solução Medical IDP na AWS extrai, resume e consulta registros médicos, com validação humana para resultados de baixa confiança.

- Para quem programa
NVIDIA detalha como usar o Earth-2 para ajustar previsões do tempo com observações locais
O guia mostra como incorporar medições de satélites, radares e sensores próprios em modelos do Earth2Studio para atualizar previsões regionais e globais.

- Ciência e saúde
Multiverse Computing detalha poda de LLMs como problema de física estatística e cita ganho de 23 pontos
Em artigo no Hugging Face, a empresa descreve o CBO, que trata a escolha de blocos de transformers como um sistema de spins e relata melhora de quase 23 pontos no MMLU…

- Para quem programa
Cloudflare torna geral o suporte a Python no Workers
A plataforma passa a aceitar Python de forma oficial e integrada a serviços como Workers AI, R2, D1 e Hyperdrive, além de frameworks web populares.

- Novas IAs
SpaceXAI detalha Grok 4.7, modelo para codificação com preço a partir de US$ 2 por milhão de tokens
A empresa diz que o Grok 4.7 trabalha melhor em tarefas longas, custa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, e já pode ser usado em…

- Para usar
Muse, app de IA da Meta, supera o ChatGPT nos primeiros 12 dias, segundo a Apptopia
Estimativas da Apptopia indicam 1,8 milhão de downloads do Muse em iOS nos EUA e Canadá, acima dos 1,3 milhão do ChatGPT no mesmo intervalo inicial.

Domingo, 20 de setembro
- Para quem programa
Hugging Face detalha tokenizers v1, com encode 3 a 30 vezes mais rápido que a v0.23
A versão candidata do tokenizers v1 mantém os mesmos IDs de saída da v0.23 e traz ganhos de desempenho medidos em testes no Apple M4 Max.

Sexta-feira, 18 de setembro
- Para quem programa
SageMaker AI detalha 13 capacidades de inferência
Em um post de revisão, a Amazon descreve 13 capacidades de inferência adicionadas ao SageMaker AI em 2026, entre endpoints gerenciados e HyperPod Inference.

- Para quem programa
NVIDIA detalha o AIPerf, sucessor do GenAI-Perf, para medir LLMs em servidores
O guia explica como o AIPerf mede latência e vazão sem virar o gargalo do teste e compara um cenário fixo com outro em que as requisições variam.

- Para quem programa
AWS detalha a disponibilidade do Kimi K3 da Moonshot AI no Amazon Bedrock
Modelo aberto chega ao Bedrock com visão nativa, 1 milhão de tokens de contexto e cache explícito de prompts; há perfis global e para os EUA.

- Para quem programa
AWS mostra como migrar agente de IA multi-modelo para o Bedrock AgentCore
Guia da AWS detalha a migração de um agente de saúde do ECS com Fargate para o Bedrock AgentCore runtime, mantendo a lógica e a divisão entre três modelos.

- Para quem programa
AWS detalha novo runtime do AgentCore com inicialização mais previsível e memória sob demanda
O Amazon Bedrock AgentCore runtime passa a recuperar memória quando a sessão libera recursos e mantém o tempo de inicialização mais estável, segundo a AWS.

- Para quem programa
AWS detalha seis habilidades para agentes de código implantarem modelos Hugging Face no SageMaker AI
Em uma publicação, a AWS mostra como seis skills open source ajudam agentes como Kiro e Claude Code a escolher o contêiner certo, aplicar padrões de produção e evitar…

- Trabalho e dinheiro
Google amplia equipe do AI & Economy para estudar impacto da IA em empregos e produtividade
O programa AI & Economy do Google ganhou novos conselheiros acadêmicos e dois diretores para analisar adoção global da IA, mercado de trabalho e crescimento econômico.

- Para quem programa
AWS detalha SageMaker HyperPod Inference Gateway para rotear inferência em EKS
O add-on usa sinais de GPU em tempo real para encaminhar requisições ao pod mais adequado e, segundo a AWS, pode reduzir em até 82% a latência do primeiro token.

- Para usar
Google mostra como estilistas criaram ferramentas no Flow para a NYFW
Jane Wade e Sergio Hudson co-criaram no Google Flow recursos para visualizar looks e simular passarelas, com apoio do Google Envisioning Studio e do Labs.

- Para usar
SpaceXAI detalha o Grok Voice Transcribe 2.0, com mesma tarifa e melhor transcrição
A empresa publicou detalhes do Grok Voice Transcribe 2.0, que segundo testes internos e públicos supera a versão 1.0 e mantém os preços de US$ 0,10 e US$ 0,20 por hora.

- Novas IAs
TypeSafe AI detalha Jev, modelo que devolve probabilidades para automação de software
O sistema não gera texto: ele retorna decisões calibradas e a empresa diz que isso o torna rápido, barato e útil para tarefas como classificação e revisão de comandos.
