Briefing diário
30 de agosto de 2026 · 5 histórias
🔥 Em destaque
1Uma startup lança seis times de IA que substituem toda a sua pilha de software de atendimento ao cliente
Imagine que em vez de comprar um telefone, um fax, um secretária eletrônica, um software de tickets e uma ferramenta de qualidade, você contrata seis funcionários virtuais e joga o resto fora. Essa é a aposta da Crescendo, que em 25 de agosto lança a plataforma CXP: seis agentes IA especializados (concierge, agent assist, qualidade, workforce, otimização, knowledge) substituem um equivalente a seis ferramentas tradicionais. Para uma PME de 50 pessoas que gerencia 500 tickets por dia, a mudança concreta é simples: em vez de pagar sete assinaturas e três integradores, configuram-se seis agentes em quatro semanas. Resta ver se a aposta se sustenta por 90 dias. Fonte : https://crescendo.ai/news/crescendo-launches-the-ai-native-customer-experience-platform/
2NVIDIA entrega seu primeiro processador construído para agentes de IA -- OpenAI, Anthropic e AWS já receberam o deles
O processador Vera da NVIDIA, pensado para o trabalho sem parar dos agentes de IA, entra em entrega em grande escala. A AWS recebeu sua primeira máquina em 27 de agosto em Seattle. A Oracle já implanta em escala. OpenAI, Anthropic e um ator espacial receberam os deles entre maio e julho. Para uma equipe que gerencia um agente de suporte ao cliente, a mudança concreta é esta: como cada chamada de um agente consome muito mais potência que um chat simples, o processador volta a ser o gargalo. A NVIDIA promete 1,8 vez mais rápido por núcleo em cargas de trabalho de agentes. Fonte : https://blogs.nvidia.com/blog/vera-cpu-delivery/
3China publica um modelo de IA livre que supera o GPT em cibersegurança -- quinta entrega chinesa em cinco dias
O laboratório chinês Z.ai publicou em 29 de agosto os pesos abertos do GLM-5.3, um modelo de 753 bilhões de parâmetros dos quais apenas 40 bilhões se ativam a cada pergunta. Para leitores não técnicos: dá para baixar e rodar em casa, sem assinatura. Obtém as melhores pontuações conhecidas em dois testes de cibersegurança (84,5 % no CyberGym, recorde no Terminal Bench 3.0). O preço está publicado: alguns centavos por milhão de palavras lidas, menos que um café para uma conversa inteira. É a quinta entrega de um grande laboratório chinês em cinco dias -- a máquina não para mais no fim de semana. Fonte : https://huggingface.co/zai-org/GLM-5.3
4NVIDIA torna público seu pequeno modelo de IA econômico e seu roteador inteligente -- para que os agentes não falhem na hora errada
Em 11 de agosto, a NVIDIA publicou gratuitamente o Nemotron 3.5 Lightning, um modelo de 31 bilhões de parâmetros dos quais apenas 3,6 bilhões se ativam por vez, pensado para rodar em um único servidor. Vem com o NeMo Switchyard, um roteador que escolhe a ferramenta certa para cada tarefa (resposta rápida ou análise profunda) para não pagar o preço alto por tudo. Para uma startup que automatiza suporte, a fatura da nuvem pode cair pela metade segundo os primeiros relatos. O modelo atinge 51,6 % no teste SWE-bench. Fonte : https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx/
5Juiz dos EUA decide: 1,5 bilhão de dólares por 7 milhões de livros usados sem permissão -- nova regra do jogo para todo o setor de IA
O acordo do processo Bartz contra Anthropic recebeu a aprovação judicial definitiva em 20 de julho e os pagamentos começaram em 10 de agosto. A Anthropic havia usado cerca de 7 milhões de obras baixadas sem consentimento, o que dá cerca de 3.100 dólares por livro em média, e destruirá as cópias. Para um empreendedor que quer usar IA em um produto, a mudança concreta é esta: a pergunta "posso mesmo usar este modelo na Europa?" agora tem um preço oficial. Google, Meta, Midjourney e OpenAI enfrentam ações similares -- o mercado de seguros de dados de treinamento acabou de se tornar viável. Fonte : https://anthropiccopyrightsettlement.com/
📡 A vigiar
O artigo 50 da lei europeia de IA está ativo há 28 dias
Desde 2 de agosto, todo chatbot profissional deve se declarar como IA e toda imagem gerada deve levar marca d'água. O Digital Omnibus (Regulamento UE 2026/1744) adia as obrigações mais pesadas para dezembro de 2027, mas as obrigações de transparência já são exigíveis. Para qualquer PME que venda na Europa, chegou a hora de incluir um aviso legal no seu chatbot. 78 % das organizações europeias ainda não estão prontas. Fonte : https://digital-strategy.ec.europa.eu/
Patch de segurança Linux com prazo federal
Em 28 de agosto, a agência americana CISA incluiu a exploração de um kernel Linux por um agente IA (CVE-2026-53362) em seu catálogo oficial de vulnerabilidades a serem corrigidas obrigatoriamente. Agências federais devem aplicar o patch até 30 de agosto. É o primeiro incidente em que um agente IA dispara uma obrigação de patch em nível federal americano. Vale acompanhar para qualquer organização que exponha agentes em hardware padrão. Fonte : https://www.cisa.gov/known-exploited-vulnerabilities-catalog
O ritmo chinês não diminui -- próxima onda esperada nesta semana
Após cinco entregas em cinco dias (GLM-5.3-Flash, Qwen3.8 Flash, Ling 3.0 Fin, Tencent Hy4, GLM-5.3 completo), os laboratórios DeepSeek, equipe Qwen, Moonshot ou ByteDance provavelmente alinharão seus modelos nos cinco dias seguintes. O preço médio de uso caiu abaixo de 1 euro por milhão de palavras lidas nas versões mais competitivas -- um divisor de águas para a integração em PMEs europeias. Fonte : https://huggingface.co/zai-org/GLM-5.3-Flash
Primeira implantação massiva de Vera + Rubin na Oracle Cloud
A Oracle se torna o primeiro grande provedor de nuvem a implantar o novo par Vera CPU + Rubin GPU em escala industrial. Objetivo anunciado: centenas de milhares de CPUs Vera operacionais até o fim de 2026. Para equipes que hospedam seus agentes na nuvem, o preço por milhão de palavras deve cair nos próximos meses -- a confirmar com benchmarks independentes. Fonte : https://blogs.nvidia.com/blog/vera-cpu-delivery/
📊 Tendência
Domingo, 30 de agosto de 2026: o fim de semana ja nao para a maquina. Os laboratorios chineses saltaram o calendario ocidental e entregaram a sua quinta publicacao open-weight em cinco dias (GLM-5.3 completo, depois da Tencent Hy4 e do Qwen3.8 Flash). Enquanto isso, a NVIDIA distribui em grande escala uma CPU projetada especificamente para agentes -- o hardware se torna um gargalo reconhecido. Empresas voltadas ao cliente fazem a sua propria virada: a Crescendo aposta na substituicao completa da pilha de atendimento ao cliente por seis agentes especializados, em vez de uma fina camada de IA. E a justica americana sentenciou pela primeira vez o preco dos livros usados sem permissao para treinar um modelo: 1,5 bilhao de dolares -- uma referencia que pesara em todas as proximas negociacoes do setor.