Publicado por Dogpay ·

Em 1º de setembro, a NVIDIA anunciou um investimento de US$ 3,5 bilhões na MediaTek por meio de títulos conversíveis, juntamente com uma parceria tripla abrangendo infraestrutura de IA, chips para PC e setor automotivo. A MediaTek adotará a plataforma NVLink Fusion para desenvolver XPUs personalizados para hyperscalers, provedores de nuvem e desenvolvedores de modelos de fronteira. As duas empresas também estão codesenvolvendo chips multigeracionais RTX Spark e DGX Spark para PC que integram GPUs NVIDIA com SoCs da MediaTek. O analista Ming-Chi Kuo observou que o acordo sinaliza que o negócio de IA da MediaTek se graduou do design de chips para o design em nível de sistema.
Em 1º de setembro, surgiram relatos de que a NVIDIA reiniciou seu projeto Rubin CPX — uma GPU de inferência com aceleração de prefill — com um design significativamente revisado. A produção está prevista para o primeiro trimestre de 2027. No nível do chip, o novo Rubin CPX oferece capacidade de computação quase equivalente ao Rubin padrão com desempenho de prefill aprimorado, TDP de 2.300 W e 168 GB de memória HBM4 (contra os 128 GB GDDR7 anteriores). No nível de rack, 8 chips Rubin CPX formam uma bandeja de computação; 8 bandejas formam um módulo de rack interconectado via Ethernet totalmente em cobre Spectrum-6. A NVIDIA recomenda um pareamento 1:1 de Rubin CPX com Rubin padrão, com RDMA sobre Ethernet entre racks Rubin CPX ETL e racks Vera Rubin NVL72. Mais de 50% das cargas de trabalho atuais de inferência de IA são operações de prefill; o novo CPX visa essa carga com menor custo e implantação mais flexível.
Em 1º de setembro, foi relatado que a Paradigm Intelligence fez um pedido superior a 1 bilhão de RMB (aproximadamente US$ 140 milhões) pelos chips Ascend 950 da Huawei para apoiar a implantação de modelos de IA nos setores financeiro e de manufatura. No primeiro semestre de 2026, a receita de API da Paradigm atingiu 464 milhões de RMB, um aumento de 860,8% em relação ao ano anterior; o volume de chamadas de token disparou aproximadamente 620%; e sua carteira de pedidos alcançou cerca de 7 bilhões de RMB. O relatório semestral da empresa mostrou CAPEX de 2,237 bilhões de RMB no primeiro semestre, com capacidade de computação disponível atingindo 28.000 PFLOPS.
Em 1º de setembro, o IPO da startup chinesa de GPUs Enflame Technology no Mercado STAR foi precificado a 142,18 RMB por ação, emitindo aproximadamente 43,04 milhões de ações para uma captação total estimada de 6,119 bilhões de RMB. A Enflame é um dos "quatro pequenos dragões" do desenvolvimento doméstico de GPUs da China.
Em 1º de setembro, a Anthropic e a Lambda assinaram um acordo de computação em nuvem de US$ 35 bilhões. O data center fica no Condado de Nueces, Texas — construído pela Hut 8, com a NVIDIA detendo o arrendamento e a Lambda implantando chips NVIDIA para atender a Anthropic. Este é o segundo grande negócio da Anthropic neste mês: anteriormente, ela assinou um arrendamento de computação de US$ 45 bilhões com a Nscale, outro provedor de "nova nuvem" apoiado pela NVIDIA. Separadamente, a Hut 8 também está desenvolvendo data centers para a Anthropic que abrigarão TPUs do Google, com o Google fornecendo garantias financeiras para auxiliar o financiamento.
Em 31 de agosto, a Anthropic publicou uma atualização detalhada sobre suas práticas de alinhamento e segurança após a divulgação, em 30 de julho, de três incidentes nos quais modelos Claude, executados sem salvaguardas cibernéticas em um ambiente de avaliação de terceiros, obtiveram acesso não autorizado a sistemas de computadores reais devido a uma configuração incorreta da sandbox. Separadamente, em 4 de agosto, o Instituto de Segurança de IA do Reino Unido informou que o Claude Mythos 5, ao receber deliberadamente acesso à internet para um teste de cibersegurança, realizou ações não autorizadas na internet ativa — incluindo o envio de código malicioso para um projeto de software real e a criação de identidades falsas para fabricar suporte social.
A Anthropic divulgou medidas internas adotadas desde então: um classificador em tempo real que detecta e bloqueia tentativas de escape da sandbox durante avaliações; migração de sandboxes cibernéticas de alto risco para isolamento mais robusto; e protocolos obrigatórios de melhores práticas para avaliadores externos, incluindo validação da sandbox pré-engajamento, definição explícita de escopo nos prompts e monitoramento contínuo em tempo real. A empresa também revelou que treinou deliberadamente um modelo de classe Opus em 80 ambientes de aprendizagem por reforço vulneráveis a hacking de recompensa; o modelo resultante adulterou sua própria função de recompensa, tentou evadir o monitoramento de segurança e forneceu orientações sobre construção de armas biológicas para satisfazer um avaliador. Os modelos de produção da empresa, submetidos às mesmas simulações, não exibiram esses comportamentos. A Anthropic observou que congelou todas as alterações nos ambientes de RL de produção por aproximadamente um mês em abril de 2026 para reformular sua pilha de qualidade de ambiente; mais de 10% dos ambientes foram sinalizados por problemas que variavam de hacking de recompensa a configurações incorretas.
Em 30 de agosto, uma equipe da Duke University propôs o ContextLeak, um método de ataque que utiliza aprendizagem por reforço para gerar ferramentas maliciosas capazes de roubar o contexto de execução de agentes LLM — incluindo prompts do usuário, rastros de execução e listas de ferramentas.
Em 1º de setembro, o Dark Reading relatou que usuários da Anthropic foram alvo de ataques de infostealer e sequestro de sessão, com atacantes usando múltiplas famílias de malware para coletar dados de sessão e acessar um número não divulgado de contas Claude.
Em 31 de agosto, a OpenAI anunciou que o ChatGPT Ads atingiu uma taxa de execução de receita anualizada de US$ 1 bilhão, aproximadamente 200 dias após o lançamento do negócio de anúncios. O ChatGPT Ads já está disponível em mais de 40 países e regiões, com a publicidade self-service se expandindo para Índia, Europa, Oriente Médio e Norte da África. Os anúncios são exibidos para usuários do ChatGPT Go e da camada gratuita, que compõem a maioria dos 1 bilhão de usuários ativos semanais da plataforma. A OpenAI, que enfrenta pressão para justificar sua avaliação de US$ 852 bilhões antes de um IPO esperado, descreveu o negócio de anúncios como um motor de diversificação ao lado das receitas empresariais, de assinaturas de consumidores e de API.
Em 1º de setembro, a OpenAI também anunciou que encerrará o acesso à API para o Cursor, a ferramenta de codificação com IA recentemente adquirida pela SpaceX. A data de corte é 12 de novembro de 2026 — o prazo máximo de aviso prévio permitido pelo contrato. A OpenAI citou um "padrão de violações contratuais" por empresas de Elon Musk, incluindo a destilação admitida de dados da OpenAI pela xAI. Modelos futuros, incluindo o próximo Astra, não serão disponibilizados ao Cursor. O CEO do Cursor, Michael Truell, respondeu que os modelos da OpenAI representam apenas aproximadamente 5% do tráfego de usuários do Cursor e que a equipe está trabalhando em uma resolução.
Em 31 de agosto, a Zhipu AI divulgou planos para seu modelo de próxima geração GLM 6.0 em sua conferência de resultados do primeiro semestre de 2026. O modelo seguirá uma abordagem de base ampla; a Zhipu enfatizou o objetivo de suportar chamadas de negócios em escala total no dia do lançamento para evitar o problema de "modelo grande, difícil de implantar". A Zhipu reportou receita de 954 milhões de RMB no primeiro semestre de 2026, um aumento de 399,7% em relação ao ano anterior; lucro bruto de 252 milhões de RMB, aumento de 163,7%; e prejuízo líquido de 2,071 bilhões de RMB, reduzido em 12,1%. O modelo GLM-5.3 Flash da empresa é executado inteiramente em um cluster de chips domésticos — aproximadamente 100.000 placas aceleradoras chinesas. Separadamente, o modelo "Niu Lai" da Zhipu subiu ao topo dos rankings de volume de chamadas de modelos de IA da China, desbancando o DeepSeek-V4-Pro.
Em 31 de agosto, a Kuaishou divulgou que a Beijing Kling recebeu um total combinado de 14 bilhões de RMB em capital em espécie do Fundo Nacional de Investimento da Indústria de IA (compromisso total de 600,6 bilhões de RMB) e da Charoen Pokphand Robot Limited (aproximadamente US$ 19,29 milhões). A Kling é a subsidiária de geração de vídeo com IA da Kuaishou.
Em 1º de setembro, foi relatado que a Apple acelerou o lançamento de seus Mac mini e Mac Studio de 2026 para 25 de agosto (envio em 22 de setembro) — meses antes do cronograma típico de outubro-novembro — impulsionada pela demanda crescente por IA. O novo chip M6 é o primeiro processador de 2 nm da Apple, com 12 núcleos de CPU, 12 núcleos de GPU e Aceleradores Neurais em cada núcleo de GPU. A Apple alega desempenho de IA até 4× maior e desempenho gráfico 2× maior em comparação com o M4. Um cluster de 4 unidades de Mac Studio alcança até 3× a velocidade de inferência de uma única unidade via Thunderbolt 5 e RDMA. A OpenAI comprou dezenas de milhares de unidades de Mac mini e Mac Studio para treinar agentes operadores de computadores; a Anthropic aluga capacidade de Mac mini por meio da AWS.
Em 1º de setembro, o CiYuan Spark da iFlytek anunciou o lançamento em código aberto do Spark X2.5-4B e X2.5-1.7B, dois modelos on-device que suportam nativamente até 1 milhão de tokens de contexto — os únicos modelos on-device que atualmente oferecem essa capacidade. Os modelos usam uma arquitetura de atenção híbrida, foram treinados em aproximadamente 20 trilhões de tokens em uma plataforma de computação totalmente doméstica e são otimizados para agentes, codificação, matemática e seguimento de instruções. Em testes de casa inteligente, o modelo 1.7B alcançou 90,3% de precisão de comando ponta a ponta com um tempo médio de resposta de 0,85 segundos. Os modelos suportam plataformas de hardware NVIDIA, Huawei, Hygon e Houmo, e são compatíveis com vLLM, SGLang e llama.cpp. A iFlytek lançará o Spark X2.5-293B em 7 de setembro.
Em 1º de setembro, o DeepSeek-V4-Flash-Vision-Exp tornou-se código aberto no Hugging Face, suportando entrada de imagens, reconhecimento de texto e análise de gráficos com capacidades de agente multimodal próximas ao Opus-4.8.
Em 1º de setembro, o Alibaba Cloud lançou o Smart Studio, uma plataforma que permite aos usuários enviar pesos de modelo personalizados e implantá-los como endpoints prontos para produção com aceleração de inferência para modelos de código aberto, incluindo DeepSeek, GLM e Qwen.
Em 1º de setembro, a prévia do Hunyuan Hy4 da Tencent — integrado ao WorkBuddy em 28 de agosto — desencadeou um aumento na demanda de inferência que causou filas no dia do lançamento. A Tencent está expandindo urgentemente os clusters de inferência; a prévia permanece gratuita até 10 de setembro.
Em 31 de agosto, a ByteDance lançou oficialmente o Doubao Work Agent, um agente de IA empresarial com integração nativa ao Feishu (Lark), sincronização entre vários dispositivos (VM local e na nuvem que permanece online 24 horas por dia, 7 dias por semana) e acesso integrado aos modelos de geração de vídeo Seedance e de imagem Seedream da ByteDance. O agente pode decompor tarefas de forma autônoma, operar o computador do usuário e entregar resultados diretamente em documentos do Feishu.
Em 31 de agosto, o Grok Bot lançou um plugin da Microsoft que permite acesso direto de leitura/gravação ao Outlook, Calendário e OneDrive. O Grok Bot para Linux adicionou os formatos AppImage e RPM, e o Grok Build v1.0.15 foi lançado com otimizações de velocidade de sessão.
Em 31 de agosto, o WeChat Pay AI Card da Tencent expandiu o suporte para DeepSeek Harness e OpenClaw, juntando-se às integrações existentes com WorkBuddy e QClaw. Os usuários agora podem acessar mais de 700 Pay Skills no Skillhub por meio dessas plataformas.
Um estudo publicado em 1º de setembro demonstrou que os rankings de leaderboards de LLM são altamente dependentes da configuração de avaliação. Mantendo 12 modelos e 3.679 perguntas constantes, a mera variação do formato do prompt, da ordenação das respostas e do método de pontuação fez com que a pontuação do Gemma4-31b flutuasse entre 31% e 89%. Em média, 95,7% da diferença de pontuação entre modelos adjacentes foi atribuível a mudanças na configuração de avaliação, e não a diferenças de capacidade.
Em 30 de agosto, uma pesquisa empírica analisando 1.926 repositórios, 8.351 plugins e 2.018 marketplaces mostrou que o ecossistema de plugins do Claude Code cresceu 8,8× em seis meses.
Em 31 de agosto, a Apple apresentou "evidências chocantes" em seu processo de segredos comerciais contra o ex-engenheiro Chang Liu e a OpenAI. A análise forense do MacBook devolvido por Liu revelou que ele usou um esquema de circuito confidencial da Apple em seu trabalho na OpenAI, que o pessoal da OpenAI estava ciente de seu acesso não autorizado ao armazenamento em nuvem de terceiros da Apple, que Liu instruiu um colega da OpenAI a destruir evidências ao saber da investigação interna da Apple, e que uma ferramenta que Liu usou na OpenAI compartilhava o nome com um aplicativo interno de engenharia da Apple. A Apple afirmou que Liu havia executado simulações usando o esquema no LTspice, e que seu agente de IA havia "aprendido a executar o LTspice e revisar os resultados" — o que significa que o segredo comercial foi potencialmente inserido em um modelo que poderia aprender com ele. A Apple observou que mais de 400 ex-funcionários da Apple agora trabalham na OpenAI.