É novamente a era do CPU.
- A Meta lançou em 8 de setembro o agente de IA pessoal Muse. Ele não é simplesmente um chatbot responsivo, mas sim um agente pessoal capaz de executar tarefas de forma proativa e sugerir ideias no lugar do usuário. Suas características incluem enviar e-mails e reservar viagens em nome do usuário, além de ser um agente residente capaz de continuar executando tarefas em segundo plano mesmo após o encerramento do aplicativo.
- O mercado reagiu com grande entusiasmo no lançamento. Em 12 dias, o Muse atingiu 1,8 milhão de downloads acumulados, superando o recorde do ChatGPT no mesmo período, e o DAU também chegou a 640 mil, muito acima do ChatGPT no momento correspondente. Isso é visto como o primeiro caso de sucesso na popularização de agentes de IA entre consumidores.
- A estrutura do negócio também favorece o aumento do uso. Comparado aos chatbots, agentes de IA têm ciclos mais longos e consomem mais tokens, tornando-se um serviço de custo elevado. No entanto, mesmo sem assinatura, a Meta oferece até 100 milhões de tokens gratuitos por semana. A longo prazo, seu objetivo é gerar comissão dos vendedores das plataformas integradas de compras e viagens através do Muse.
- É importante notar que essa carga de trabalho é intensiva em CPU. Agentes de IA são estruturados em múltiplos ciclos de chamadas de ferramentas externas, acesso a bancos de dados e reiterações de raciocínio. Exceto pelo processamento de IA feito por GPU, as etapas de decisão, orquestração e acesso a softwares externos ficam sob responsabilidade da CPU.
- Especialmente no caso do Muse, todos os usuários gratuitos recebem uma VM dedicada na nuvem, o que possivelmente aumentará proporcionalmente a demanda por CPU à medida que o número de usuários cresce. A Intel mencionou que, com a popularização dos agentes, a proporção GPU:CPU pode subir do atual 8 a 4:1 para acima de 1:1 no longo prazo.
- Os movimentos de investimento da Meta também apontam nessa direção. No primeiro semestre do ano, a Meta garantiu amplos contratos de CPU para servidores com NVIDIA Grace·Vera, ARM AGI, AMD Venice e AWS Graviton. Isso é interpretado como uma preparação antecipada para a expansão dos serviços de agentes, incluindo o Muse.
- O sucesso do Muse é um exemplo do potencial de crescimento dos serviços de agente de IA voltados ao consumidor. Quanto mais rápido esses serviços se difundem, mais estrutural tende a ser o crescimento da demanda por CPU para orquestração das cargas de trabalho.
- O gargalo já apertado do fornecimento de CPU provavelmente será ainda mais agravado. Os principais fabricantes de CPU, como Intel, AMD e ARM, além da cadeia de valor de CPU que passou por ajustes recentemente, devem voltar a chamar atenção. Acredito que isso abre uma oportunidade de compra.
Aviso Legal: o conteúdo deste artigo reflete exclusivamente a opinião do autor e não representa a plataforma. Este artigo não deve servir como referência para a tomada de decisões de investimento.
Talvez também goste

O grande apostador Burry aumenta apostas contra Micron e Nebius, argumentando que o fornecimento de memória está crescendo rapidamente e os preços devem enfrentar pressão de queda.
Michael Burry aumentou significativamente suas apostas de venda contra Micron, Palantir e o ETF de semicondutores, afirmando que o valor dessas posições é "bastante grande". Sua lógica central é que Samsung, SK Hynix e Micron, para atender à demanda de HBM para IA, reduziram a produção de DRAM convencional, o que causou uma escassez temporária. Agora, com o aumento da capacidade de produção, a ameaça de excesso de oferta paira sobre o mercado como uma espada de Dâmocles. O alerta de estoque do CEO da Acer o fez acreditar ainda mais que o ciclo de memória já atingiu seu pico.
