Novo Mac Studio com M5 Max e M5 Ultra
O novo Mac Studio da Apple com chips M5 Max e M5 Ultra está sendo recebido como uma poderosa estação de trabalho de IA local, graças a até 512GB de memória unificada e à altíssima largura de banda de memória, que o tornam atraente para executar modelos de linguagem grandes no dispositivo. Ao mesmo tempo, muitos estão alarmados com os preços, especialmente para configurações com muita RAM em meio a um “RAMpocalypse” global, e debatem se comprar esse hardware supera alugar GPUs ou usar serviços de IA na nuvem. O lançamento também reabre questões sobre se vale mais a pena escolher desktops em vez de laptops, quanta proteção futura a memória unificada, porém não atualizável, realmente oferece, e onde a Apple se posiciona em relação a sistemas baseados em NVIDIA para cargas de trabalho sérias de IA.
Preços e Diferenças Regionais
- Muitos comentaristas focam nos preços altos, especialmente na Europa, onde uma configuração bem equipada do M5 Ultra ultrapassa €6.600.
- Comparações entre EUA e UE destacam a inclusão do IVA nos preços da UE e o imposto sobre vendas variável nos EUA; alguns consideram comprar em regiões com poucos impostos ou sem tarifas (com lembretes de que, tecnicamente, ainda se aplicam impostos de importação).
- Várias pessoas comparam os preços atuais com PCs historicamente caros, observando que o “computador que você realmente quer” ainda custa alguns milhares de dólares, mas as configurações de IA de ponta agora excedem isso com folga.
Capacidade de RAM, Escassez e Opções
- O preço da RAM é chamado de “insano”: +US$4.000 por 256 GB de memória unificada, com 512 GB previstos para ficar perto ou acima de US$20 mil.
- Várias publicações mencionam um “RAMpocalypse” mais amplo: a capacidade de DRAM estaria esgotada até 2027 e grandes compradores (incluindo a Apple) podem ter reservado menos do que o necessário.
- Muitos usuários gostariam de uma opção de 1 TB de memória unificada; alguns dizem que pagariam US$20–30 mil porque isso muda quais modelos podem ser executados localmente (por exemplo, modelos de ~1T+ parâmetros em 4 bits).
Desempenho, Memória Unificada e Cargas de Trabalho de LLM
- A memória unificada é elogiada por permitir que CPU e GPU compartilhem um pool grande e rápido, ideal para LLMs locais e cargas de trabalho com contexto grande.
- A largura de banda de 1,2 TB/s do M5 Ultra é destacada repetidamente; alguns a comparam favoravelmente às GPUs de consumo em largura de banda, mas outros argumentam que as GPUs de workstation da Nvidia ainda dominarão em computação bruta.
- Há debate sobre eficiência energética e tokens por watt: alguns afirmam que os Macs vencem; outros dizem que rigs Nvidia otimizados podem igualá-los ou superá-los.
- São discutidos os trade-offs entre largura de banda e latência; alta largura de banda ajuda no prefill de LLMs, mas cargas de trabalho com muitos ponteiros dependem mais de latência e caches.
Desktop vs Laptop / Configurações de Thin Client
- Muitos estão reconsiderando um Mac Studio (ou Mini) com um laptop leve ou iPad, acessando remotamente via Tailscale, SSH ou Apple Screen Sharing.
- Vários descrevem o uso de Studios/Mac Minis como servidores domésticos sempre ligados para LLMs e desenvolvimento, com laptops (ou Neo/iPad) como thin clients.
- O throttling térmico e o ruído da ventoinha nos MacBook Pros sob cargas sustentadas de LLM levam alguns a preferir desktops.
Economia da IA na Nuvem vs Local
- Alguns argumentam que alugar GPUs ou usar provedores de API ainda é mais barato para experimentação e cargas de trabalho em picos; o hardware local fica ocioso na maior parte do tempo.
- Outros, com cargas de trabalho pesadas, contínuas ou sensíveis à privacidade, relatam contas de IA na nuvem na casa das dezenas de milhares por mês e justificam hardware local caro como “pré-pagamento” de anos de computação.
Expansibilidade, Formato e Preparação para o Futuro
- A falta de RAM/SSD substituíveis pelo usuário e a ausência de um Mac torre modular recebem críticas; alguns querem um chassi reutilizável com placas-mãe intercambiáveis.
- Outros respondem que o SoC + memória no pacote é o que permite esses números de largura de banda, tornando a atualização tradicional tecnicamente e economicamente difícil.
- É discutido o agrupamento de múltiplos Studios via Thunderbolt 5; a Apple afirma ganhos de velocidade para até quatro nós, mas são observadas limitações de largura de banda e de RDMA.
Outras Notas Técnicas e Reações
- A arquitetura PCIe Gen 6 de SSD com até 2× de سرعت de armazenamento intriga alguns; permanecem dúvidas sobre térmica e benefício no mundo real.
- O lançamento discreto do M6 (apenas Mini, limite de 32 GB, sem Pro/Max/Ultra) sugere que o M7 será o passo maior focado em IA.
- No geral, o sentimento mistura entusiasmo com capacidades sérias de IA local e frustração com preços, limites de RAM e bloqueio de longo prazo de SO/hardware.