Mercado & Negócios

AMD Ryzen™ AI Max e GPUs Radeon™

Hoje, a AMD está oferecendo suporte Day 0 ao Qwen3.8 27B, dando aos desenvolvedores uma opção para executar localmente esse modelo de última geração em PCs e workstations equipados com AMD desde o momento em que ele estiver disponível.

O Qwen3.8 27B traz a mais recente geração da família Qwen em um tamanho de modelo bastante adequado para desenvolvimento local de IA. A geração Qwen 3.8 mantém o foco em programação, trabalho do mundo real, pesquisa e cargas de trabalho de IA de longa duração, acompanhando o ritmo acelerado de inovação que estamos observando no campo da IA aberta.

Os usuários podem levar o Qwen3.8 27B diretamente para sistemas equipados com processadores AMD Ryzen™ AI Max+ ou para uma única placa de vídeo AMD Radeon™ AI PRO R9700 de 32 GB, utilizando frameworks abertos como o llama.cpp.

O modelo também pode ser executado em hardware AMD compatível com mais de 24 GB de memória gráfica variável (VGM) ou VRAM.

Isso coloca um novo modelo de IA capaz na mesma máquina em que os usuários desenvolvem, testam e utilizam suas aplicações. E ele está pronto desde o Day 0.

Os primeiros testes mostram um desempenho local expressivo do Qwen3.8 27B em hardware AMD, chegando a 24,5 tokens por segundo no AMD Ryzen™ AI Max+ 395 e a 51,8 tokens por segundo em uma única AMD Radeon™ AI PRO R9700.

Como um modelo denso de 27 bilhões de parâmetros, o Qwen3.8 27B exige bastante capacidade de memória e poder computacional. Por isso, um hardware local mais potente é especialmente importante.

Números preliminares

Qwen3.8 27B executado em um AMD Ryzen AI Max+ utilizando o llama.cpp.

Esses resultados preliminares foram medidos no Windows utilizando o popular projeto llama.cpp, com o backend Vulkan, utilizando MTP=4 no Ryzen AI Max+ 395 e MTP=2 na Radeon AI PRO R9700.

Os números representam a média da velocidade de geração de tokens obtida em três ou mais execuções.

Como ainda estão sendo realizados novos trabalhos de otimização tanto no software quanto no modelo, a expectativa é que o desempenho continue melhorando à medida que o suporte Day 0 evolua.

Rodando com o LM Studio

Para usuários avançados e entusiastas que querem começar a utilizar o Qwen3.8 27B imediatamente, o LM Studio oferece uma maneira simples de executar o modelo localmente.

Em sistemas AMD compatíveis, os usuários podem encontrar, baixar e começar a trabalhar com o modelo por meio de uma interface gráfica familiar.

O Qwen3.8 27B pode ser utilizado com o LM Studio em hardwares AMD recomendados, incluindo sistemas equipados com processadores AMD Ryzen™ AI Max+ e a placa de vídeo AMD Radeon™ AI PRO R9700 de 32 GB.

É importante observar que o modelo necessita de aproximadamente 24 GB de memória gráfica variável (VGM) ou VRAM para funcionar confortavelmente. Ele também pode ser executado em plataformas AMD mais antigas compatíveis com o LM Studio.

Observação: o MTP precisa estar habilitado e configurado com a quantidade correta de tokens de rascunho para obter o melhor desempenho. Configure 4 para AMD Ryzen™ AI Max+ e 2 para AMD Radeon™ AI PRO R9700.

Nas configurações avançadas de carregamento do modelo, desmarque a opção “Try mmap”.

Isso torna o LM Studio uma opção simples para explorar o modelo, testar prompts e fluxos de trabalho e descobrir o que o Qwen3.8 27B consegue fazer localmente sem escrever uma única linha de código.

Para usuários AMD, o LM Studio faz parte de um ecossistema crescente de IA local baseado em modelos abertos e tecnologias de inferência amplamente utilizadas, como o llama.cpp. Dessa forma, o usuário tem um caminho acessível desde o download do modelo até a execução local da IA.

Integração com o Lemonade

Executar um modelo é apenas o primeiro passo. A grande oportunidade para os desenvolvedores está em transformar a IA local em uma parte nativa de suas aplicações.

É nesse ponto que entra o Lemonade.

O Lemonade é uma plataforma de desenvolvimento da AMD focada em IA local, criada para reduzir a complexidade da implementação de inteligência artificial em PCs.

Sua arquitetura com múltiplos mecanismos oferece uma interface unificada, enquanto cuida da seleção do backend e das otimizações específicas do hardware, utilizando os recursos disponíveis de CPU, GPU e NPU.

A AMD desenvolveu o Lemonade especificamente para lidar com os desafios encontrados pelos desenvolvedores ao criar aplicações de IA local para diferentes configurações de hardware.

Para desenvolvedores de aplicações, o Lemonade pode ser distribuído junto com um aplicativo como uma camada leve de inferência local. Isso permite que a aplicação se comunique com o Qwen3.8 27B utilizando padrões de API conhecidos, sem que os desenvolvedores precisem criar e manter sua própria infraestrutura de inferência específica para cada hardware.

O resultado é uma experiência de desenvolvimento muito mais simples: distribuir a aplicação, iniciar o serviço de inferência local, conectar ao modelo e deixar o Lemonade cuidar da integração com a plataforma AMD.

Avançando a IA com suporte Day 0 para modelos locais de última geração

O ritmo de evolução da IA aberta não está diminuindo. Os usuários não deveriam precisar esperar que seu hardware e ecossistema de software acompanhem cada novo modelo lançado.

O Qwen3.8 27B representa mais um passo importante para a IA local, trazendo uma nova geração de recursos para um modelo que pode ser instalado diretamente nos sistemas dos usuários.

Os processadores AMD Ryzen AI Max+ e as placas de vídeo AMD Radeon AI PRO R9700 oferecem aos desenvolvedores plataformas locais potentes para executá-lo.

O LM Studio oferece um caminho rápido para experimentar o modelo.

O Lemonade oferece uma maneira de transformar essa capacidade em uma aplicação.

E, com o suporte Day 0 da AMD, os desenvolvedores podem começar a criar desde o primeiro dia.

Rafael

Rafael de Souza Mota é especialista em tecnologia, mobilidade e inovação, criador do Inteligência Móvel. Atua como gerente de projetos e produz reviews, análises e conteúdos sobre smartphones, gadgets, automóveis e lifestyle digital.