Recentemente, AMD e Qualcomm anunciaram conjuntamente que seus hardware suportam oficialmente a série de modelos de raciocínio aberto gpt-oss lançada pela OpenAI, marcando um importante passo na integração entre computação nas bordas e inteligência artificial. A nova série gpt-oss lançada pela OpenAI inclui dois modelos: o gpt-oss-20b, com menos parâmetros, e o gpt-oss-120b mais complexo. O primeiro pode ser executado de forma suave em dispositivos com 16 GB de memória, enquanto o segundo pode ser executado com eficiência em uma única placa de vídeo com 80 GB.

A AMD anuncia orgulhosamente que o processador Ryzen AI Max+395 se tornou o primeiro processador de PC de inteligência artificial de uso geral capaz de executar o modelo gpt-oss-120b. Para adaptar-se a esse poderoso modelo, a AMD utilizou o framework GGML e o formato MXFP4, permitindo que o gpt-oss-120b seja executado com tranquilidade usando cerca de 61 GB de memória de vídeo. Além disso, a plataforma "Strix Halo" pode alocar 96 GB para a GPU com sua memória unificada de 128 GB, atendendo às necessidades de execução.

image.png

No que diz respeito ao desempenho, o Ryzen AI Max+395 pode produzir 30 tokens por segundo ao executar o gpt-oss-120b e também suporta o protocolo de contexto do modelo MCP. Isso significa que os usuários podem aproveitar velocidades de resposta mais rápidas e maior eficiência ao lidar com tarefas complexas.

A Qualcomm afirmou que, após testes iniciais, o modelo gpt-oss-20b demonstrou excelentes habilidades de raciocínio em cadeia em sua plataforma Snapdragon. Os desenvolvedores podem acessar facilmente este modelo em dispositivos com chips Snapdragon por meio de plataformas conhecidas como Hugging Face e Ollama, aproveitando plenamente suas capacidades poderosas.

image.png

Essa colaboração não apenas demonstra a visão prospectiva da AMD e da Qualcomm na área de inteligência artificial, mas também abre caminho para o futuro da computação nas bordas e da inteligência artificial. Com a aplicação ampla dos modelos gpt-oss, podemos esperar dispositivos mais inteligentes e cenários mais flexíveis de aplicações de inteligência artificial.