LM Studio Bionic integra GLM-5.3-Flash com suporte a entradas multimodais e contexto de 1 milhão de tokens

·por TechRitual Editorial·Apple
LM Studio Bionic integra GLM-5.3-Flash com suporte a entradas multimodais e contexto de 1 milhão de tokens
✏️ Conteúdo original| TechRitual World Redação

LM Studio adicionou suporte ao novo modelo GLM-5.3-Flash da Z.ai na sua plataforma de agentes de inteligência artificial Bionic, introduzindo funcionalidades de entrada multimodal, uma janela de contexto de 1 milhão de tokens e uma redução significativa nos preços em comparação com o antecessor GLM-5.2. O Bionic é uma plataforma da LM Studio destinada a tarefas de codificação, pesquisa e processamento de documentos, suportando os sistemas operativos macOS e Windows, e permitindo aos utilizadores escolher entre modelos implantados localmente ou modelos em nuvem hospedados em servidores nos Estados Unidos, sendo que estes últimos têm uma política rigorosa de não retenção de dados.

Desde a sua divulgação oficial a meio de julho, a LM Studio tem vindo a expandir continuamente o número de modelos e o âmbito de funcionalidades disponíveis na plataforma Bionic. Após a adição anterior do suporte ao Kimi K3 da Moonshot AI, agora é a vez de introduzir a nova criação da Z.ai, o GLM-5.3-Flash. A LM Studio afirmou que os custos de operação deste modelo podem ser até 10 vezes inferiores aos do GLM-5.2. O anúncio da LM Studio ocorreu apenas algumas horas antes do lançamento oficial do GLM-5.3-Flash, que já tinha sido testado anonimamente nas plataformas OpenCode e OpenRouter sob o codinome "Ox Alpha", gerando ampla atenção.

GLM-5.3-Flash adota uma arquitetura de mistura de especialistas com desempenho comparável a modelos de ponta

O GLM-5.3-Flash pertence à arquitetura de mistura de especialistas (Mixture-of-Experts, MoE), com um total de 320 bilhões de parâmetros, ativando 18 bilhões de parâmetros por inferência, suportando entradas de imagem e texto, com uma janela de contexto de 1 milhão de tokens. Os resultados dos testes de referência divulgados pela Z.ai mostram que este modelo supera o GLM-5.2 em várias métricas, apresentando desempenho geral comparável a modelos de ponta como Anthropic, OpenAI, Google e DeepSeek.

Os utilizadores da LM Studio podem aceder a este modelo em nuvem diretamente através da plataforma, e as configurações e métodos de utilização podem ser consultados nas instruções oficiais.

ItemEspecificações
Nome do modeloGLM-5.3-Flash
DesenvolvedorZ.ai
ArquiteturaMistura de especialistas (MoE)
Total de parâmetros320 bilhões
Parâmetros ativados18 bilhões
Janela de contexto1 milhão de tokens
Suporte de entradaImagem, texto
Plataforma de operaçãoLM Studio Bionic (macOS, Windows)

Ler o artigo original em techritual.com (chinês tradicional)

T
Sobre o autor
TechRitual Editorial

The TechRitual editorial desk in Hong Kong. Articles on TechRitual World are translated from the Traditional Chinese originals on techritual.com.