LM Studio 在旗下 Bionic 人工智能代理平台新增支持 Z.ai 全新 GLM-5.3-Flash 模型,引入多模态输入功能、100 万词元(token)上下文窗口,并在定价上较前代 GLM-5.2 大幅下调。Bionic 为 LM Studio 针对编码、研究及文件处理等代理任务而设的平台,支持 macOS 与 Windows 操作系统,同时允许用户选择本地部署模型或采用托管于美国服务器的云端模型,后者设有严格的零数据保留政策。
自七月中旬正式公布以来,LM Studio 持续扩充 Bionic 平台可用的模型数量与功能范围,继先前加入月之暗面 Moonshot AI 的 Kimi K3 支持后,这次再引入 Z.ai 的新作 GLM-5.3-Flash。LM Studio 指出,该模型的运行成本最高可比 GLM-5.2 降低 10 倍。LM Studio 的公布时间仅距离 GLM-5.3-Flash 正式发布数小时,该模型早前曾以“Ox Alpha”代号在 OpenCode 与 OpenRouter 平台上匿名测试,并引起广泛关注。
GLM-5.3-Flash 采用专家混合架构 性能与前沿模型看齐
GLM-5.3-Flash 属于专家混合(Mixture-of-Experts,MoE)架构模型,总参数量为 3,200 亿,每次推理启用 180 亿参数,支持图像与文字输入,上下文窗口达 100 万词元。Z.ai 公布的基准测试结果显示,该模型在多项指标上均超越 GLM-5.2,整体表现与 Anthropic、OpenAI、Google 及 DeepSeek 等前沿模型大致处于相同水平。
LM Studio 用户可通过平台直接调用此云端模型,相关设置及使用方式可参阅官方说明。
| 项目 | 规格 |
|---|---|
| 模型名称 | GLM-5.3-Flash |
| 开发商 | Z.ai |
| 架构 | 专家混合(MoE) |
| 总参数量 | 3,200 亿 |
| 启用参数量 | 180 亿 |
| 上下文窗口 | 100 万词元 |
| 输入支持 | 图像、文字 |
| 运行平台 | LM Studio Bionic(macOS、Windows) |

