-
GLM-5.3-FlashX:智谱基于 GLM-5.3-Flash 推出的高速推理模型flal下载
GLM-5.3-FlashX 是智谱面向开发者和企业推出的 GLM-5.3-Flash 高速推理版本,最高输出速度可达 200 tokens/s。模型延续 GLM-5.3-Flash 的 Coding、Agent、视觉理解及专业办公能力,并通过 Infra 和推理侧优化提升生成速度,适合对实时响应和高频调用要求较高的应用。数字人软件- 480
- 0
-
MiMo-V2.5-Pro-UltraSpeed:小米发布的高速 AI Agent 推理模型ai人工智能下载
MiMo-V2.5-Pro-UltraSpeed 是小米 MiMo 团队推出的高速推理模型模式,基于 MiMo-V2.5-Pro-FP4-DFlash,支持代码生成、Agent 工作流和长上下文任务,官方称输出速度可突破 1000 tokens/s。al怎么下载使用- 2.9k
- 0



