AI 深度解读 · 财经 · 科技
智谱发布新模型
30 秒速读赶时间看这里
智谱发布GLM-5.3-FlashX,推理速度提升5倍,价格为原版2.5倍。
热点原文摘录
"9月18日,智谱正式宣布发布GLM-5.3-FlashX,API同步全面开放。据介绍,新版本推理速度最高可达200 tokens/s,较现有GLM-5.3-Flash提升5倍,定价提升至原版本的2.5倍。" 摘自公开热点词条简介 · 查看公开来源
01
核心事实
9月18日智谱正式发布GLM-5.3-FlashX,API同步全面开放,新版本推理速度最高可达200 tokens/s,较现有GLM-5.3-Flash提升5倍,定价提升至原版本的2.5倍。
02
为什么重要
- 推理速度直接影响实时交互类应用的用户体验
- 速度提升5倍、价格提升2.5倍,单位时间内的性价比有所提高
03
深层启示
速度快5倍,价格贵2.5倍,这笔账对需要实时响应的应用是划算的,比如语音助手、实时客服。对不在意延迟、更看重成本的批量任务,原版本可能仍然更合适。大模型的竞争正在从"谁更聪明"细分到"谁更快、谁更便宜",开发者可以按场景选择。
快5倍贵2.5倍,按场景算账。
—— 观察者 · 本篇金句
相关实体大模型63
话题追踪同实体 · 跨刊期 10 条
昨天智谱跌超10%港股大模型概念股走低,智谱跌超10%。大模型694.8万5天前罗福莉压力有多大罗福莉公开直播MiMo训练,不到两天成本超130万美元。大模型455.1万6天前罗福莉压力有多大罗福莉公开直播MiMo训练,不到两天成本超130万美元。大模型339.2万1周前小米大模型训练每小时烧钱超20万小米MiMo-V2.6两个版本训练合计每小时花费超20万元。大模型312.5万1周前华为高层内部万字长文曝光郭平:计算业务要做成"英伟达",战略是聚焦不扩张。大模型513.5万1周前词元出海怎么实现?服贸会上有答案服贸会上,"词元出海"成了新说法。大模型761.9万2周前iPhone 18 Pro系列真机上手iPhone 18 Pro真机上手:新增酒红、冰川蓝,灵动岛可显三个动态。大模型714.3万2周前DeepSeek正式发布新模型 定价下调最小尺寸,价格下调大模型647.5万2周前知情人士证实DeepSeek备战科创板IPO已进入尽职调查阶段大模型742.4万2周前DeepSeek新模型限时内测 烧钱更快了更快了,也更费token大模型600.2万