本文自南都。
***写 | 南都N***记者 林文琪
2月21日,“全球大模型第一股”智谱AI(02513.HK)发布致歉信称,GLM-5发布后GLM Coding Plan存在透明度不够、GLM-5灰度节奏太慢、老用户升级机制设计粗糙三大问题,表示“挨打要立正”,并提出了相应的处理和补偿方案。致歉信提到,GLM-5发布后,流量超出预期,智谱扩容节奏没有跟上,不得已将GLM-5按照Max、Pro、Lite的顺序逐步开放。
值得一提的是,截至最新交易日(2月20日),智谱股价暴涨42.72%至725港元,市值突破3200亿港元。
2月12日,智谱发布新模型GLM-5,该模型Coding与Agent能力上取得开源SOTA表现。智谱方面表示,GLM系列模型受到全球开发者喜爱,在GLM Coding Plan全球爆量后官方不得不启动限售活动。
GLM Coding Plan是智谱重押的业务模式。此前智谱CEO张鹏在接受媒体***访时披露,智谱面向全球开发者的模型业务(GLM Coding Plan)年度经常性收入(ARR)已超过1亿元人民币,约合1400万美元。
2月16日,智谱也发文表示,由于全球范围内对GLM-5的需求激增,并且访问量突破了既有规划的上限,导致服务出现排队、响应延迟及卡顿现象,影响到部分用户的体验,对此内部已经多次对国产芯片集群进行扩容,并限量发售了GLM Coding Plan套餐,但依然无法彻底解决当前供不应求的局面。
为此,智谱启动“算力合伙人”招募***:对于芯片厂商,智谱愿开放核心技术接口联合开展针对 GLM-5 的底层优化,共同打造极致的软硬一体化性能标杆;对于算力伙伴与推理服务商,如果拥有大规模、高稳定性的算力池,或具备卓越的推理分发能力,智谱期待共建更高并发、更低延迟的推理网络。
不过2月21日,智谱就该业务向开发者致歉。智谱在致歉信中提到,GLM-5发布后,有老用户反馈消耗变快了。智谱表示,“GLM-5的参数规模是GLM-4.7的两倍以上,定位是效果逼近Claude Opus 4.5的‘大杯’模型,适合复杂任务。为了让更多用户能把GLM-5用在真正需要的场景,我们设计了分层使用策略:日常简单任务优先用GLM-4.7,GLM-5按高峰期3倍、非高峰期2倍的消耗计算。尽管我们提前对消耗倍数做了准备,但没提前算清楚账给到大家,这是我们的失误。”
在体验方面,智谱也表示,近期GLM Coding Plan遭受灰产号池和黄牛党冲击,恶意占用了大量***。与此同时GLM-5发布后,流量超出预期,智谱扩容节奏没有跟上,不得已将GLM-5按照Max、Pro、Lite的顺序逐步开放。目前Max用户已经全面开放,Pro用户虽已开放,但高峰期可能会因集群负载较高遇到限流,Lite用户将会在节后非高峰期逐步灰度开放。
针对受到影响的Lite和Pro用户(不分新老),智谱支持自主申请退款。退款遵循2026年1月1日至2月21日,“智谱全部请客”的原则。
附致歉信全文:
返回搜狐,查看更多
一是,这场科普直播把小米汽车试验室的部分测试停了下来,为了让大家看清楚试验室环境和流程,工作节奏按了暂停键,雷军表示直播费用“很高很高”。 还未等告别雷军光辉,小米汽车就陷入了严重的舆论危机上,SU7发生车…...
多方传闻显示,苹果今年将推出超 20 款新品,而 本周刚刚亮相的 AirTag (第二代)只是一道开胃菜。我们也对苹果未来一年所拥有的机会感到兴奋,能够带来前所未见的创新,并在每一步持续丰富用户生活。展望接…...
现在智能体如此智能,这种「硅基劳动力」的出现基本上合乎逻辑、顺理成章的下一步了。 智能体产出的所有东西——起草的推文、分析报告、内容稿件——都还停留在OpenClaw的输出层。心跳不再需要Vercel的定时…...
这也是论文反复强调“原位***利用”(ISRU)的原因:所谓ISRU,说穿了就是不再把所有补给都从地球往上送,而是在月球、小行星等地外天体就地获取***,现场加工成水、氧气、推进剂等可直接使用的物资。相比把所有…...
外观相似就是抄?国外博主吐槽中国手机抄袭苹果_Pro_设计_摄像头...
【CNMO科技消息】2月2日,阿里旗下AI助手“千问”宣布将投入30亿元发起春节“请客”***,邀请用户感受AI时代的“吃喝玩乐”。这标志着,继腾讯“元宝”豪掷10亿、百度“文心”发放5亿红包后,中国互联网公司…...