智谱发布 GLM-5.3-FlashX:推理提速 5 倍至 200 tokens/s,定价提升 2.5 倍
9 月 18 日,智谱正式上线 GLM-5.3-FlashX。新版本将推理速度提升至最高 200 tokens/s,较上一代 GLM-5.3-Flash 提速 5 倍,定价同步提升至原版的 2.5 倍。API 已全面开放,Model Key…
9 月 18 日,智谱正式上线 GLM-5.3-FlashX。新版本将推理速度提升至最高 200 tokens/s,较上一代 GLM-5.3-Flash 提速 5 倍,定价同步提升至原版的 2.5 倍。API 已全面开放,Model Key…
微信不只想做 AI 功能的入口——它开始自己做模型了。 8月12日至13日,腾讯微信团队正式在 X 平台公布了大语言模型系列 WeLM(WeChat Large Language Model),主打资源效率,面向微信生态内的 AI 规模化落…
AI 实验室买显卡不稀奇,但现在开始按「吨」囤 Mac mini 了。 据 The Information 报道,OpenAI 过去数月采购了数万台苹果 Mac mini 和 Mac Studio,专门用于训练 Computer-use A…
端侧模型之前有个痛点:参数小了跑得动,但处理不了长文本;参数大了跑不动。上下文稍微长一点就开始丢信息、忘前情、已读乱回。 科大讯飞这次想把这个矛盾解决一下。 9月1日,科大讯飞全资子公司词元星火正式开源星火 X2.5-4B 和星火 X2.5…
旗舰大模型本地部署,硬件门槛又降了一截。 9月1日,腾讯混元团队发布 Hy4 preview 轻量版,将模型权重从接近 1.5TB 压缩至约 214GB,体积压至原来的七分之一左右。 两项核心技术,不是「一刀切」量化 这次压缩用了两项自研技…
7 月 31 日,特斯拉中国正式向 Model 3、Model Y、Model S、Model X 全系车型分批推送 2026.14.13 版本车机软件更新。这次更新最大的看点,是字节跳动旗下的豆包大模型正式上车——从今往后,中国特斯拉车主…
8 月 6 日,DeepSeek 开放平台发布公告:「计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。」消息一出,AI 从业者圈子里立刻炸了锅——毕竟在过去的几个月里,Dee…
2026年7月19日,上海世界人工智能大会(WAIC 2026)现场,阿里巴巴正式发布通义千问旗舰模型 Qwen 3.8-Max 预览版。这款采用 MoE(混合专家)架构的多模态大模型总参数规模高达 2.4 万亿,被阿里官方定位为̶…
2026年7月21日,Google 悄悄在 AI Studio、Vertex AI 以及部分早期用户体验界面上线了 Gemini 3.6 Flash 和 Gemini 3.5 Flash Lite 两款模型。作为 Gemini 3.5 Pr…