中国电信开源 Xing4.0-29B-A4B:全栈国产,消费级显卡跑 512K 上下文
中国电信把”全栈国产”四个字走成了闭环。9 月 17 日,中国电信端出新一代星辰大模型 Xing4.0-29B-A4B:总参数 29B、激活参数仅 4B,原生吃下 256K 上下文、还能扩展到 512K,是国内首个从…
中国电信把”全栈国产”四个字走成了闭环。9 月 17 日,中国电信端出新一代星辰大模型 Xing4.0-29B-A4B:总参数 29B、激活参数仅 4B,原生吃下 256K 上下文、还能扩展到 512K,是国内首个从…
把十亿参数级的视觉—语言—动作模型(Vision-Language-Action,VLA)塞进移动机器人,本质上是一场系统冲突:语义推理天然想吃云端 GPU 的算力,闭环控制却必须在本地及时响应网络延迟和抖动。CloudEdgeVLA 给出…
2026 年 9 月,TypeSafe AI 正式发布旗下首个 System One 模型 Jev。它不是又一个聊天机器人,而是一个专为软件系统自动决策设计的 AI 模型:输入程序状态和预定义问题后,直接返回结构化决策结果及置信度概率,供软…
9 月 18 日,智谱正式上线 GLM-5.3-FlashX。新版本将推理速度提升至最高 200 tokens/s,较上一代 GLM-5.3-Flash 提速 5 倍,定价同步提升至原版的 2.5 倍。API 已全面开放,Model Key…
豆包Pro全量上线:支持500+子Agent并发调度,能一次性读懂28万行Java老系统,Token消耗降30%+,企业AI落地成本大幅下降。
微信不只想做 AI 功能的入口——它开始自己做模型了。 8月12日至13日,腾讯微信团队正式在 X 平台公布了大语言模型系列 WeLM(WeChat Large Language Model),主打资源效率,面向微信生态内的 AI 规模化落…
AI 实验室买显卡不稀奇,但现在开始按「吨」囤 Mac mini 了。 据 The Information 报道,OpenAI 过去数月采购了数万台苹果 Mac mini 和 Mac Studio,专门用于训练 Computer-use A…
端侧模型之前有个痛点:参数小了跑得动,但处理不了长文本;参数大了跑不动。上下文稍微长一点就开始丢信息、忘前情、已读乱回。 科大讯飞这次想把这个矛盾解决一下。 9月1日,科大讯飞全资子公司词元星火正式开源星火 X2.5-4B 和星火 X2.5…
旗舰大模型本地部署,硬件门槛又降了一截。 9月1日,腾讯混元团队发布 Hy4 preview 轻量版,将模型权重从接近 1.5TB 压缩至约 214GB,体积压至原来的七分之一左右。 两项核心技术,不是「一刀切」量化 这次压缩用了两项自研技…