Qwen-UI-Agent 发布:阿里通义 GUI 智能体基座模型,100+ 真机 150+ 应用训练超越 GPT、Claude、Gemini
结论先行:阿里通义推出 GUI 智能体基座模型 Qwen-UI-Agent,覆盖手机、电脑、网页以及深度搜索四类场景。它的训练数据来自 100+ 台真机与 150+ 应用,在 MobileWorld、OSWorld、WebArena 等多项…
结论先行:阿里通义推出 GUI 智能体基座模型 Qwen-UI-Agent,覆盖手机、电脑、网页以及深度搜索四类场景。它的训练数据来自 100+ 台真机与 150+ 应用,在 MobileWorld、OSWorld、WebArena 等多项…
结论先行:微软推出升级版编程模型 MAI-Code-1.1-Flash,在代码能力、速度和价格三个维度同时做了大幅调整——Terminal-Bench 2.1 测试表现提升 22%,.NET 任务提升 15%,Token 生成速度提升 25…
结论先行:阿里通义把 Qwen-Audio-3.0 系列三款语音模型一次性推上千问 AI 平台,开发者可以通过 API 或 Token Plan 两种方式调用。这不是单模型的版本号刷新,而是把「听清—说话—实时对话」这条链路拆成了三款可以独…
结论先行:李飞飞旗下 World Labs 推出了 Atlas,官方定位为全球首个多模态世界模型。它采用多模态自回归扩散 Transformer 架构,支持像素级相机控制生成图像与视频、3D 场景重建以及时空模拟;据公布的信息,Atlas …
结论先行:阿里千问联合淘天集团开源了电商经营评测基准 E-Commerce Bench。它的设计思路很直接——给每个模型 10 万元本金,在真实市场数据里经营一家网店 365 天,覆盖选品、定价、供应商谈判、库存与促销全链路。据公布的信息,…
结论先行:商汤办公小浣熊移动端正式上线,iOS 与安卓版本同步发布。移动端不是桌面端的简化版,而是补上了”离开工位之后”这一环——手机发指令、电脑持续执行;离开工位也能随时查看、分享和接续成果;长按语音输入、松手即发…
结论先行:OpenAI 把实时语音模型 GPT-Live-1 放上了 API,核心变化是语音理解与语音输出被整合进同一个模型,并支持全双工对话——可以同时听和说,能处理打断、停顿与背景噪声。据 OpenAI 公布的信息,这一模型面向餐厅预订…
结论先行:国家超算互联网平台正在从”把算力卖给你”的资源池,转向”算力 + 智能体”一体化交付的服务平台。据曙光智算总裁何牧君在 2026 算力网发展大会上披露,平台注册用户已超 170 万,…
结论先行:阿里千问团队于 2026 年 9 月 20 日开源 Qwen-Image-2.1,把一个「文生图 + 图像编辑」合一的图像模型放进单个权重里——视觉生成部分只有 7B 参数(32 层 Single-Stream DiT),并原生支…
一句话结论:阿里正式推出 QoderWake 1.0,产品定位是让企业像管理真实员工一样,对 AI 员工完成招聘、培训、授权与管理的全流程。它主张人与 AI 在同一组织内协作——人负责决策与把关,数字员工负责执行与推进,从而把优秀员工的能力…