agentic-eCAL 实测多智能体能耗:跨 5G 与光链路的文本传输仅占 0.25%,成本在 GPU 推理
agentic-eCAL 把能耗度量从单次推理推广到多智能体工作流,实测结论相当反直觉:跨 5G 无线接入网、城域网与光链路传输智能体之间的文本,只占整个工作流能耗的 0.25%。真正的能耗大头是通信所诱发的额外推理与上下文处理——多一次协…
agentic-eCAL 把能耗度量从单次推理推广到多智能体工作流,实测结论相当反直觉:跨 5G 无线接入网、城域网与光链路传输智能体之间的文本,只占整个工作流能耗的 0.25%。真正的能耗大头是通信所诱发的额外推理与上下文处理——多一次协…
2026 年 8 月 26 日,阿里通义千问团队正式发布全新多模态 MoE 模型 Qwen3.8-Flash:主模型参数量 125B,额外配备 51B N-gram Embedding,每 Token 仅激活 6B 参数,原生支持 262,…
独立开发者 yetone 开源的 Cumora 将 AI 智能体作为正式团队成员纳入协作,共享成员列表/群聊/看板/日历,首日 948 Stars,目前 3700+ Stars,MIT 协议开源。
宇树科技于9月10日开源 UnifoLM-WLA-1.0,6B参数基于2500小时真机数据训练,单模型统筹64项任务,覆盖桌面操作和全身移动操作,不绑定单一末端执行器。注意:代码、模型、数据集目前仍显示 Coming soon。
端侧模型之前有个痛点:参数小了跑得动,但处理不了长文本;参数大了跑不动。上下文稍微长一点就开始丢信息、忘前情、已读乱回。 科大讯飞这次想把这个矛盾解决一下。 9月1日,科大讯飞全资子公司词元星火正式开源星火 X2.5-4B 和星火 X2.5…
旗舰大模型本地部署,硬件门槛又降了一截。 9月1日,腾讯混元团队发布 Hy4 preview 轻量版,将模型权重从接近 1.5TB 压缩至约 214GB,体积压至原来的七分之一左右。 两项核心技术,不是「一刀切」量化 这次压缩用了两项自研技…
做个盲测。 给你 1000 份乱糟糟的文档,有扫描件、有 PDF、有表格、有图表,有中文有英文有日文。现在你问一句「这份合同里违约金是怎么算的」,模型要找出最相关的那一页。 传统做法是什么?先跑 OCR 把图片转成文字,切块,向量化,进向量…
腾讯混元 Hy4 preview 发布:770B 参数、1M 上下文,开源阵营再添狠角色 8月28日,腾讯混元悄无声息地扔出了一颗炸弹。 新一代大语言模型 Hy4 preview 正式发布并开源,总参数 770B、激活参数 49B,上下文长…
英伟达已经同意收购 Hugging Face,129 亿美元,约合人民币 867 亿元。这是 The Information 8 月 27 日的独家消息,如果最终敲定,将是英伟达历史上最大的一笔收购,也意味着开源 AI 生态最核心的那块拼图…
上个月小红书那个在 IMO 拿满分 42 分的 dots-note-3.0,大家应该还有印象。那是 AI 第一次在国际奥数竞赛拿到官方认证的满分,当时社区问得最多的就是什么时候开源。8 月 14 日,小红书 dots 实验室给了答案,dot…