腾讯混元 Hy4 preview 发布:770B 参数、1M 上下文,开源阵营再添狠角色
腾讯混元 Hy4 preview 发布:770B 参数、1M 上下文,开源阵营再添狠角色 8月28日,腾讯混元悄无声息地扔出了一颗炸弹。 新一代大语言模型 Hy4 preview 正式发布并开源,总参数 770B、激活参数 49B,上下文长…
腾讯混元 Hy4 preview 发布:770B 参数、1M 上下文,开源阵营再添狠角色 8月28日,腾讯混元悄无声息地扔出了一颗炸弹。 新一代大语言模型 Hy4 preview 正式发布并开源,总参数 770B、激活参数 49B,上下文长…
英伟达已经同意收购 Hugging Face,129 亿美元,约合人民币 867 亿元。这是 The Information 8 月 27 日的独家消息,如果最终敲定,将是英伟达历史上最大的一笔收购,也意味着开源 AI 生态最核心的那块拼图…
上个月小红书那个在 IMO 拿满分 42 分的 dots-note-3.0,大家应该还有印象。那是 AI 第一次在国际奥数竞赛拿到官方认证的满分,当时社区问得最多的就是什么时候开源。8 月 14 日,小红书 dots 实验室给了答案,dot…
DeepSeek Harness 开源还不到一周,GitHub 已经冲到 9 万多星。社区比官方还兴奋,插件目录站 dshplugin.dev 收录了 937 个项目,加起来 5.4 万颗星,最近 24 小时就有 465 个更新。这增长速度…
8月14日,智谱正式发布 GLM-5.3。这个版本有个很反直觉的地方,基座模型和 GLM-5.2 完全一样,7430 亿参数的底座动都没动,所有的提升全部来自后训练。 智谱把这套打法叫后训练 Scaling。数十倍规模的长程任务环境、更丰富…
8月13日晚上,DeepSeek 一口气干了三件事。先是公布 API 调价方案,几个小时后,V4 Pro 正式版悄悄上线,再晚一点,Harness 团队顶着那只黑鲸头像发了第一条推文,宣布 DeepSeek Harness 开发者预览版开放…
8 月 13 日早上,阿里千问大模型团队把 Qwen3.8-2.4T-A95B 的模型权重挂上了 Hugging Face 和魔搭社区。十天前 Qwen3.8-Max 发布时承诺的开放权重,说到做到了。这也是千问家族第一次把 Max 级别的…
8月10日,Meta Superintelligence Labs 正式发布并开源了 Muse Glimmer——一个约 30B 参数(精确约 29.6B)的开源智能体模型,专为“始终在线的本地代理工作流”(always-on local …
8月5日,清华系AI视频团队Sand.ai正式发布并开源了视频生成模型MAGI-2 Preview。这是全球首个千亿级开源MoE视频生成模型,总参数约114B(1140亿),采用MoE(混合专家)架构,单次前向计算仅激活约6B参数,激活比例…
8月3日,阿里云千问团队正式发布了 Qwen 家族迄今最强大的模型 Qwen3.8-Max,并宣布了一个重磅决定:下周开源模型权重,同时开源的还有 Qwen3.8-27B。这是 Qwen-Max 级别模型历史上第一次向社会开放权重,意味着阿…