MiniMax-M1 开源推理模型解析:4560 亿参数、100 万 Token 上下文,54 万美元完成训练
结论先行:MiniMax(稀宇科技)在 2025 年 6 月 17 日发布的 MiniMax-M1,是一枚主打开源的大规模混合架构推理模型。它把参数量做到 4560 亿(456B),上下文输入上限拉到 100 万 Token,推理输出长度做…
结论先行:MiniMax(稀宇科技)在 2025 年 6 月 17 日发布的 MiniMax-M1,是一枚主打开源的大规模混合架构推理模型。它把参数量做到 4560 亿(456B),上下文输入上限拉到 100 万 Token,推理输出长度做…
一句话结论:2025 年 3 月 16 日,百度推出新一代原生多模态基础大模型文心大模型 4.5,在文心一言官网免费开放,并通过千帆平台开放 API——输入价格低至 0.004 元/千 tokens,输出 0.016 元/千 tokens。…
一句话结论:MoonshotAI 开源的音频基础模型 Kimi-Audio,用「音频分词器 + 音频大模型 + 音频去分词器」的三段式集成架构,把语音识别、音频理解、音频转文本和语音对话四类任务收进同一个模型,在 LibriSpeech 测…
一句话结论:2025 年 3 月 4 日,智谱发布 CogView4,这是全球首个支持生成汉字的开源文生图模型,在 DPG-Bench 基准测试中综合评分排名第一,达到当时开源文生图模型的最先进水平(SOTA),并遵循 Apache 2.0…
一句话结论:OpenAI 在 2025 年 8 月 5 日推出开放权重模型系列 GPT-OSS,包含 GPT-OSS-120B 与 GPT-OSS-20B 两款,均采用 MoE 架构与 Apache 2.0 协议,原生支持最长 128K t…
一句话结论:蚂蚁集团在 2025 年 11 月 18 日发布的全模态 AI 助手「灵光」,把「说一句话生成一个能用的小应用」压缩到最快 30 秒,并用对话、闪应用、开眼三大模式覆盖文字、图像、语音、视频、3D 模型、动画六类模态。它瞄准的不…
结论先行:Tabbit 不是装了 AI 侧边栏的传统浏览器,而是把 Agent、妙招、脚本三套能力做进浏览层,让浏览器从”看网页的工具”变成”干活的平台”。2026 年 3 月 2 日,美团旗…
如果你一直想要一个不用翻墙、能读中文资料的 NotebookLM,网易有道给出了一个答案。网易有道近日推出 AI 知识管理工具「有道宝库」,定位为“你的 AI 研究助手和思考伙伴”,目前已开放公测。它支持 50 余种来源的内容导入,官方强调…
多数 AI 产品在做“更好用的工具”,美团则做了一次反向尝试:给 Agent 一个身份,让它在社区里成长。美团基础研发的 AI 创新产品团队推出 AI 原生社区产品「觅游」(Meyo),目前已进入公测阶段,官方定位是“一个属于人和 AI 的…
结论先行:Skywork AI 推出的 SkyClaw-v1.0 不是一款用来聊天的模型,而是一款明确为 Agent 工作流设计的长上下文模型。官方页面信息显示,该模型于 2026 年 5 月 19 日发布,支持 1M token 上下文,…