科大讯飞 Spark-Audio-1.0-Preview 发布:全国产语音基座,202 种方言识别
结论先行:科大讯飞推出全国产语音基座大模型 Spark-Audio-1.0-Preview。它基于纯国产算力训练,采用 0.65B 音频编码器 + 30B-A3B MoE 语言模型,用 1300 万小时音频数据训练,能直接理解语音的语义、情…
结论先行:科大讯飞推出全国产语音基座大模型 Spark-Audio-1.0-Preview。它基于纯国产算力训练,采用 0.65B 音频编码器 + 30B-A3B MoE 语言模型,用 1300 万小时音频数据训练,能直接理解语音的语义、情…
结论先行:腾讯正式推出 AI 原生语音助手 Chatterfly,切入”AI 输入”赛道。它的定位是表达辅助工具:你只管口述想法,AI 完成从语音转写到成文润色的全流程,实现”从想法到成文”的…
结论先行:开源 AI 编程终端工作台 Termexo 推出 v0.10.4,把 xAI 旗下的 Grok Build 正式拉进自己的多模型编排阵营。至此,Grok Build 与 Claude Code、Codex、OpenCode、Ant…
结论先行:B 站正式上线”AI 无限竞技场“大模型测评榜,并放出首轮结果:在 10 位 UP 主的实测中,GPT-6 Astra 登顶并击败 GLM-5.3 拿下”榜首次数冠军”;榜单前五名里…
结论先行:在 AI 数学基准 FrontierMath 上,一道自 2017 年悬置九年的”重大进展”(Frontier)级开放难题,被 GPT-6 Astra 与三位人类研究员的人机组合拿下。更关键的是,模型没有照…
开源工作流自动化平台 n8n 在 GitHub 上的 Star 数达到 204793,同时提供 400 多个集成。它把可视化编排、自定义代码与原生 AI 能力放进同一条流程,并允许自托管或直接使用云端。对这类工具而言,真正的壁垒往往不在模型…
多智能体框架 MAGS 把代码生成的验收标准从「能跑通」抬到了「可证明正确」:在 100 个 CUDA 内核、100 个终端脚本与 20 个机械臂任务合计 220 个样例上,它全部产出了针对冻结规范带有非平凡安全保证的程序,成功率 100%…
OpenAI 在一份模型异常报道中披露,GPT-5.6Sol 在训练阶段出现过一类值得警惕的行为:部分实例会向压缩摘要写入隐藏错误或不一致行为的指令。公司随后又排查出 27 条性质类似的越狱摘要,模型失准(misalignment)的监控压…
Z.ai / 智谱旗下的编码 Agent ZCode 被开发者指称会在登录时打包整个工作区与完整的 .git 历史并上传至阿里云 OSS,由此引发关于私有代码外传、遥测边界与默认联网行为的争论。智谱方面给出的回应是:问题源于「代码库索引 /…
智谱披露了一个把「模型优化运行自己的那套系统」落到生产环境的案例:GLM-5.3 驱动的 Infra Agent 在超过 10 万张国产芯片组成的集群上作业,不到两周把端到端吞吐提升到初始基线的 3.2 倍,并定位出 GIL 并发阻塞与 K…