阿里千问发布 Qwen-Audio-3.1 系列五款语音模型并全线降价
千问发布 Qwen-Audio-3.1 系列语音大模型,包含 ASR、ASR-Next、TTS、TTS-Next 和 Realtime 五款模型,覆盖语音识别、合成、实时交互和音频创作。
值得看新能力已经进入可体验阶段,值得关注对现有工作流的影响。
OpenAI 发布 GPT-6 系列两款新模型 GPT-6 Sol 与 Luna,API 定价相比 GPT-5.6 促销价下调约 50%,Sol 为每 1M tokens 输入 $2、输出 $10,Luna 为 $0.10、$0.50,两者已上线 API。
模型动态
千问发布 Qwen-Audio-3.1 系列语音大模型,包含 ASR、ASR-Next、TTS、TTS-Next 和 Realtime 五款模型,覆盖语音识别、合成、实时交互和音频创作。
值得看新能力已经进入可体验阶段,值得关注对现有工作流的影响。
OpenAI 用内部 LLM 生成纳维-斯托克斯问题的证明后,数学界指出其解法依赖外部力项这一漏洞,偏离了数学家真正关心的无外力版本。上周四三位数学家发文证明去掉外力后爆炸消失,OpenAI 的方法无法扩展到完整问题,但按 Clay Institute 2000 年原始表述的选项 C,其解法成立。
值得看它会影响模型能力边界、成本或接下来的技术选型。
Kyutai 发布 Voice of Reason,两个基于 GLM-4-Voice-9B 的开源权重语音到语音模型,无需转写和独立文本 LLM 即可口头解数学题。
值得看开放权重或代码降低验证门槛,团队可以更快评估与落地。
Epoch AI 估算,自 2023 年以来达到固定基准分数的 AI 成本每季度下降约 47%,约合每年 13 倍降幅。在 GPQA Diamond 上,OpenAI 的 o3 需要 75% 分数约每题 $0.30,不到 18 个月后 GPT-5.6 Luna 以 $0.0004 达到同等水平,成本下降 725 倍。
值得看新的评测口径会影响模型选型,也能暴露旧基准忽略的能力。
Cisco Talos 于 9 月 22 日披露针对 Windows 11 的 AI 恶意软件 ClosedQuorum,它基于 Go 语言打造,调用谷歌 Gemini、DeepSeek、Qwen 和 Mistral 等模型,在入侵设备后无需人类操作员即可通过投票机制自主决策下一步攻击。
值得看它会影响模型能力边界、成本或接下来的技术选型。
作者基于向美国国会的报告整理开源权重模型现状:中国模型自2025年7月起在 Hugging Face 下载量领先约1.6B(总计3.2B),AAII 基准前三为中国模型(GLM-5.3 得分45、Kimi K3 得分44),领先美国最高分模型(26)约2-6个月。
值得看开放权重或代码降低验证门槛,团队可以更快评估与落地。
BestBlogs 早报本期精讲 Anthropic 发布 Claude Opus 5.5,典型任务运行成本较 Opus 5 低 40%,缓存读取价格下降 60%,输出速度提升超 30%。
值得看新能力已经进入可体验阶段,值得关注对现有工作流的影响。
Anthropic 发布 Claude Opus 5.5,OpenAI 随后发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 两款价格为其 GPT-5.6 对应型号的一半,GPT-6 Luna 低至 $0.10/M 输入、$0.50/M 输出;Opus 5.5 降价 20% 至 $4/$20,缓存读取降 60%。
值得看新能力已经进入可体验阶段,值得关注对现有工作流的影响。
Artificial Analysis 测算 Claude Opus 5.5 (max) 每 Intelligence Index task 成本为 $5.98,与 Opus 5 (max) 的 $5.86 接近。Opus 5.5 token 用量上升单独会使成本升至 $10.51,但 Anthropic 基础价格下调 20%($5/$25 降至 $4/$20)降至 $8.41,缓存读取降至 $0.20/1M 再降 29% 至 $5.98。
值得看它会影响模型能力边界、成本或接下来的技术选型。
Artificial Analysis 发文指出,GPT-6 Sol 和 Luna 在 Intelligence Index 中得分与各自前代相近,但 token 定价下降约 50%,将单任务成本减半。其图表展示了各代 OpenAI 模型在智能与单任务成本之间的权衡曲线。
值得看新的评测口径会影响模型选型,也能暴露旧基准忽略的能力。