AI资讯
8月11日周二
TODAY'S SIGNAL

编写智能体时,哪种编程语言最合适?

针对"动态语言比静态语言更省 LLM token"的流行说法,作者用 GPT-5.6 Sol 让智能体实现 zstd 解码器进行实测。结果显示,medium 努力度下动态语言表现更好,ultra 下静态语言反而更优,且此前评测存在测试路径错误等缺陷。作者认为,琐碎任务上的性能无法推广到更大问题。

为什么重要新的评测口径会影响模型选型,也能暴露旧基准忽略的能力。
Hacker News 热门(buzzing.cc 中文翻译)16 个信源正在报道阅读更多

模型动态

X:阿易 AI Notes (@AYi_AInotes) · 1 小时前模型

字节 Seedance 2.5 免费开源提示词文档

字节 Seedance 2.5 与 Seedream 5.0 Pro 的提示词文档免费开源,内含几十套完整案例,覆盖盛唐 30 秒长镜头、废土科幻一镜到底等场景。视频支持 30 秒生成、时间戳指定镜头动作,最多吃 30 图 + 10 视频 + 10 音频参考;生图支持高密度信息图与商用级人像。官方将专业分镜、运镜、负面词方法论拆成可直接复制的 Prompt,替代传统分镜师与后期团队一周的工作。

值得看开放权重或代码降低验证门槛,团队可以更快评估与落地。

X:Deedy Das (@deedydas) · 37 分钟前模型

AI文本水印技术与欧盟AI法案合规现状

AI文本水印检测无法做到完美,约400 token时真阳性率约90%(假阳性率<1%)。欧盟AI法案第50(2)条要求所有模态AI生成内容可检测,第113条规定2026年8月2日起适用。Claude宣布合规,Gemini已用SynthID,OpenAI曾搁置水印方案但表示将扩展溯源信号至文本。

值得看它会影响模型能力边界、成本或接下来的技术选型。

X:蚂蚁百灵 (@AntLingAGI) · 2 小时前模型

蚂蚁百灵 Ling-3.0-flash 单机跑出 38.7 tok/s

蚂蚁百灵 Ling-3.0-flash 124B 在单台 DGX Spark 上实现 38.7 tok/s(官方 int4 量化),社区 GGUF 为 35.2 tok/s,速度达 DeepSeek V4 Flash 同硬件成绩的 2.4 倍。该模型支持完整 256K 上下文,并能在智能体循环中一次性写出可运行代码,被评测者视为单机最快的 124B 级本地模型。

值得看新的评测口径会影响模型选型,也能暴露旧基准忽略的能力。

X:Rohan Paul (@rohanpaul_ai) · 3 小时前模型

Meta Muse Glimmer-30B 击败 Gemma 4 31B

Meta 开源 Muse Glimmer-30B 在三个街机游戏生成任务中击败 Gemma 4 31B。测试在 Atomic Chat 桌面应用本地运行,每模型各用一块 RTX 5090(32GB VRAM)。Glimmer 游戏还原度高,但代价高昂:耗 83.4K tokens、17.7 分钟,而 Gemma 仅 17.8K tokens、4.5 分钟。

值得看开放权重或代码降低验证门槛,团队可以更快评估与落地。