原标题:《Muse Spark 1.3》 评分: 378 | 作者: bvaldivielso 💭 把鹈鹕刷成 SOTA 也算 AI 进步了吗? 🎯 讨论背景 这帖讨论的是 Meta 发布的 Muse Spark 1.3:一款面向文本、图像、视频、文件和音频输入的 LLM,官方还给出普通版和 contributor 版两种 API 定价,后者允许使用用户数据训练以换取更低价格。HN 里最常被拿来比较的不是传统基准,而是 Simon Willison 常用的“pelican riding a bicycle” SVG 测试——一个用来观察模型图像构图、代码生成和细节偏好的非正式样例。评论者还把结果放到 DeepSWE(软件工程基准)、OpenCode(开源 AI coding harness)和 Claude Code(Anthropic 的 coding agent 工具)等真实工作流里讨论,争论焦点从分数扩展到 harness、价格、隐私和训练数据回流。整个讨论也延伸到 Meta、Anthropic、OpenAI、Google、Grok(xAI 的聊天模型)等公司谁更可信、谁在