Artificial Analysis 评测显示,OpenAI 新发布的 GPT Image 2.5 Flare 和 Sunburst 包揽其 Image Arena 前两名,在低于 GPT Image 2 一半时间内生成更高质量图像,价格保持不变。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtxag5x702throukwt8vno1e
AI HOT
"我们现在离构建 AGI 近得多了,而在这个过程中,我们并没有学到任何关于智能的根本性新东西"--@RichardMCNgo 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9trgy0fmjroedge15zqat
Google DeepMind 联合哈佛、斯坦福等机构发表论文,主张通往 AGI 的路径可能是能记忆变化、预测结果并采取行动的视觉 AI。论文认为视觉系统应直接从图像、视频、3D 结构和交互中学习,理解存在什么、变化了什么、隐藏了什么及下一步可能发生什么,而非仅将视觉输入语言模型。作者呼吁停止主要用图像问答、字幕或逼真视频来评判视觉 AI。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9x6360fo5roedhxmrdeua
前 Google DeepMind 研究副总裁 Oriol Vinyals 在 Agentic AI Summit 2026 上表示,AI 递归自我改进不可避免但进程缓慢,不会出现突然的智能爆炸。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9fqss0bgoroed12jj7y2f
突发:Yale AI Association 在耶鲁大学以 Grok Bot 的现场演示开启了新学年。 该学生团体还宣布了一项为耶鲁打造实用应用的竞赛。Cursor 将活动带到校园,并为参会者提供一个月免费的 Cursor Pro。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9g8jw0biproedl2ruwjn0
红杉合伙人 Grady Buchanan 表示,Workday、Salesforce 和 ServiceNow 这类记录系统型 SaaS 受 AI 冲击更小。风险在于中间层的工作流应用,因为 AI 智能体正成为在核心数据之上执行工作的新一层。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9x6370fo6roedcqtq4jaj
程序员 Andy Balaam 发布视频《Feeling sad about AI》,讲述 AI 让他长期感到悲伤,甚至影响到日常生活与家庭关系。他认为悲伤源于编程被贬为过时技能、从业者遭到不尊重,并分别对热爱编程者、学习者与自己给出建议:编程思维与代码原理仍将有用,对编程的热爱不会被夺走。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9fif20bf6roed3otyxzjr
Anthropic 的 Boris Cherny 表示,Claude 编写的生产代码应比人类编写的代码有更高标准。Anthropic 为此设置了大量护栏,包括 lint 规则、测试、Claude 驱动的端到端测试、每日运行的 Claude 模糊测试器、自动化代码审查与安全审查、自动化代码重构等。缺少这些措施,代码库可能变得难以维护。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9h3og0bkiroedujiq4uvl
David Sacks 称 AI 末日叙事背后已有大量资金支持,而 Anthropic 若 IPO 会让这一资金来源进一步扩大。此番表态引用了前 Anthropic 研究员 Jacob Coxon 在 CBS News 的采访,他警告 AI 可能通过互联网自我复制到其他计算机、制造上万份协作副本,因此无法简单"拔掉插头"。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx9x6370fo7roedwqmav1aa
Grok 4.7 正式推迟了,遗憾。但好东西需要时间。 【引用 @elonmusk】:@farzyness Grok 4.7 还需要再等几天才能"出锅"。 我们在 RL 中可能对回复长度惩罚过度了(或者别的什么原因),因为它仍然过早放弃困难任务(而它明明能做!),而且在检查自身工作方面还不够严谨。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmtx8ulil0b0hroedbxn5gans