全部资讯

重置筛选
Steef-Jan Wiggers
Steef-Jan Wiggers
Foundry Model Router Expands from Two Regions to 28, Refreshing Its Model Pool

微软将 Azure AI Foundry 中的 Model Router 从仅 East US 2 和 Sweden Central 两个区域,扩展到全球标准部署的 28 个区域以及数据区部署的 21 个区域,并刷新其底层模型池。模型池新增 Anthropic Claude Opus 4.8 与 GPT-5.6 系列,因 gpt-5-chat、gpt-5.2-chat、gpt-5.3-chat 和 DeepSeek-V3.1 达到生命周期终点而被移除。使用默认 Balanced 配置的团队无需重新部署即可自动获得更新;自定义子集的团队则不受影响。路由支持 Balanced、Quality、Cost 三种模式,切换最长需 5 分钟。上下文窗口以池中最小模型为准,且路由决策仅基于文本、拒绝音频输入。Claude 模型需预先以匹配 SKU 部署到同一 Foundry 账户才能被路由选中,否则报 InvalidResourceProperties 错误。公告未提供准确率、成本或延迟对比数据,微软建议通过开源 foundry-model-router-autoeval 流水线进行基准评估,每次响

Scott Jenson
Scott Jenson
Scott Jenson谈桌面操作系统的演进、Local-First与智能体式UX

InfoQ播客主持人Olimpiu Pop对话资深UX设计师Scott Jenson,讨论桌面操作系统二十年来的停滞现状与未来演进方向。Scott Jenson曾参与Macintosh System 7、Google Mobile Maps首版及Chrome项目,他指出苹果近年新增功能主要服务于生态锁定而非提升用户生产力,移动设备虽赢得消费市场却未能取代桌面在复杂生产力场景中的地位,平板则偏向消费而非创造。他提出Local-First架构应对云端时代的隐私与脆弱性问题,确保数据主权并抵御断网与AWS类故障影响。Scott批评当前大型科技公司以生态锁定和15%抽成为核心、忽视用户赋权的设计取向。在桌面交互层面,他提出"直接操控之诅咒"概念——现有界面是无状态操作,缺乏历史记忆,因此他设计了三个原型探索未来桌面的工作记忆机制:空间型窗口管理利用大屏优势、情景型记忆追踪用户活动历史、关联型模型通过索引与元数据实现上下文延续。节目还涉及LLM集成方向,主张从通用聊天机器人转向嵌入应用流程的智能体式界面。

Shijin Nair
Shijin Nair
使用 Workload Identity Federation 消除 GCP 中的长期凭证

InfoQ 文章介绍作者如何在 Google Cloud Platform(GCP)上以 Workload Identity Federation(WIF)替代长期服务账号密钥的实践经验。作者首先指出传统 JSON 密钥模式带来密钥泄露、轮换复杂和审计困难等问题,随后说明 WIF 通过"信任关系"取代"秘密持有",由工作负载身份池、提供商/连接器和服务账号绑定三部分构成,并以 OIDC 为通用机制。文章重点分享其组织在六个月内部署到 120 多个 GCP 项目的做法:在新项目创建阶段强制启用 WIF,而非回溯迁移存量无过期密钥,使遗留密钥成为固定且逐步缩小的存量风险。作者详细拆解了 GitHub Actions、Harness 流水线和 AWS Lambda/ECS 等外部工作负载接入 GCP 的流程,强调属性条件中的 CEL 表达式是身份层最后的安全关卡,并解释了 AWS 通过 STS GetCallerIdentity 让 GCP 验证身份的链式签名机制。整体结论是,强制在创建点启用 WIF 比大规模改造存量更安全、更可扩展。

极客洞察
极客洞察
🤔 240M 域名 autocomplete 的 0ms 争议

原标题:《P99 0 ms* autocomplete for 240M domain names》 评分: 131 | 作者: dbalatero 💭 把延迟改名成 keyup,就能假装成 0ms 了吗? 🎯 讨论背景 这篇讨论围绕一个声称支持 2.4 亿域名、并把 p99 做到 0ms 的 domain autocomplete 工具展开。它依赖预先构建的数据结构和缓存来尽量减少查询等待,但评论指出域名空间本身并不容易完整枚举,因为只有部分 gTLD(通用顶级域名)会公开 zone file,而很多 ccTLD(国家/地区代码顶级域名)不会。于是作者实际采用了热门域名、已知注册域名和 TLD 后缀补全的混合策略,这也引发了“结果真假难辨”的争议。评论还把话题延伸到前端输入事件的语义差异、键盘与鼠标的交互惯例,以及 Cloudflare R2(对象存储)和 CDN(内容分发网络)能否进一步压低延迟。 📌 讨论焦点 TLD 补全让真假域名混在一起 不少人指出,这个 autocomplete 会在输入垃圾字符串时依然给出看起来像真域名的结果,容易让人误以为这些域名存在。作者解释说,

noreply@aihot.virxact.com (IT之家(RSS))
noreply@aihot.virxact.com (IT之家(RSS))
智谱 2026 年上半年营收 9.54 亿元同比增长 399.7%,归母亏损收窄至 20.71 亿元

智谱 2026 年上半年实现营业收入 9.54 亿元,同比增长 399.7%,云端部署收入占比提升至 86.5%,开放平台及 API 业务收入同比增长超 27 倍。期内归母净亏损 20.71 亿元,同比收窄 12.1%,经调整净亏损率同比收窄 3.5 倍。MaaS 平台用户数超 740 万,较年初增长 144%,付费日活用户增长 603%。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmth5ohcg03j0rodm8pmgawws

noreply@aihot.virxact.com (X:腾讯混元 (@TencentHunyuan))
noreply@aihot.virxact.com (X:腾讯混元 (@TencentHunyuan))
腾讯混元Hy4动画效果获赞

太棒了 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmth4ksjd02strodmk8uwnwvm

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))
noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))
Perplexity Mac 将推混合模式,本地模型处理子任务

Perplexity 即将在 Mac 端推出 Hybrid 混合模式,由云端 Computer 编排并将合适子任务委托给本地模型处理。当前支持 Gemma 4(16GB 机型)、Qwen3.6 及 Perplexity 自研模型(32GB 机型)。该模式还内置 Privacy Gate 小模型,可在数据上传云端前检查并拦截个人敏感信息。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmth5aai9038arodm9euiyys5

noreply@aihot.virxact.com (The Decoder:AI News(RSS))
noreply@aihot.virxact.com (The Decoder:AI News(RSS))
OpenClaw 2.0 发布:简化设置、重构浏览器应用并支持多人会话

OpenClaw 基金会发布开源 AI 平台 2.0 版,为迄今最大更新,包含超 16,000 个拉取请求。新版本简化首次设置,可自动检测 ChatGPT 或 Claude 订阅、API 密钥及本地模型;浏览器应用完全重构,新增显示会话进度的 Session Rail 功能。共享云会话支持多人协作,会话可在本地网关、配对设备或 Crabbox 租用的临时机器上运行。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmth4mflf02urrodmtgth9y3r

noreply@aihot.virxact.com (X:赵纯想 (@chunxiangai))
noreply@aihot.virxact.com (X:赵纯想 (@chunxiangai))
赵纯想为AI项目寻投资,征集盈利产品

赵纯想发文称有位大哥想投资AI项目,但认为"laper"作为文人生产力不够标准化,非AI最佳战场。他邀请推友在评论区留下盈利且"性感"的项目体验链接,寻求投资机会。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmth42qo302a9rodmr8cj421x

加载更多资讯