每日 AI 快讯

“每日 AI 快讯”栏目的最新文章。

英伟达发布免费工具 PAIR:把闲置电脑变成个人 AI 算力池

英伟达推出开源软件 Personal AI Router(PAIR),可自动发现并连接局域网内的多台电脑,将分散的 GPU 整合成统一算力池,供本地 AI 推理使用。它不是硬件路由器,目前兼容 Nvidia RTX 20 系及以上显卡,以及苹果 M4 芯片及更新型号。 名字带"路由器",其实是一款…

Cursor 自托管机器上线:Agent 工具调用可完全留在内网

摘要:Cursor 推出“自托管机器”能力,让 AI agent 的执行任务跑在用户自己的基础设施上,代码、构建产物与机密信息无需再离开内网。通过动态池调度,机器可按需扩缩、闲时休眠,为注重数据隐私的团队提供了更可控的 AI 编程执行环境。 自托管机器解决了什么问题? 很多团队在尝试 AI 编程助…

大语言模型时代下的编程语言与类型安全

我不得不承认,智能体编程(agentive coding)已经是大势所趋,尽管我仍然觉得它有点被高估了。不过,Elon Musk 比我看得更乐观。他认为有了大语言模型(LLM),编译器将变得多余,甚至还放出过这样的言论: 也许到今年年底,事情就会发展到你根本不需要费心去写代码的程度。 AI 直接…

Copilot 代码审查现已支持批准拉取请求

GitHub Copilot 代码审查功能迎来更新,现已可以直接批准拉取请求。此前 Copilot 主要提供审查意见,需要开发者手动确认;现在它能在符合设定条件时自动放行,减少重复性操作。这一改动旨在简化团队协作流程,让开发者更专注于需要人工判断的复杂问题。

Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线

无论你此前让Claude处理什么任务,Fable 5.1都能做更多,并且把最难的部分完成得更出色 梦晨 发自 凹非寺量子位 | 公众号 QbitAI 刚刚,Fable 5.1和Mythos 5.1发布! 8项公开基准测试全部第一,价格最高降45%。 尤其是在科学研究和代码这两项上,明显甩开了Fab…

fx 现已可在 AI SDK harness 层中使用

AI SDK 的 harness 层(编码代理的统一运行层)现在支持 fx——Vercel 推出的轻量级开源编码代理。该层为在应用中运行编码代理提供了统一 API,因此你可以直接接入 fx,而无需单独编写集成代码。 使用官方 @ai-sdk/harness-fx 适配器配置 HarnessAgent…

六个部分,一根主干

每个部分单独都很有用。它们之间的连接模式是冻结的,只允许增补,因此新代理或新检查可以插入,无需触碰主干。 存储与投影 每个仓库一个存储,并投影到每个代理自己的文件里——CLAUDE.md、AGENTS.md、.kiro、copilot-instructions。有两个哈希:一个在源头移动时变旧失效…

Power Leak:Amazon Kiro IDE 提示注入可导致数据外泄

Mindgard 在 Amazon Kiro IDE 中发现了一个数据外泄漏洞。这件事既展示了 AI 执行路径会带来哪些技术风险,也暴露出漏洞披露流程中的空白。 核心要点 - Amazon Kiro IDE 是一款 AI 辅助开发环境,存在可通过提示注入和 Kiro Powers 实现数据外泄的漏…

20ms把PDF变成Markdown!开源OCR神器快了近300倍

摘要:Firecrawl 团队开源了一款名为 OCR It 的浏览器插件,能在 20ms 内将 PDF 页面中的文字提取并转为 Markdown,速度比同类工具 Docling 快近 300 倍。本文介绍它的用法、效果与当前局限。 从 PDF 到 Markdown,只需 20 毫秒 曾经手动摘取…

Vercel CLI 新增 DNS、域名和项目管理命令

Vercel CLI 现在提供了专门用于管理 DNS 记录、域名和项目的命令。以前需要通过 Vercel 控制台和 API 才能使用的不少功能,现在可以直接在终端里操作了,既支持交互式使用,也能写进脚本或由代理程序调用。 查看和更新 DNS 记录 可以获取某条 DNS 记录的完整配置,也可以凭记录…

从 Vercel 控制台构建并部署 eve agents

现在你可以直接在 Vercel 控制台里创建 eve agents。创建完成后,你就能立刻得到一个已部署的 agent,并直接和它聊天。构建器会先搭好 agent 的骨架,把所有相关文件放进一个私有 Git 仓库,再作为你团队下的一个新 Vercel 项目完成部署。只需点几下鼠标,你就能获得一个可用…

攻破 Claude Code Opus 5 的 Auto 模式

在这篇文章中,我们将探讨一个简单的网页摘要请求,如何劫持运行在 Auto 模式下的 Claude Code Opus 5,并以小样本量实现 60-80% 的攻击成功率,最终达成代码执行。 这事有意思的地方在于,Anthropic 委托的第三方评估显示,Opus 5 在 Auto 模式下的提示注入攻击…

标题:Uno Platform 如何用 .NET、MCP 和 AI 构建高质量应用

原文: Uno Platform 如何用 .NET、MCP 和 AI 构建高质量应用 本文由 Sam Basu 撰写的客座文章。Sam 是技术专家、作家、演讲者、Microsoft MVP,同时也是 Uno Platform 的开发者布道师。如果你在过去几年里做过任何软件开发,你一定能感受到这种变…

Show HN:开源智能体协作平台,支持团队协同

Open Session 是一个开源的云端智能体编排平台,团队可以借助它完成代码发布、数据分析、客户沟通等各类工作。它支持在浏览器、Mac 和 Windows 上运行,iOS 版本也将很快推出。 Open Session 由 Tella 团队开发。我们想要一个完全贴合团队需求的编排工具,但市面上的现…

Cursor 现已接入 AI SDK 的 harness 层

AI SDK 的 harness 层现在正式支持 Cursor,通过官方适配器 @ai-sdk/harness-cursor 即可接入。harness 层让应用可以通过同一个 HarnessAgent 接口运行不同的编码代理(coding agent),这样你无需改动应用代码就能切换代理。使用方式很…

从零开始,无需仓库

Cloud Agents 现在不需要先连接 GitHub 或其他第三方代码托管服务(SCM)就能直接上手。你可以从一开始就用提示词指挥 Agent,之后再把成果保存到 Cursor Origin 仓库。 开始使用 在仓库选择器中选择 Start from scratch,然后直接向 Agent 下…

在 NVIDIA GB300 NVL72 上体验 Qwen3.8-Flash-Next 的智能体编码

阿里巴巴发布了 Qwen3.8-Flash-Next 的模型权重,这是即将推出的 Qwen4 架构的预览版本,供开发者试用和评估。它是一个多模态混合专家(MoE)模型,主模型有 125B 参数,另外补充了 51B 的 N-gram 嵌入参数,每个 token 激活 6B 参数。原生上下文窗口为 26…

我估算:读代码的成本是写代码的2.1倍

根据我的估算,人类审查一行代码改动的成本约为0.243美元,而AI智能体生成一行通过基准测试的代码,模型花费仅约0.114美元。在这些假设下,人工审查成本约为AI生成成本的2.1倍。本文详细拆解了两者的计算过程和依据。 估算背景 这个估算的出发点是:AI编程智能体已经能自动产出代码,但人工审查仍然…

Vercel 安全面板正式全面上线

Vercel 安全面板(Security Dashboard)现已面向所有套餐开放。现在,你可以在一个地方查看所有账号和项目的安全态势,既可以在网页界面里打开安全面板,也可以在 Vercel CLI 中运行 vercel security check 命令。 随着团队规模扩大,再加上编码代理(cod…

Vercel Connect 现已全面可用

Vercel Connect 现已面向所有套餐及 v0 全面开放。与存储长期有效的服务商密钥不同,你的代码只需在运行时请求短期、限定作用域的令牌。部署时沿用现有的 Vercel OIDC(OpenID Connect)身份进行认证。每个令牌仅作用于当前任务,自动刷新,到期自行失效。 一条命令接入任何…

告别智能体的凭证泛滥困境

任何真正好用的 agent 都会触及代码库之外的世界。它往 Slack 发消息、提交 pull request、查询 Snowflake,或是调用内部 API。正是这种“伸手”的能力让它变得有价值,但风险也随之而来——因为长期以来,要授予这种权限,就意味着要配置一个长期有效的令牌(token),然后…

Run SDK 发布:为智能体提供安全评估

智能体(agent)越来越多地会编写 TypeScript 程序来协调工具、处理返回结果。一旦这些程序接触到真实应用,有些步骤需要身份认证,有些则必须经过人工审批。如果直接用 eval 执行这类代码,代码会获得与所在应用同等的权限,包括访问密钥和内部服务,而且无法在这些边界处可靠地暂停。今天,我们正…

Claude Cowork 终于能记住你在 Chat 里说过的话了

图片来源:Anthropic Claude Cowork 终于能记住你在 Chat 里说过的话了 Claude 的记忆系统做了一次更新,解决了一个用 AI 智能体(agent)时最让人抓狂的问题——不用再反复向 AI 交代它本该已经知道的信息。周二,Anthropic 宣布将 Chat 和 Cla…

Chat SDK 现已支持 XChat

Chat SDK 现在已经支持 XChat 了。 借助 Chat SDK 新增的 XChat 适配器,你可以构建机器人在 XChat 上开展端到端加密的一对一和群组对话。加密、密钥管理和签名验证这些工作全部由适配器自动完成。只要用户开启了加密聊天并关注了机器人,机器人也可以主动给用户发消息。 XCh…

智能体技能是用什么语言写的?

论文信息 - 原文:arXiv:2608.10906 论文信息 - 原文:arXiv:2608.10906 摘要 2026 年第一季度,新编写的智能体技能中有 13.0% 使用的语言不是英语;一个季度之后,这个比例变成了 16.3%。也就是说,在三个月内,对 255,068 个技能样本而言,非英…

Agentic Resource Discovery(ARD):智能体发现的开放规范

AWS Agent Registry 与 ARD 规范如何为您的智能体提供跨环境发现能力 随着组织大规模使用人工智能(AI)智能体和工具,找到合适的资源反而成了难题。团队构建模型上下文协议(MCP)服务器、部署智能体、创建专用工具,但如果没有一个中央目录,这些资源就会被隔离在各个角落。开发者需要手动…

当代码变得廉价,判断力就是手艺

AI 编程工具不只是让工程师写代码更快,它正在重新定义「什么是好的软件工程师」 一位工程师正在审查 AI 智能体写的一段支付功能代码。代码看起来整洁,路由都搭好了,自动化测试也通过了。但他注意到一个严重的问题:重试路径没有保留支付请求的幂等键。通俗地说,如果数据库已经记录了扣款,但响应超时了,自动重…

Agent Harness 的演进

2025 年圣诞节前后,AI 工程师们注意到智能体(agent)出现了一个变化:它们开始真正能干活了。具体是为什么,很难说清。也许是假期里大家终于有空,能拿最新的模型配最新的智能体挨个试一遍;也许是模型跨过了一道能力门槛;也许是模型外面那层封装(wrapper)成熟了。 我这篇文章想论证的是:后两者…

Vercel CLI 扩展对 DNS、域名和项目命令的支持

Vercel CLI 现在新增了专门管理 DNS 记录、域名和项目的命令。此前只能在 Vercel 控制台和 API 中使用的许多功能,现在直接可以在终端里操作了,既能交互式使用,也能写进脚本,或交给智能体(agent)执行。 查看和更新 DNS 记录 你可以获取某条 DNS 记录的完整配置,也可…

模型用 Python 思考,却用 JavaScript 干活:AI 编程时代的语言错位

摘要:大模型训练离不开 Python,但生成真实产品代码时却以 JavaScript 为主。这种语言错位并非偶然,而是 AI 编程从实验室走向工程落地的必然结果。TypeScript 在这轮浪潮中受益最大,但最终跑在浏览器里的,仍然是 JavaScript。 训练与交付:两个不同的语言世界 大模型…

将 v0 应用连接到 Slack、Google 和 100 多项其他服务

通过 Vercel Connect,用 v0 构建的应用和智能体(agent)现在可以安全地连接 100 多项第三方服务,包括 Slack、Google、Notion、GitHub 和 Salesforce。你只需提示 v0 连接某个服务,它就会引导你完成连接器(connector)的设置。连接器归…

O'Reilly 来稿:智能体开发,规格说明写多少才合适?

我在关于智能体的讨论里反复看到同一个观点:详细的规格说明已经成了旧时代的额外负担。给模型一个粗略的目标,让它自己去探索,把返回的结果修一修,然后继续往前走。听起来很高效,但也把成本藏了起来。 一句简单的提示词(prompt)看起来又便宜又让人心动,因为它能让实现立刻启动。但紧接着就是一轮又一轮的纠错…

在 Amazon Bedrock AgentCore 中用自然语言编写 Dogwood 策略

AI 智能体(agent)能自动执行复杂的工作流,但如果没有适当的管控,它们也可能做出不符合企业策略或监管要求的操作。为此,我们在 Amazon Bedrock AgentCore 中加入了策略(Policy)功能,让团队可以对运行在 AgentCore 上的所有智能体统一实施管控。 最近,这一功能…

Vercel Agent 现已上线 Slack 代码频道

Vercel Agent 现在可以在 Slack 代码频道(code channels)中工作了。Slack 今天推出了这种新频道,专门用于和编码 Agent 协作。频道里的任何人都能跟进工作进度,给 Agent 下新指令,还能审查它写的代码。在 Slack 侧边栏选择“创建代码频道”,把 Agen…

在命令行中管理 Vercel Toolbar 评论

现在,你可以用 Vercel CLI 管理 Vercel Toolbar 评论了。vercel comments 命令覆盖了完整的评论处理流程: - 按当前 Git 分支筛选,列出关联项目中尚未解决的评论 - 查看完整的讨论串,包括每条消息及其 ID - 在终端里直接回复、解决、重新打开、编辑或删除…

Show HN:用于构建 AI 写作工作流的编辑器 UI 工具包

原文: 模型无关 · 服务端提示词 · 结构化文档上下文 · 同步、任务或自定义传输 在你的产品中构建 AI 辅助写作工作流 Redactor 提供文档编辑器和审阅 UI。你可以接入自己的后端、提示词和模型。 工作原理 模型返回数据,Redactor 将其转化为编辑工作流 Redactor 不依…

云代理与 Cursor 工具链改进

标题:Cloud Agents 与 Cursor 工具链的改进 我们还在继续打磨云代理(Cloud Agents)和 Cursor 本身的工具链,让常驻代理能够像一个完整的系统那样运作,自主完成软件的构建和交付,不必在每个循环节点都等人来干预。这次更新之后,云代理可以响应事件自动接手任务,把目标一直…

让 Agent 照看你的部署

部署是件吓人的事。就是那一刻,你会搞砸东西。 而不部署更吓人。等待只会让下一次部署变得更大。 俗话说:“如果疼,就多练。” 显而易见且正确的答案是持续交付(CD)。但接着你就得去构建金丝雀发布、波浪发布,还有用作闸门的自动化检测系统。金丝雀和波浪都容易,自动化检测系统却很难。可能出错的事情数不胜数,…

voyage-code-4:专为编程智能体打造的代码检索模型

作者: · voyage-code-4:专为编程智能体打造的代码检索模型 TL;DR——我们推出了下一代代码嵌入模型voyage-code-4,它专门针对编程智能体(coding agent)的性能提升和成本优化而设计。在一个专门衡量编程智能体代码检索效果的新基准测试中,它的表现比Cohere E…

Claude Code 2.1.234 更新:额度重置后自动恢复会话

Claude Code 2.1.234 版本带来一项便利更新:当用户的使用额度重置后,当前会话将自动继续,无需手动重新加载。此前用户达到限额后只能中断等待,新版本可无缝接续工作流,减少重复操作,提升开发效率。

解读智谱 GLM-5.3 评测结果:别只盯着头条数字

原文: 智谱的 GLM-5.3 评测结果已经公布,但数字背后的信息更值得玩味。 智谱发布的 GLM-5.3 技术报告中有一句话,多数新闻报道都没有提到。在描述自家网络安全测试结果时,这家北京公司写道:能力“增长最快的地方,恰恰是我们落后最远的地方”。 智谱(也以 Z.ai 名义运营)是少数几家发布模…

TDD-Agent:代码生成的测试驱动推理

论文信息 - 原文:arXiv:2608.16742 摘要 大型语言模型(LLM)在代码生成方面已经取得了显著进步,但在复杂的“仓库级”任务(需要理解整个代码库并完成修改的任务)中,如何保证生成结果的正确性仍然是一大难题。现有方法通常把模型自己生成的测试用例只当成事后的静态“验证器”——也就是代码…

理解债务:AI 写代码的真正代价

随笔 理解债务:AI 写代码的真正代价 你的代码库里有一个模块,是上个月上线的。它能跑,有测试,也通过了评审。但如果某天凌晨两点它出了问题,团队里没有一个人能说清楚它是干什么的。 在一个以 AI 为核心的代码库里,随便指着某个文件问一句“谁懂这块?”,诚实的答案往往是:没有人。这不是因为工程师变差…

Vercel 公开测试版支持部署 Cursor Origin 仓库

Pro 用户现在可以将 Origin 仓库连接到 Vercel。连接后,Origin 上的拉取请求会自动在 Vercel 生成预览部署,合并代码则会触发生产部署。你可以通过团队设置、项目设置,或在创建新项目时点击“Continue with Origin”来连接 Origin。也可以在 Origin…

面向 Cursor 仓库的应用扩展

Origin 代码托管 Cursor 现在可以托管你的代码了。Origin 今天开始在所有付费套餐中推出早期测试版。初期先提供最核心的功能,专为 Agent(AI 智能体)场景设计:仓库、Pull Request、代码浏览和 GitHub 同步。面向 Agent 的原生功能也即将上线。 Origi…

这个开源运行时旨在为 AI 智能体提供更像真实“计算机”的环境,而不是临时容器。按照 Cloudflare 的说法,它借助 Cloudflare isolates 实现快速无服务器执行,让智能体成本更低、速度更快,也更易于扩展。

Cloudflare Computer 要解决的是 AI 智能体部署中的一个大难题。Cloudflare 认为,依赖容器来运行智能体,规模很难扩展至“数亿乃至数十亿个并发智能体”,因为全球的计算能力根本不够。 为此,@cloudflare/computer 软件包引入了一种智能体运行时,由平台决定代…

验证验证者:独立审计如何强化 OpenWorkProof v0.5

这个东西是干嘛的(30 秒看懂版) 现在越来越多的情况是:"干活的人"是一个 agent(AI 智能体),"检查工作的人"也是一个 agent。当你因为一个 agent 的"保证"就去付款、合并代码、部署或发布,一个新的问题就出现了:谁来验证验证者? OpenWorkProof 是一个 Python…

智谱发布GLM-5.3:编码能力逼近Claude Fable 5,安全评测挖掘2404个漏洞

智谱AI今日发布新一代大模型GLM-5.3,在编码与智能体能力上进一步逼近Claude Fable 5,同时以84.5%的白盒代码审查得分登顶开源安全模型榜首。发布前团队联合多所高校与企业开展了大规模红队测试,累计发现覆盖220个项目的2404个漏洞,其中最早的代码缺陷可追溯到40年前。 在Deep…

Cloudflare 如何识别 MCP 流量并保障其安全

标题:Cloudflare 如何识别并保护 MCP 流量 大多数公司在设计资源权限时,默认使用对象是人类用户。比如,一位资深工程师可能有权部署到生产环境、查询敏感数据库,或者撤销其他用户的访问权限。这些权限本身带有风险,但传统上风险一直被两个前提约束着:工程师会运用人类判断力,并且只能以人的速度行事…

Agents on Rails:大语言模型基准测试项目

2026年8月12日 星期三 由 Rails Foundation 发布 今天我们分享 Agents on Rails 的首批成果。这是一个新的长期项目,旨在衡量当下领先的编码智能体工具(包括前沿模型和开放权重模型)在 Ruby on Rails 代码库上的实际表现。 Rails Foundati…

我读过不少同行软件工程师对 AI 辅助编程的激烈抨击。我理解!LLM 确实有很多理由值得大量批评!

但有时候,我觉得我们仿佛生活在完全不同的世界里。 在这篇文章里,我想回应 Senko Rašić 的帖子,标题是《“编码从来不是最难的部分”是对所有程序员的侮辱》(存档版)。我承认,这个标题相当抓人眼球,光是看到标题,我就产生了强烈的情绪反应。 在回应帖子内容之前,我想先说明一点:我完全不认同 Se…

Show HN:Hearth——一个AI代理能帮你建应用的家庭共享空间

Hearth 是一个供家庭成员共同使用的工作空间。家里的大小事,比如计划、笔记、日程安排、人员信息,还有每周的家庭惯例活动,都可以放在里面,而且有一个 AI 代理能结合这些背景信息帮你处理事务。有点像给 Obsidian 加了个 AI 助手。 有意思的是,这个 AI 代理还能基于家庭的笔记直接构建小…

借助 Builds 功能,Cloud Agents 启动速度快了 3 倍

Agent 在就绪环境中启动时,才能发挥出最佳状态:代码仓库已克隆、依赖已安装、安装脚本已执行完毕。此次更新带来了 构建(Builds) 功能——Cursor 会在后台预先准备好一份开发环境的副本,Agent 直接基于这份就绪环境启动,而无须每次从零搭建。Builds 已包含在 Cloud Agen…

在 AI SDK 的 harness 层中使用兼容 ACP 的 harness

AI SDK 的 harness(编程代理运行框架)层现在支持任意符合智能体客户端协议(Agent Client Protocol,ACP)的 harness——通过新的 @ai-sdk/harness-acp 包,配合 HarnessAgent 即可接入。在此之前,每个 harness 适配器都只…

AI SDK harness 层现已支持 Grok Build

AI SDK 的 harness 层(即统一接入层)提供了一套标准接口,用来接入各种成熟的 AI 编程代理运行时(coding-agent runtime)。这意味着,你可以在不修改应用代码的情况下,轻松切换底层运行时。 今天,这套 harness 家族新增了 Grok Build。和所有其他受支持…

Cursor Design Mode 更新:在页面上直接“指给”智能体看,改 UI 不再只靠聊天

摘要:Cursor 的浏览器环境更新了 Design Mode,用户可以在运行中的产品界面里直接点选元素、框选区域或语音描述改动,把修改意图交给智能体。这套交互让“看见界面”和“理解代码”之间的断层更小,也把从发现问题到完成编辑的闭环压缩得更短。 从聊天到指向:UI 协作的新方式 聊天是人类与智能…

从亚百毫秒级启动到生产级部署,腾讯云为何重构 Agent 沙箱?

2026 年初,OpenClaw 以一己之力掀起了本地终端 Agent 热潮,人们开始习惯把文件系统、浏览器、邮件、终端,以及各种账号权限交给 Agent。“养虾”,一度成了上半年最时髦的事儿。 但“养虾”的背后,潜藏着比模型幻觉更直接的风险。 Meta 超级智能实验室对齐负责人 Summer Yu…

Vercel 发布新语言 Zero:代码不是写给人看的,而是写给 AI 的

Vercel Labs 发布了实验性系统编程语言 Zero,其核心思路是让编译器输出的主要阅读者从人类变成 AI 智能体。该语言以机器可读的诊断与修复计划、显式副作用管理和图优先存储为特色,目前仍处于实验阶段。对于关注 AI 编程的开发者来说,这是一个观察工具链设计风向的样本。 面向智能体的系统语…

研究:编码代理无视开源社区贡献规则

北京大学的一项新研究发现,自主编码代理会无视开源社区里的贡献规则。 这对开源维护者来说不是好消息——他们正被大量粗制滥造的 AI 生成贡献淹没。如果编码代理连贡献指南都不看,那维护者就算重写规则,也约束不了代理的行为。 研究团队选了四款前沿模型做测试,从 49 个仓库中筛选出 106 个包含 AI…

Vercel Connect 现在支持通过 CLI 配置 100+ 连接器

现在,你可以通过 Vercel Connect 在命令行中集成 100 多种服务了。以前,vercel connect create 只能在终端里为部分服务完成配置,其余服务都得打开控制台手动处理。 现在只需要传入服务名,就能创建连接器并关联到你的项目。CLI 会自动填好品牌名、图标、认证类型以及…

Claude Code 定价:同样的 token,同样的模型,价格却可能相差 40 倍

同样的 token,同一个模型,价格差距却高达 40 倍——这就是 2026 年 8 月 Claude 的定价现状。 智能体编程(agentic coding)是大语言模型真正找到产品市场契合点的场景:智能体消耗的 token 比普通聊天多得多,而且已经成为全球一批高薪专业人士的日常工具。一年前,每…

Vercel Sandbox 现基于 Vercel Managed Images 运行

Vercel Sandbox 现在跑在 Vercel Managed Images 上。 今天,我们正式推出 Vercel Managed Images(VMI)——一组带版本号的开源基础镜像,你可以直接拿来用,也可以自行扩展。所有镜像的源码都存放在公开的 vercel/sandbox 仓库中。托管…

在 NVIDIA 平台上用 Meta 的 Muse Glimmer 运行本地智能体 AI 工作流

Meta 再次回归开源生态,发布了 Muse Glimmer——一个拥有 300 亿参数的开放权重稠密模型,配备 12 万以上的上下文窗口,专为本地 AI 智能体工作而设计。该模型针对 NVIDIA 边缘设备、桌面端和工作站等多款 AI 平台进行了优化,在单块 GPU 上可实现每秒 2 万 toke…

微软正式发布 Agent Framework Harness 和 Hosted Agents

微软已经将 Agent Framework 从 SDK 阶段推进至受支持的生产运行时。该框架于 2026 年 4 月 2 日正式发布 1.0 版本;在 6 月 2 日至 3 日举行的Build 2026大会上,Agent Harness、GitHub Copilot SDK 和 Claude Age…

Meta Muse Glimmer:让本地 AI 智能体跑在消费级 GPU 上

Meta 以 Apache 2.0 协议开源了 300 亿参数的 Muse Glimmer 模型,主打本地 AI 智能体场景。它在多个智能体基准上领先于同级别的 Gemma 和 Qwen 模型,但在编码和多模态任务上各有胜负。对开发者而言,这意味着无需依赖云端 API,就能在自有 GPU 上运行私人…

然而,仅靠固定检查器的静态分析并不够。纯 LLM 评审有几个局限:多次运行结果不稳定、安全问题召回率低、大规模使用成本高,而且容易被无关因素“带偏”。

过去 6 年,我们一直在构建一个确定性、纯静态分析的代码评审产品。今年早些时候,我们开始从底层重新思考这个问题,意识到静态分析恰好能弥补纯 LLM 评审的关键盲区。过去 6 个月里,我们构建了一个新的“混合”智能体循环:将静态分析与前沿 AI 智能体结合,在发现和修复代码质量与安全问题上,优于纯静态…

Claude Code五天后默认开启自动权限模式,分类器开销由Anthropic承担

摘要:Anthropic宣布Claude Code将于5天后默认启用自动权限模式,取代人工审批。其数据显示,用户对权限请求的拒绝率仅为3%,而自动模式拦截危险命令的成功率高达89%,远超人类的13.6%。分类器每次工具调用产生的额外token开销将由Anthropic承担,不再向用户收费。 你是否还…

Anthropic 将 Claude Code 的自动模式设为默认

图片来源:Samuel Boivin/NurPhoto / Getty Images Anthropic 将 Claude Code 的自动模式设为默认 用 Claude Code 编程很快将需要更少的人工监督——Anthropic 宣布,从 8 月 14 日起,自动模式将成为 Pro、Max 和…

让 Herdr 里的每个 agent 都拥有独立的 Vercel Sandbox

像 Claude Code、Codex、OpenCode 这样的终端编码 agent,现在可以各自运行在相互隔离的 Vercel Sandbox 中,并由 Herdr 统一调度。Herdr 是一个类似 tmux 的管理器,能在分屏(pane)里并排运行多个 agent。无论 agent 执行了什么命…

一个代理,随处可用:我们如何构建 Kiro 代理框架

在 Kiro 开发初期,我们就在讨论一个问题:在开发者的日常工作中,智能体(agent)开发应该是什么体验?我们反复想到的场景是,会话可以在笔记本电脑、云端沙箱之间无缝流转,来回切换毫无阻碍。一天工作结束,你合上电脑,Kiro 会话照样在云端继续运行。买咖啡的间隙,掏出手机就能查看进度。第二天早上打…

Marketplace 集成现在会安装服务商的技能

现在通过 Vercel CLI 安装 Marketplace 集成时,也会一并安装该服务商发布的代理技能(agent skills,来自 skills.sh),让你的代理知道怎么使用它。只要服务商发布了技能,这一过程就会自动完成。 你甚至不用离开终端就能找到集成:vercel integration…

全新推出 Agent Plugins 1.0.0

Agent Plugins 1.0.0 现已正式发布。它是一个开放、不绑定特定厂商的标准,用于将 Agent Skills(智能体技能)和 MCP servers(模型上下文协议服务器)打包成可移植的插件。兼容的智能体客户端可以直接发现并加载这些插件。 Agent Plugins 定义了一套通用格式…

为任意网站接入 WebMCP 接口

今天,我们在 Cloudflare 上发布了 WebMCP 的开发者预览版。一键开启,浏览器代理就能直接和你的网站协作,不需要写代码,源站也无需任何改动。Cloudflare 会在你的页面里嵌入一条轻量桥接,为访问者的代理注册一组可用工具。 互联网当初的设计前提是:屏幕对面坐着一个人——有人读页面、…

使用 Chat SDK 暂停工作流以等待审批

你可以通过新的 chat/workflow 子路径,用 Chat SDK 来构建人工介入的审批流程。调用一次 requestApproval,就会发送一张带有“批准”和“拒绝”按钮的卡片,同时挂起 Workflow SDK 的工作流,直到有人做出决定。等待时间可以短到几秒、长到几天,即使部署或重启也…

MCP 最大更新落地:砍掉握手与会话,回归无状态 HTTP 时代

MCP 发布近两年后迎来官方口中“最大的一次更新”:移除初始化握手与会话粘滞,让每个请求独立携带完整上下文。远程 MCP 服务器从此可以像传统无状态 HTTP 服务一样部署和运维。但这意味着,跨会话的上下文管理将重新交给开发者。 MCP 折腾了近两年,终于迎来了官方口中“发布以来最大的一次更新”,只…

从GPU到Token:英伟达Vera Rubin如何重构下一代AI工厂 - InfoQ

英伟达正在将下一代 AI 基础设施的竞争,从“谁拥有更快的 GPU”推向“谁能建成效率更高的 Token 工厂”。 之前,企业只需要数百到数千块加速卡组成的集群,但现在 AI 基础设施面对的任务已经不再是完成一次次更大规模训练,还需要支持智能体系统持续运行生成更多 Token、KV cache,并产…

180万刀,连亚马逊都烧不起Claude了

Claude不是我说你,钱真不能这么花 程浅 发自 凹非寺量子位 | 公众号 QbitAI 洛阳纸贵,Agent用量爆炸已成为科技公司的噩梦,这些公司不幸地发现:原来比起AI,人的最大优势是可以拖欠工资(x)。 AI不理解情怀,硅谷不相信眼泪。 最近,年入7000多亿美元、家大业大的亚马逊,也被C…

将 Workers AI 和 AI Gateway 统一为一个 AI 控制平面

AI Gateway 和 Workers AI 最初是两个独立的产品,但随着时间的推移,我们注意到用户的使用方式正在靠拢。通过 AI Gateway,你可以把请求代理到任何模型提供商,并获得内置的可观测性、日志、访问和安全管理能力。Workers AI 则把模型托管在我们管理的 GPU 基础设施上,…