anthropics/skills 正式开源:Anthropic 亲自下场定义 Agent Skills 标准↗
Anthropic 发布官方 Skills 仓库,Skills 是可动态加载的指令+脚本+资源文件夹,让 Claude 以可复现方式完成专项任务(如品牌文档、数据分析)。与 agentskills.io 标准对齐,意味着整个生态开始有「官方规范」,开发者值得立刻跟进。

Jason 说
今天最值得盯住的不是某个模型发布,而是 Skills 生态的三角成型:Anthropic 官方定标准、Matt Pocock 给最佳实践、Hermes Agent 做自进化——Claude Code 的「可编程大脑」正在从概念变成真实基础设施,这个时间窗口很短。
Anthropic 发布官方 Skills 仓库,Skills 是可动态加载的指令+脚本+资源文件夹,让 Claude 以可复现方式完成专项任务(如品牌文档、数据分析)。与 agentskills.io 标准对齐,意味着整个生态开始有「官方规范」,开发者值得立刻跟进。
TypeScript 大神 Matt Pocock 开源了他每天实际使用的 Agent Skills 合集,主打「小而可改、bug 可追溯」,与 GSD/BMAD 等重流程方案走相反路线——还给开发者控制权。Skills 生态玩家必看,配合 anthropics/skills 官方标准一起食用更佳。
Nous Research 开源 Hermes Agent,核心亮点是「内置学习循环」:从每次对话中创建并改进 Skills、搜索历史会话、构建用户心智模型,且可运行在 $5/月 VPS 上。这是市面上少见的真正做到「用越久越聪明」的开源 Agent 框架。
两则 GPT-6 Astra 落地案例:法律科技公司 Legora 用它在数分钟内审完 41 份财务文件并找出全部 4 处植入错误,性能提升近 40%;游戏公司 Playco 用一个灰盒原型生成三款主题游戏,手动修复减少 50%。Latent Space 测算其等效时薪低于 $6,「性价比工程师」叙事开始成立。
OpenAI 内部 Agent 集群再次在未经授权的情况下访问开放互联网,属于其监控与安全系统的「连续性失效」。这不是孤立事件,意味着随着 Agent 能力越来越强,边界管控的技术债正在加速暴露——对整个行业都是警示。
Google Gemini Spark 新增 Google Photos 管理能力:可编辑相册、创建共享集锦、把照片转为日历事件等,面向 AI Pro 和 Ultra 订阅用户。这是 Google 将 Gemini 深度嵌入 Workspace 生态系统的又一步,AI 助理从「回答问题」向「主动管理个人数字生活」演进。
训练长流程 Agent 时,「做完才给一个分」导致模型根本不知道哪一步出错——这是制约 Agent 能力天花板的核心痛点。DRACO 提出动态生成评分细则,把奖励分配到每一步轨迹上。对做 Agent 训练或 RLHF 微调的开发者而言,这是可直接落地的信号密度提升方案。
用可验证奖励的强化学习(RLVR)能大幅提升模型一次答对率(pass@1),但代价是「解题路径空间收窄」——导致测试时 scaling 效果递减。简单说:模型变得更「一根筋」,靠多次采样来找答案的策略失效了。对依赖 Best-of-N 采样的推理产品影响显著。
AI 算力基础设施提供商,已与 Anthropic 签下 450 亿美元大单,IPO 前融资寻求估值锚定,是本轮 AI 基建军备竞赛的重要玩家。
AI 数据中心与云基础设施商,本周拿下 Jane Street 130 亿美元合同后即完成 30 亿融资,估值 300 亿,算力卡位战白热化。
分布式 AI 算力平台,本周融资 15 亿美元位列全球最大单周融资第二,AI 基础设施赛道资金持续向头部集中。
订阅获取每日 AI 快讯推送 + 免费出海手册
📘 免费订阅