OpenAI 自研推理芯片 Jalapeño 首测:吞吐量与能效双双领先↗
OpenAI 自研推理芯片 Jalapeño 首次公开测试结果出炉。在 SemiAnalysis 的 InferenceX 基准上,Jalapeño 在每用户 token 数和每千瓦吞吐量两项指标上均超越当前最先进芯片。这意味着 OpenAI 有望摆脱对 Nvidia 的硬件依赖,大幅压缩推理成本,直接影响 API 定价。

Jason 说
今天最大的信号是 OpenAI 自研芯片 Jalapeño 跑赢了现有最好的推理芯片——这不只是技术秀肌肉,而是 OpenAI 真的在用垂直整合的方式重塑 AI 成本曲线,对所有依赖 API 定价做生意的开发者来说,这是个值得长期跟踪的变量。
OpenAI 自研推理芯片 Jalapeño 首次公开测试结果出炉。在 SemiAnalysis 的 InferenceX 基准上,Jalapeño 在每用户 token 数和每千瓦吞吐量两项指标上均超越当前最先进芯片。这意味着 OpenAI 有望摆脱对 Nvidia 的硬件依赖,大幅压缩推理成本,直接影响 API 定价。
Anthropic 为 Claude 推出跨 Chat 与 Cowork 的共享记忆功能。此前用户每次切换界面都要重新介绍项目背景,现在 Claude 能在两个入口间共享偏好、项目信息和历史上下文。对于每天在 Claude 里处理多任务的重度用户,这是生产力的实质提升。
Accel 投资的 Keenable 完成 2600 万美元种子轮并正式亮相。与面向人类的搜索引擎不同,Keenable 构建的网页索引专门针对 AI Agent 的查询模式优化,解决 Agent 无法高效实时检索网页信息的核心痛点。随着 Agent 大爆发,底层搜索基础设施将成为关键卡点。
GitHub Trending 热门项目:开发者将 Andrej Karpathy 对 LLM 编程缺陷的观察提炼成单一 CLAUDE.md 文件,可直接放入项目根目录。涵盖常见代码幻觉、重复逻辑、边界案例处理等问题的应对规则。作者同步开源了 Multica —— 一个管理编码 Agent 与可复用 Skills 的平台。
开源项目 free-claude-code 整合了 50 个符合 ToS 的免费 Provider,让开发者无需付费订阅即可在终端、IDE 或手机端运行 Claude Code、Codex 等工具,每月可用 token 超 13 亿。支持语音输入,是穷游 Claude Code 的合规路线图。
AutoResearch 将 AI 科研自动化拆成「想法生成」与「想法执行」两阶段,持续整合最新研究信号并通过实验验证闭环。对开发者的意义:这是目前少数认真解决「AI 跑完整个研究流程却产出幻觉结论」问题的系统设计,为构建可靠 AI Research Agent 提供了可复用的架构思路。
把大模型压缩到 4-bit 量化后,推理、数学、代码能力会明显下降。这篇论文提出「量化感知修复」方案,用软标签替代硬标签重新微调,解决了传统 QAT 收敛慢且容易过峰值崩溃的问题。对想在自有 GPU 上低成本部署 LLM 的开发者,这是一份接地气的工程配方。
OpenAI 封禁了一批俄罗斯来源账号,这些账号利用 AI 工具伪造了一个虚假的以色列智库,并发布「主权指数」内容,系统性地赞扬俄罗斯、批评西方。这是 AI 被用于国家级信息战的最新案例,也再次验证了大模型在内容生产层面的双刃剑属性。
Stable Diffusion 母公司完成新一轮 7600 万美元融资,累计融资额升至 2.32 亿美元,试图在开源图像生成赛道重建竞争力。
订阅获取每日 AI 快讯推送 + 免费出海手册
📘 免费订阅