Twitter AI 编程 - 2026-07-28¶
1. 人们在讨论什么¶
1.1 Google 的 Antigravity 攻势:Gemini 3.6 Flash 演示连发,免费工具大放送 🡕¶
Google/Antigravity 几乎包揽了当天互动量最高的帖子:官方连续发了两条演示讨论串,同时一篇爆红的“15 个免费 AI 工具”清单文也被至少 3 个不同账号转发。
@antigravity 展示(637 个赞、48 条回复、42,843 次浏览)了一个全栈协作式 Markdown 编辑器,支持多智能体状态实时同步,并通过运行在 Gemini 3.6 Flash 上的 Antigravity SDK 端到端构建——这是当天得分最高的帖子。当天第二条官方演示则把 tldraw 画布草图直接变成了可交互的主题化 UI(277 个赞、15 条回复、20,239 次浏览),其中一位付费用户的回复点出了真正省时的地方:“从粗略草图直接到能跑的交互式代码,中间完全不用手动翻译。”
@mikenevermiss 列出(167 个赞、235 次收藏、13,440 次浏览)了 15 个免费的 Google AI 工具。 其中包括 Pomelli、Stitch、Opal、Antigravity、NotebookLM、Jules, 以及 Gemini CLI、Code Wiki、Firebase Studio 和 Gemini Code Assist。 同一天,这份清单又被 @DivyanshT91162 和 @k2sbhai 几乎原文照搬地分别转发。 抓取 labs.google/pomelli 也能确认,这些都是真实、当前免费的产品,不是空头概念。 回复分成两派:有人夸 NotebookLM 很适合做 RAG 原型(“在 3 个项目上替我省了好几天搭建时间”),也有人反驳说,“免费工具也可能带来隐藏成本——比如花时间学会它们、把它们接进现有流程。”
Google 还展示了一个非编程的生产场景:密歇根一位奶农的 《Farm Brain》(153 个赞、48,891 次浏览),这是一个在 Antigravity 内部基于 Gemini 3.6 Flash 搭建的本地多智能体系统,用来自动跟踪牧场日常运营表现——这说明 Antigravity 的使用已经从演示应用扩展到真正的运营工具。类似地,@xdadevelopers 把 Antigravity 接入一个 Obsidian vault(24 个赞、8,665 次浏览),让它审计多年积累的笔记,自动找出失效的内部链接、孤立笔记和重复内容簇。

讨论要点:即便在官方讨论串里,大家对 Antigravity 本身的情绪也很分裂。回复里既有“我昨天就卸载了 Antigravity”,也有“Gemini 根本做不了复杂工作……情况看起来非常非常糟”,这些抱怨主要针对默认前沿模型只给 Flash 档;同时也出现了更具体的功能请求,例如把手机上的任务交接给宿主笔记本里的智能体、为更新的模型提供 BYOK,因为原生 Opus“还卡在 4.6”。
1.2 GitHub Copilot 里“运行框架,不是花招”的叙事站稳脚跟 🡕¶
反复出现的一个主题,是大家反对囤积工具和提示词,转而主张把一个运行框架真正吃透。 @burkeholland 写道(34 个赞、2,488 次浏览):“你没有落后。别人也没有什么你不知道的秘密。真正有用的就是运行框架,而它大多数时候已经够了。” 他还链接了一篇 github.blog 文章,建议用户先选定一个 Copilot 入口,在沙箱(Codespaces 或 devcontainers)里打开 YOLO/allow-all 模式,先做原型,再逐步加固。 官方 @github 账号也在当天转发了这篇文章(63 个赞、72 次收藏、18,492 次浏览)。
回复里既有认同,也有怀疑:有人把版本控制称作安全 YOLO 模式的“另一半”——“只要智能体碰到的一切最终都能变成 git diff,自主性就没那么可怕了”; 也有人反驳说,“把一堆胶带叫成运行框架有点抬举了……我午饭前工作流就已经坏了两次。” 另一条同类讨论串来自 @jamescoder12, 他认为(41 个赞、28 条回复、1,477 次浏览)“80% 的 Cursor 用户,实际上只是把它当成自动补全更好的 VS Code 来用”, 并结合 Cursor Rules、多文件 Composer 和后台智能体给出具体时间对比:一项手工要花“2-3 小时”的功能,用 Composer 可以压到“15-20 分钟”。
1.3 Grok 4.5 进入 GitHub Copilot 🡕¶
@cb_doge 披露(215 个赞、75 条回复、20,152 次浏览), Grok 4.5 现在已经可在 GitHub Copilot 中使用,称其“专为快速的智能体式编程和复杂多步工作流打造”,拥有 500,000 token 的上下文窗口、图像支持以及可调推理强度。 GitHub 自己的更新日志也确认了上线机制:Pro、Pro+、Max、Business 和 Enterprise 用户都可使用, 覆盖 VS Code、Visual Studio、Copilot CLI, Copilot 云端智能体、Copilot 应用、JetBrains、Xcode 和 Eclipse 也都在范围内, 不过 Business/Enterprise 管理员需要手动打开这项策略(默认关闭)。 @veggie_eric 也独立确认(162 个赞、4,044 次浏览)了同一轮上线,并附上截图; 官方 @GHchangelog 账号也发了自己的摘要(18 个赞、1,199 次浏览)。 有条回复点出了真正的考验:“真正要看的是,它在改了 40 分钟之后,还能不能把一个代码仓库里那些古怪的本地规则都理顺。这通常就是编程智能体开始摇晃的地方。”


1.4 Kimi K3 通过 Modal 免费开放,用户也想把它接入 Antigravity 🡕¶
@StudentOffersHQ 公开(88 个赞、117 次收藏、4,364 次浏览)了一个消息: Modal 提供每月 $30 的免费算力额度,可用于 Kimi K3,而且不需要信用卡——大致相当于每月 1,000 万输入 token 或 200 万输出 token,按月补充且不结转。 Modal 的产品页(推文截图中可见)也确认,Kimi K3 是 Moonshot AI 的“2.8 万亿参数混合专家模型,原生支持视觉,拥有 100 万 token 上下文窗口”, 定价为输入 $3/MTok、缓存 $0.30/MTok、补全和推理均为 $15/MTok。 @SahilPanhotra 发帖(23 个赞、19 条回复)给出了几乎相同的教程,附上 4 张同样展示 Modal 部署和 OpenCode 配置流程的截图; 两条讨论串描述的都是同一套 2 分钟配置流程:用 GitHub/Google 登录、创建 Managed Endpoint、生成代理 token,再把生成的配置粘贴进 OpenCode。
另一边,@HarshithLucky3 发帖(474 个赞、40 条回复、32,764 次浏览)喊话:“嘿 Google,把 Kimi K3 加进 Antigravity。” 他贴出的截图展示了 Antigravity 当前的模型选择器,里面只有 Gemini 3.6/3.5 Flash、Gemini 3.1 Pro、Claude Sonnet/Opus 4.6 和 GPT-OSS 120B,没有 Kimi K3——这让这条请求的动机变得非常直观。 同一作者当天的后续帖子(“很多人都想在 Antigravity 里用 Kimi K3”,76 个赞)进一步强化了这一需求信号。

2. 令人困扰的问题¶
按 token 计量的定价正在吞掉订阅价值(高严重度)¶
最明确的抱怨线索,是按月付费的 AI 订阅背后其实藏着按 token 计量的成本,而且这种成本会毫无预警地飙升。 @sam_ess604 直接问 OpenAI(15 个赞、1,778 次浏览):“OpenAI 到底什么时候才会修复这个把大家每周额度都耗光的工具调用问题?5.5 会并行工具调用,让它们在同一上下文里工作;5.6 却会为每一次工具调用都重新抓取上下文,结果模型轮数更多。” 他还链接了一个具体的 GitHub 问题单——这不是泛泛抱怨,而是一条非常具体的回归问题。 @MLStreetTalk 也单独表示,因为“我有多个账号”,Codex 手机应用一直无法连上 Codex 服务, 并进一步建议,“OpenAI 干脆推出一个每月 $1000 的档位吧,这样大家就不用再折腾多个 Pro 账号了。” 更宏观地看,@OwenGregorian 转发的一段 Ed Zitron 采访(15 个赞、1,415 次浏览)引用报道称, OpenAI 在 2025 年营收 $13.07B、亏损 $20.9B,而 Uber 在一个季度里就烧掉了全年 token 预算, 借此论证订阅给出去的 token 量“是其价格所能支撑的 20 到 40 倍”——这其实就是用户口中“额度很快烧完”问题的结构性版本。
多工具凭证与配置摩擦(中严重度)¶
当多个编程智能体并排运行时,初始化配置的摩擦是真实存在的。 @_GateAI 做了一个路由器(8 个赞),明确就是为了解决“很多人都是倒在‘去改 3 个配置文件’这一步”—— 它会自动识别 Claude Code、Cursor、OpenClaw、Codex 和 OpenCode,并把它们都路由到同一次登录。 @theAIsailor 的 BaseCode 工具也出自同样的痛点: 在“我们的 Anthropic 账单一路冲向 $1 million”之后,他们做了一个中心化系统, 为 Claude Code、Codex、Copilot、Gemini 和 OpenCode 统一下发身份、策略、技能和 MCP 服务器,并按工程师追踪开销。
桌面端对 Copilot 式整合的疲劳感(中严重度)¶
@alex_verem 抱怨(9 个赞、2,206 次浏览),即便买了 Windows 11 Pro, 系统里还是会自带“Notepad、Photos 和 Snipping Tool 里的 Copilot 按钮”、遥测, 以及无法在设置中彻底关闭的 Recall 截图功能—— 于是有人推荐用第三方 WinUtil 工具(其精简脚本下载量已超 20M)把这些东西再剥掉。 这并不是在抱怨 GitHub Copilot 的编程能力,但它说明,大家对操作系统层面那些无法移除的 AI 助手入口,已经开始产生疲劳。
共享聊天链接被搜索引擎收录(高严重度,单次事件但影响严重)¶
@HedgieMarkets 报告(10 个赞、838 次浏览),Claude 的公开分享链接功能在 Anthropic 于 7 月 26 日修复之前,让陌生人的聊天记录——其中一些还包含加密钱包密钥和家庭住址——在周末被 Google 收录。报道称,修复前有超过 11,000 条共享消息被复制到一个公开页面,因此现在就算删除链接,“也已经无法挽回”。同一账号还指出,这是大型 AI 厂商第 3 次(先是 ChatGPT,随后 Claude 连续两次)推出易分享功能后再处理隐私后果——对于同样支持可分享会话链接的编程类工具来说,这是一个值得持续跟踪的重复模式。
3. 人们期望的功能¶
Antigravity 的移动端任务接力与 BYOK(直接机会)¶
Google 那条 tldraw 画布演示下,一位付费用户回复(来自 @huzaifashaikh_)要求,手机上的任务能直接交给跑在宿主笔记本上的智能体(类似 Cursor/Claude 的支持方式),并加入 BYOK,“这样我们就能自己用上最新的模型版本(你们原生的 Opus 还停在 4.6)。” 这不是空泛愿景,而是供应商可以直接补上的、非常急迫的产品缺口。
在 Antigravity 内支持 Kimi K3(直接机会,外部已部分满足)¶
把 Kimi K3 加进 Antigravity 模型选择器的需求(@HarshithLucky3,474 个赞;同日重复帖又有 76 个赞)已经被第三方部分满足——Modal 的免费托管 endpoint 加上 OpenCode 的一键配置,意味着今天就能用到这个模型,只是还不是 Google 自家 IDE 里的原生选项。这对最先交付原生支持的供应商来说,是一个明显的竞争机会。
具身化、常驻在线的语音助手人格(偏愿景型)¶
@xikhar 做了(48 个赞、4,461 次浏览)一个套在 ChatGPT Realtime Voice 模式外面的 3D 脸部/身体壳层,并直接向 OpenAI 喊话:“这才是 Codex Pets 应该变成的样子。” 这更像偏情感和愿景的表达,而不是迫切的实用需求,但它也呼应了同一种愿望:人们想要的是会持续存在、能让人感到“在场”的智能体,而不是只活在聊天窗口里的东西。
一套配置,跑遍所有智能体(直接机会,已部分满足)¶
在 3 条彼此独立的帖子里,同一个愿望反复出现:别再为每个编程智能体重复配置凭证和策略。@_GateAI 的一键路由器和 @theAIsailor 的 BaseCode,今天都已经分别给出了局部答案(前者解决凭证路由,后者解决支出/策略治理),这说明市场识别这个需求的速度,已经快过任何单一厂商把它端到端补齐的速度。
4. 使用中的工具与方法¶
| 工具 | 类别 | 评价 | 优势 | 局限 |
|---|---|---|---|---|
| GitHub Copilot | IDE 助手 / 智能体 | (+/-) | 现已在 VS Code、CLI、JetBrains、Xcode、Eclipse 等入口提供 Grok 4.5(50 万 token 上下文);新增“运行框架”工作流指引;Spring Tools MCP 集成可在 Eclipse 中降低 token 消耗 | 企业管理员需手动启用新模型;即便按运行框架指南操作,也有用户称自己的工作流“午饭前就坏了两次” |
| Grok 4.5 (via GitHub Copilot) | LLM | (+) | 50 万 token 上下文、图像输入、可调推理强度;按 GitHub 内部测试,擅长并行调度工具 | 上线分批且按套餐分层;独立排行榜在成本校正后的编程任务上只给中游(5.9/10) |
| Kimi K3 | LLM | (+) | 2.8T 参数 MoE、原生视觉、100 万 token 上下文;Modal 每月 $30 托管 endpoint 额度可免费用;独立排行榜排第 7(7.75/10) | 在前 15 个测试模型里平均每次提示最慢(16:12);Antigravity 里还没有原生支持 |
| Claude Code | 智能体式编程 CLI | (+/-) | Anthropic 据称砍掉了 80% 的系统提示词;官方市场有 17 个插件和 141 个 skills;按 The Information 的说法,尽管成本上升,它仍占主导 | 竞品基准称其冷启动内存为 386.6MB、约 3,436ms;共享聊天链接曾短暂泄露到 Google 搜索 |
| Codex / Codex CLI | 智能体式编程 CLI | (+/-) | Voice Mode 支持免手操作、可并行跑约 8 条工作流;实体键盘 Codex Micro 已发货并售罄 | 5.5 到 5.6 的工具调用回归据称更快耗尽周额度;应用 UI 虽打着“开放运行框架”的旗号却仍是闭源;多账号手机号绑定有 bug |
| Cursor | AI 代码编辑器 | (+) | Composer 2.0(多文件智能体)和 Background Agents 可把一项原称需 2-3 小时的任务压到 15-20 分钟;印度版 Start 套餐仅 Rs 649/月 | 据称大多数用户只用了约 20% 的能力,把它当成“自动补全更好的 VS Code” |
| jcode | 编程智能体运行框架 | (+) | MIT 许可的 Rust 运行框架:基准称首帧启动约 14ms,而 Claude Code 为 3,436ms;单会话 RAM 27.8MB,对比 386.6MB;支持 30+ 提供商 OAuth,并内置记忆图谱 | 一条质疑回复指出,除初始基准外,长会话稳定性尚未验证;这是个新项目,stars 在短时间内涨到 11-13k |
| Antigravity | AI 编程工作区 | (+/-) | 多智能体 SDK 能从提示词/画布草图直接搭完整应用;已被用于真实牧场运营工具,不只是 demo | 默认前沿模型只给 Flash 档(有回复直言“Gemini 根本做不了复杂工作”);没有移动端任务接力;更新模型不支持 BYOK |
| Modal (Kimi K3 hosting) | 推理平台 | (+) | 每月 $30 的免费托管 endpoint 额度、无需信用卡、2 分钟即可接入 OpenCode | 额度不结转;工作负载达到 $30 上限后会被硬性停止 |
| OpenBB | 开源金融终端 | (+) | 70,000+ GitHub stars,是年费约 $32K Bloomberg Terminal 的免费替代;AI copilot 会标注来源 | 领域高度垂直(金融),不是通用编程工具 |
| GPT-5.6-Sol / GPT-5.6-Luna | LLM | (+/-) | Sol 在独立排行榜通过 Codex CLI 拿到第 1(9/10);Luna(Medium)则以 $0.15/次提示、8.25/10 被标成最佳性价比 | 同一作者也说 Sol“贵得离谱”($1.38/次提示) |

总体来看,情绪沿着成本与能力轴线分裂:更便宜的模型(GPT-5.6-Luna、Kimi K3)在独立基准测试中凭“最佳性价比”收获赞誉,而旗舰模型(Opus 5、GPT-5.6-Sol)则被承认最强,却也因为昂贵而挨批。 迁移信号在部分角落已转向 OpenAI 的 Codex 生态(“去年 12 月后我主要改用 Codex 了;Claude 那几款模型……没一个能把我拉回去”), 而 Anthropic 的 Claude Code 尽管单用户成本上升,按《The Information》的报道仍保持使用份额上的主导。 GitHub Copilot 生态则是在吸收外部模型(Grok 4.5),而不是只靠自家模型竞争; 与此同时,MCP 服务器(Spring Tools、codebase-memory-mcp)正在成为一种机制,让这些智能体拿到结构化、token 更省的项目上下文,而不是盲目搜索整个仓库。
5. 人们在构建什么¶
| 项目 | 构建者 | 功能 | 解决的问题 | 技术栈 | 阶段 | 链接 |
|---|---|---|---|---|---|---|
| jcode | 1jehuang | 超快、低 RAM 的编程智能体运行框架,带可查询记忆图谱和群体式多智能体模式 | 现有运行框架(Claude Code、OpenCode)在并行跑大量智能体会话时冷启动慢、RAM 开销高 | Rust、自定义终端(Handterm)、自定义 mermaid 渲染器 | 已发布 | github.com/1jehuang/jcode |
| BaseCode | @theAIsailor / Lyzr | 类 MDM 的仪表盘,按人/项目归因 Claude Code、Codex、Copilot、Gemini、OpenCode 的编程时间和 token 开销 | AI 编程开销失控且无法归因(Anthropic 账单曾逼近 ~$1M),看不到每位工程师的使用情况 | 树图仪表盘、智能体归因徽章 | Beta | x.com/theAIsailor/status/2082028903305039891 |
| Graphify | @techwith_ram | 把代码库(连同文档、PDF、SQL 表结构、图片)转成可查询的知识图谱,供编程智能体使用 | 基于向量嵌入/grep 的上下文检索抓不到代码与非代码工件之间的关系 | 兼容 Claude Code、Cursor、Codex、Gemini CLI、GitHub Copilot | Beta | x.com/techwith_ram/status/2081989612990505234 |
| vibe-coding-prompt-template | KhazP | 把原始想法整理成研究摘要、PRD 和技术设计的结构化提示词模板,用于 AI 编程工作流 | 启动新 MVP 时提示词往往临时拼凑、缺乏一致性 | Python,标注兼容 Claude/Gemini/ChatGPT/Cursor/VS Code | 已发布(2.7k stars、MIT、已用于 3+ 个线上项目) | github.com/KhazP/vibe-coding-prompt-template |
| Gate Connect | @_GateAI | 自动识别已安装的编程智能体,并通过一次点击登录统一路由凭证 | 每个工具都要手改配置文件(“很多人就是倒在改 3 个配置文件这一步”) | 跨工具凭证路由器 | 已发布 | x.com/_GateAI/status/2082168711142646014 |
| OpenBB | Didier(社区) | 带 AI copilot 的开源金融终端,可在股票、文件披露和市场数据上标注来源 | Bloomberg Terminal 成本太高(约 $32,000/年) | Python(pip install openbb) |
已发布(70k+ stars) | x.com/He1s_Sammy/status/2082076288370593817 |
| Copilot CLI cache-break notifier | @DerekLegenzoff / @burkeholland | 会实时提示缓存中断(例如“63,153 -> 0 tokens reused”)的 Copilot CLI 扩展 | 静默缓存未命中会悄悄推高 token 成本 | GitHub Copilot CLI 插件 | 已发布 | gist.github.com/burkeholland |
| Viral-video recreation pipeline | @eptwts | 抓取高热视频 TikTok,按场景切分(PySceneDetect + ffmpeg),用 Gemini 分析每个场景,再用 Seedance 2.0 重新生成 | 想重做一条爆款视频时,手动逆向拆解其爆红原因太慢 | 由 Claude Code 编排 yt-dlp、PySceneDetect、ffmpeg、Gemini API、Seedance 2.0 | Alpha(工作流已描述,TikTok research API“即将上线”) | x.com/eptwts/status/2082110884562833793 |
| One-shot AAA-style FPS build | @mattshumer_ 提示,@ericbahn 执行 | 用一条复杂提示词生成的 ThreeJS FPS,并让 Claude Code 子智能体跑“先构建、再狠批”循环 | 展示子智能体编排和反复自评,能把一次性输出推到多远 | Claude Code、ThreeJS、子智能体“严厉评论者”循环 | Alpha(演示 / 提示词) | x.com/ericbahn/status/2082229982592680240 |
BaseCode 和 jcode 都能直接追溯到一个被明确点名的成本/性能痛点(失控的 Anthropic 账单;缓慢且吃内存的运行框架),这再次说明,本轮开发者能量主要投向的是管理和加速现有智能体,而不是再造新的基础模型。 Graphify、vibe-coding-prompt-template 和 Gate Connect 也都明确宣传兼容同一组 5 个工具: Claude Code、Cursor、Codex, Gemini CLI/Copilot、OpenCode。 这说明生态正在围绕互操作性收拢,而不是围绕锁定效应展开。




6. 新动态与亮点¶
Codex Security:OpenAI 官方漏洞扫描器¶
@badlogicgames 提到(14 个赞、999 次浏览)@openai/codex-security,这是一个刚浮出水面的官方 CLI/TypeScript SDK(“npm install @openai/codex-security”),可用于发现、验证和修复漏洞,并按其 GitHub README 支持 ChatGPT 或 API-key 认证以及 CI 集成。
Anthropic 将 Claude Code 的系统提示词砍掉了 80%¶
在《AI Engineer World's Fair》上,Anthropic 的 Thariq Shihipar 在《Seeing Like an Agent》分享中表示:“我们把 Claude Code 的系统提示词砍掉了 80%。”
这一说法出现在 @dani_avila7 分享的一张幻灯片里(5 个赞、264 次浏览),他还追问,这种裁剪逻辑是否也该用于 CLAUDE.md/SKILL.md 项目文件。
同一天,Microsoft 的 Harald Kirschner(GitHub Copilot/VS Code)和 Anthropic 的 Ado Kukic 还共同主持了一场关于上下文工程的联合圆桌(12 个赞)。
与此同时,@marfinxx 分享的一篇 arXiv 论文——《Building Effective AI Coding Agents for the Terminal》(arXiv:2603.05344)——
也把类似技术(AST 差异压缩、状态哈希路由、自适应上下文压缩)形式化到一个名为 OpenDev 的开源 CLI 智能体里。
3 个彼此独立、同日出现的来源都收敛到“少给上下文,但要精心整理”这一点上,这是一个值得注意的跨厂商信号。


GitHub Copilot 应用新增 stacked PR 管理¶
@_JeremyMoseley 演示了一个智能体如何直接在 GitHub Copilot 应用里创建和管理 stacked PR;这一演示随后在同一天被 @_Evan_Boyle 和 GitHub 自己的 @pierceboggan 放大传播,后者还直接附上了功能链接(gh.io/app)。
GitHub Copilot 应用支持企业托管设置¶
@pierceboggan(12 个赞)宣布,GitHub Copilot 应用现在支持企业托管设置。GitHub 的更新日志也确认了这一点:管理员如今可以更细粒度地控制它的行为。
Codex Micro 键盘售罄,转售价涨到 5-8 倍¶
Work Louder 的 Codex Micro 键盘——配有 13 个按键、一个摇杆和一个旋钮,用来控制 Codex 智能体,且 RGB 按键会随智能体状态变色——据 @Prompt_ProfitAI 报告(10 个赞),大约 12 小时就卖光了,eBay 上的转售价达到 $1,250 和 $1,850。@btibor91 发了上手照片,确认这设备确实存在,而且能正常工作。
ChatGPT Work 正面挑战 Claude 的 Cowork¶
@JJEnglert(1 个赞、299 次浏览)提前上手了 ChatGPT Work, 描述其中有聊天/工作切换、一个“Approve for me”操作按钮、便捷的子智能体委派以及可按子智能体查看进度的视图,还有一键部署网站的能力; 他评价说“比《Artifacts》更好”。 他认为,这对 Anthropic 的 Cowork 构成了严肃竞争, 同时也质疑,为什么设计上要照搬 Cowork 的聊天/工作切换,而不是把一切统一收进一个 ChatGPT 入口。

Anthropic 官方插件市场:17 个插件,141 个技能¶
@Suryanshti777(3 个赞、87 次浏览)梳理了 Anthropic 官方 Claude 插件市场的结构, 把它分成《Build》、《Grow》、《Operate》 和 《People & Lab》4 组, 并细化到《The Engineer》这类具名技能(用于代码审查 / 调试 / 部署),以及新的 claude-security 守护插件,它会运行一条扫描—验证—修补流水线。 这是本周数据集中,关于 Anthropic 自家(而非社区)技能生态最细的一次公开视图。


7. 机会在哪里¶
[+++] 跨智能体的支出与凭证治理 —— BaseCode(源自一张接近 $1M 的 Anthropic 账单)、Gate Connect(一键路由凭证)以及 Copilot 缓存中断提醒器(把静默缓存未命中显出来), 其实都在解决同一个底层缺口: 没人能干净、按预算、跨工具地看清 Claude Code、Codex、Copilot 和 OpenCode 到底在花多少钱、做了什么。 3 个彼此独立的开发者在同一天分别补同一个问题,已经说明了这一点。
[++] 原生的轻量高速编程智能体运行框架 —— jcode 的爆红反响(14ms 启动,对比 Claude Code 的 3,436ms;RAM 占用极小;同一基准被 3 个独立账号转发)表明,市场对更轻的智能体运行时确实有需求,只是按一条质疑回复的说法,它的长会话稳定性仍未验证。
[++] 上下文工程正固化为一种跨厂商的长期方法 —— Anthropic(Claude Code 将系统提示词砍掉 80%)、Microsoft(联合上下文工程圆桌)和学术研究(OpenDev/arXiv 论文)同一天都指向同一主题,这说明它更像一门正在成熟的实践,而不是某一家厂商的营销口号。
[+] 垂直一体化 IDE 内的原生多模型灵活性 —— 无论是 Antigravity 对 Kimi K3 的呼声,还是 BYOK/移动端接力请求,指向的都是同一种摩擦:用户想在自己偏好的工作区里用自己偏好的模型,现在他们只能靠第三方托管方(Modal)自己补缝,而不是等供应商交付。
[+] 面向 AI 编程的专用实体硬件 —— Codex Micro 售罄以及 5-8 倍的转售价,虽小但很具体地说明:除了把键盘鼠标从别处挪来用,市场上确实存在一类专门控制智能体的外设需求。
8. 要点总结¶
- Google 正在用免费 AI 工具淹没市场,但它的旗舰编程工作区在模型灵活性上仍然落后。 那篇“15 个免费 AI 工具”清单在同一天至少被 3 个账号独立转发,而 Antigravity 用户仍在请求产品补上 Kimi K3 和 BYOK。 (mikenevermiss, HarshithLucky3)
- Grok 4.5 进入 GitHub Copilot,确认了 Copilot 的策略是聚合外部前沿模型,而不是只和别人比自家模型。 按 GitHub 自家的更新日志, 它正在 8 个入口上线(VS Code、Visual Studio、CLI、云端智能体、应用、JetBrains、Xcode、Eclipse)。 (GHchangelog)
- Modal 给 Kimi K3 的免费档,是真正打乱成本结构的变量。 每月 $30 额度、无需信用卡,而且同一天有 2 位作者独立复现了几乎一样的接入流程;不过在独立成本/质量排行榜上,它只排中游(15 个模型中的第 7)。 (“现在再花钱租 GPU 服务器来试 Kimi K3,已经没太大意义了” — SahilPanhotra)
- 这一周,上下文工程已经固化成一门有名有姓的技术方法论。 Anthropic、Microsoft 和一篇 arXiv 论文都在同一天独立描述了同一种模式:不是把原始文件一股脑塞进去,而是先压缩、路由、限定上下文范围。 (dani_avila7, marfinxx)
- 当天技术细节最丰富的开发者故事(jcode),也是验证最薄弱的一个。 针对 Claude Code 的 245 倍启动速度说法,至少被 3 个账号用几乎相同的文案传播;唯一一条真正的质疑回复问的是,“两小时 repo 会话之后,它还能不能稳住?” 而公开场合里没人回答。 (Voxyz_ai)
- 真实的安全事故(Claude 共享聊天链接泄露)与安全导向的新产品发布(Codex Security)落在同一周,再次说明信任与安全仍是实打实的风险。 (HedgieMarkets, badlogicgames)