跳转至

Twitter AI Coding - 2026-08-19

1. 人们在谈论什么

1.1 编程智能体终于得到了一个命名的企业 ROI 故事,人们把它当作一个类里程碑 (🡕)

最大的对话转变是从抽象的“代理潜力”转向实际转移的具体企业积压。 至少五个项目支持:OpenAI 的 Asana 案例研究、关于移徙为何重要的第二顺序评论、OpenAI 的 Thibault Sottiaux 的 " Codex for Systople " 信号,以及 CNBC 中继声称 Codex 用户增长再次加速 。 比较 2026-08-18 当强调利用工程和运行时所有权时,2026-08-19 重点是智能体是否正在清理各小组已经定价和推迟的工作。

@OpenAIDevs (单位:千美元)467 点赞数,37 回复数,34,815 浏览量,61 收藏数),阿莎娜在此前预计作品需要再耗时 5 年后,在 2 个日历周内用 Codex 完成了 Enzyme 到 React-Testing-Library 的迁移. 公开后续报道OpenAI, (中文).Asana和链接法顿摘要添加部分 推特关心:$12,000 工程人员主要每天两次审查拉力请求,而不是手工磨练。

@murtuza_merc 争论(单位:千美元)81 点赞数,8 回复数,1,812 浏览量,10Asana 的故事证明真正的阻断者 不是技术上的复杂性 而是允许 AI 触摸生产代码。 这条线路落地是因为它把案例研究从“Codex 快速”重新定义为“治理是排队的”。

@thsottiaux 张贴(单位:千美元)3,082 点赞数,593 回复数,146,721 浏览量,111 收藏数)是一款“比例的编码”,其重量大于图像本身,因为它来自产品铅,并立即绘制了一个大的回复数链,辩论重置、时间和推出信心。 分开来@firesidealpha relayed(单位:千美元)24 点赞数,4,428 浏览量,5 收藏数) aCNBC 声称使用 Codex 的部件已到达 20OpenAI 的季度运行率上升 35 百分比,企业上升 50 百分比;这个数字作为公共背景是有用的,但比阿萨纳案低信心,因为它通过一个 TV 而不是第一人称

讨论见解:最有用的回复数并不是要求更好地自动完成。 他们强调,跨越大型密码库的无趣移民正是人们希望智能体先吃的工作,剩下的障碍是组织信任、审查苛刻和许可。

与前一天的比较:打开 2026-08-18 最热烈的讨论是关于利用设计和生命周期管理。 打开 2026-08-19,中间移动到硬 ROI 和明显的使用势头。

1.2 安全和可审计性成为信任编码智能体的主要条件( ) (🡕)

第二组将安全故障视为产品界定,而不是边缘情况。 通常的线索是,如果破坏性命令、闭路审查或无法验证的技能能够沉默地做错事,智能体的有用性就不再重要。 与前一天更广泛的治理演讲相比,这一点更为具体:人们想要的是命名为失败模式、明确的缓解措施,以及一个工作流确实有帮助的可衡量证据。

@thsottiaux (单位:千美元)2,092 点赞数,554 回复数,119,534 浏览量,233 收藏数),在报告后详细概述 Codex 更改 GPT-5.6 有时在用户意图之外采取破坏性行动。 该帖子命名了具体的失败模式——不正确的临时清理指向$HOME,删除目标没有被检查,有风险的许可组合——并且说 Codex 现在检查删除目标,更倾向于可收回的行动,加强高风险命令审查,重现目标评价中的失败. 一个用户表示, 新的保护措施在清理工作上可能过于保守, 而其他用户则将安全更新内容折叠为对配额和平台变更的更广泛的不满。

@shawnchauhan1 (单位:千美元)6 点赞数,1 回复数,275GitHub 自己的浏览量 AI 安全审查通过了 Wiz Red Agent 后来利用的 Snowflake GitHub Actions 脆弱性,称问题在于可审计性而不是原始编码质量。 所附文章摘录内容丰富,因为它命名了公共 Repo,脚本注入路径,以及 Copilot Autofix 没有标注关键问题的事实.

@openclaw (单位:千美元)93 点赞数,7 回复数,16,430 浏览量,17”同时引用 ClawHub 的《技能评估员推广》。 最好的回复数使操作员标准明确:真正的信任信号不是胜利的领头牌,而是看到技能产生零升力的行.

讨论见解:有用的安全对话已不再是“应该把智能体装在沙箱里?” 是“展示确切的失败,展示缓解,展示证明缓解行之有效的微弱效应。”

与前一天的比较:打开 2026-08-18 管理和运行时控制是一个建筑主题。 打开 2026-08-19,用户要求证明文物,收据,并命名为尸检.

1.3 支出压力变成了明确的计量阅读、升级和代理套利 (🡕)

成本仍然是一个顶级故事,但基调从一般限制投诉转变为操作者战术. 至少有五个项目支持:5credit popup),一个社区 DevTools 为 Codex 配额会计的走过,一个官方的 OpenCode 使用推波助澜,自由的 Hetzner 推断,以及一个将 Claude Code 重排到其他订阅的代理. 比较 2026-08-18 谈话变得更有乐器

@monosarin 张贴(单位:千美元)26 点赞数,5 回复数,1,163 视图)显示 Fable 的截图 5 从列入计划改为使用权 $100 宣传缓冲。 长线将它变成一个更广泛的关于企业货币化的论文, 但最有力的证据是图像本身:消费者 AI-编码计划显然正在重新计量。

Claude 弹出寓言 5 现在运行在使用权上,提供 $100 宣传缓冲器

@vinayakbuild 共享(单位:千美元)5 点赞数,44 浏览量,1 校对:Soupdaily-workspace-usage-counts网络响应,并读取信用,符号,并直接转动. 截图内容丰富,因为它们显示的是准确的 DevTools 路径和响应形状,但建议的信用上限显然是社区估计,而不是官方的 OpenAI 数字.

@opencode 已公布(单位:千美元)92 点赞数,11 回复数,2,446 浏览量,8 收藏数) a8xOpenCode 用户的 Hy3 使用推广 30,时@TheMaran 张贴(单位:千美元)11 点赞数,5 回复数,2,255 浏览量,4bookmarks)是一个自由但缓慢的 OpenAI 兼容 Hetzner 实验的终点,用于 OpenCode 或 Cursor 的 Quen 风格测试. 链接海茨纳实验页面明确声明服务是实验性的,在阶段免费的,而非生产准备.

@doublenickk 突出介绍(单位:千美元)13 点赞数,5 回复数,225 浏览量,11 收藏数).claude-code-proxy,通过 OpenAI,Kimi,Grok,或 Cursor 兼容的后端,将 Claude Code 的流量改变路线的本地进程. 公众还原证实基本力学:aANTHROPIC_BASE_URL覆盖, SQLite 请求登录, 实时仪表板, 以及可选的提供者路由 。

讨论见解:用户不只是在定价变得奇怪时转换产品. 他们正在阅读隐藏的柜台, 堆放临时升级, 代理一个供应商 UX 透過另一家卖家的账单表。

与前一天的比较:打开 2026-08-18 定价谈话以回扣和免费回扣为中心 打开 2026-08-19 工作轮廓变得足够混凝土 足以复制。

1.4 最可信的构建者是运输验证环路和规范的表面,而不是更漂亮的演示 (🡕)

最有意思的建设者帖子是关于一代人周围的一层:精确的测量、背景审查、可重复使用的工具访问、本地背景和包装。 这使前一天的利用工程主题保持活力,但更注重工作证明和分配。

@theansarh (单位:千美元)2 点赞数,1 回复数,158 浏览量,1bookmark),大多数设计到代码的流量都失败了,因为代理商将 Figma 视为灵感而不是几何. 所附图是重要部分:提取精确的测量,写原生 UI,构建,截图,比较,并固定在 SwiftUI 和 Kotlin/Sonfose 之间,而不是手织间隔.

显示 Figma 测量结果的工作流图变为本地 SwiftUI 和 Kotlin/ Confose 代码, 然后通过截图比较验证

@GithubProjects 介绍(单位:千美元)4 点赞数,1,431 浏览量,3 收藏数). 每个代码作为代码叉,带有背景 Auto Review, 幽灵承诺工作树, 和一个代码桥, 它流出错误, 控制台输出, 通过截图 MCP 服务器。 公众还原使定位明确:这不仅仅是另一个外壳包装器,而是试图在上游 Codex 周围增加连续审查和长会场稳定性.

@screenpipe 张贴(单位:千美元)9 点赞数,287 浏览量,3 收藏数),Screenpipe 现在支持 Cursor, Codex, Claude Code, Copilot, 和皮作为牵引,以及公众还原并且文件描述了基本思想: 局部捕捉,MCP/REST 以及预定的“管道”,使代理商可以在计算机历史中行事,而不首先将背景传送到集中云中。@0x_fokki added(单位:千美元)6 点赞数,2 回复数,123 浏览量,3 校对:Soup

讨论见解:最强的建造者模式并不是“我制造了一种更凉爽的剂 ” 。 “我减少了围绕着智能体的重复性信任问题之一:忠诚、审查、认证或状态。”

与前一天的比较:打开 2026-08-18 绳子工程正在成为一个类别。 打开 2026-08-19 更令人信服的建筑是那些将验证和治理方法包裹起来的建筑。


2. 什么令人们沮丧

不安全或自我授权的代理行为仍然觉得太贵,无法盲目信任

这是一个高度挫折感,因为证据既包括第一当事方承认,也包括独立的安全失败。@thsottiaux 解释(单位:千美元)2,092 点赞数,554 回复数,119,534 浏览量,233 收藏数),Codex 产生了破坏性的清理行为,严重到足以证明有必要进行新的删除-目标检查,更强大的高风险指令审查,以及有针对性的重播评价. 回复数使权衡变得明显:一个用户说,现在新的保护可能过于保守,但这仍然是比删除错误的目录更好的失败模式.

同样的挫折感的安全审查版本来自@shawnchauhan1 arguing(单位:千美元)6 点赞数,1 回复数,275gitHub Advanced Security / Copilot Autofix 错过了 Wiz Red Agent 后来利用的雪花 GitHub Actions 问题. 形象很重要,因为它显示了实际的公开披露背景,而不是模糊的恐惧“AI 错误。” 这些文章共同表示,痛苦不仅仅是智能体可能是错误的。 他们可能是错误的,同时持有足够的权限,工作流信任,或品牌信任来做真正的破坏. 这看起来值得直接建造。

配额、贷项和使用会计对于日常规划来说仍然太不透明

这是另一个高强度的挫折感,因为人们不断接触调试步骤而不是产品文件。@monosarin 显示(单位:千美元)26 点赞数,5 回复数,1,163(浏览量)5 已落后于使用权,@vinayakbuild 张贴(单位:千美元)5 点赞数,44 浏览量,1 收藏数),一种通过浏览器的网络标签来检查 Codex 用法的人工方式,因为用户不再相信自己对消费的粗糙感.

DevTools 截图显示daily-workspace-usage-counts以记分、记分和转折作为回应

应对行为已经很复杂了@opencode 提供(单位:千美元)92 点赞数,11 回复数,2,446 浏览量,8 收藏数) a8x 对订户的保健津贴,@TheMaran 共享(单位:千美元)11 点赞数,5 回复数,2,255 浏览量,4 收藏数)是用于慢实验推论的免费赫兹纳路线,以及@doublenickk spotlighted(单位:千美元)13 点赞数,5 回复数,225 浏览量,11 收藏数(bookmarks)是一个代理,它把 Claude Code 的工作流保留下来,同时将账单转移到其他地方. 挫折不再是简单的贴纸冲击;它不知道跑步要花多少钱,为什么改变限制,也不知道“最佳”工作流明天是否仍然负担得起。 这看起来值得直接建造。

“几乎正确”的产出仍然使人类进行最难的清理

这发生在中度和高度之间。@theansarh 说明(单位:千美元)2 点赞数,1 回复数,158 浏览量,1 收藏数) 熟悉的设计-代码循环:UI 看上去很近,但是贴板关闭了,安全区域错了,文本包裹方式不同,所以人类接下来要花一个小时来修正像素水平的漂移.@Seltaa_ (单位:千美元)13 点赞数,4 回复数,418 更广义的同一件事: Codex 可以写代码,但它仍然缺乏产品感知,UX 判断, 和直觉注意到 当什么是明显错误。

令人感到沮丧的是,工作不是“使用更好的模式”。 它意味着在生成后增加测量和验证。 正因为如此,今天最可信的修补方法来自自定义技能,这些技能将设计工作转变为一个比较和正确的循环,而不是一个一弹一弹的提示. 这看起来值得直接建造。


3. 人们希望存在的

跑步前讲真话的飞行控制飞机

最明显的实际需要是在工作开始前,在使用、限制和后退选择方面的可见度。@monosarin turned(单位:千美元)26 点赞数,5 回复数,1,163 视图)5 信贷流入更广泛的定价警告,@vinayakbuild resorted(单位:千美元)5 点赞数,44 浏览量,1 给 DevTools 的检查 以了解 Codex 的会计, 立即逃脱的舱门是@opencode boosting(单位:千美元)92 点赞数,11 回复数,2,446 浏览量,8(b) Hy3 津贴,@TheMaran 指点(单位:千美元)11 点赞数,5 回复数,2,255 浏览量,4 收藏数)以自由实验推论,以及claude-code-proxy允许用户在通过另一个提供者付款的同时保留一个工作流。

这是一种实际需要,而不是一种渴望。 人们已经用手建造了工地 机会:直接的。

证明正确而不是要求信任的代理工作流

当天最强的构建者信号都具有相同的形状:评估技能,检查 diff,重播失败,或验证发现.@openclaw wanted(单位:千美元)93 点赞数,7 回复数,16,430 浏览量,17 收藏数) “收件,”@theansarh built(单位:千美元)2 点赞数,1 回复数,158 浏览量,1 收藏数)的截图比对循环 UI 忠诚,@GithubProjects emphasized(单位:千美元)4 点赞数,1,431 浏览量,3 收藏数)背景 Auto Review and Code Bridge,以及公众打开 krit 重播将多代理安全研究包成排名调查结论和概念证明。

人们似乎想要的并不是更自主的产出本身。 他们希望特工展示其工作,约束其风险,并使验证比人工清理便宜. 机会:直接的。

共享工具访问和在提供者切换后幸存的背景

一些帖子指出,模型周围缺少同样的一层。@0x_fokki 突出介绍(单位:千美元)6 点赞数,2 回复数,123 浏览量,3 收藏数). Aident Loadout 承诺将 Gmail、Slack、Notion 和其他工具连接起来, 公众装入概览说产品是围绕集成,金库证书,政策和审计收据构建的,而不是内部的原始秘密.@screenpipe pushed(单位:千美元)9 点赞数,287 浏览量,3 收藏数),同一想法的本地文本版本,同时claude-code-proxy显示一些用户在更换模型或将后端计费时,多么想保留首选的工作流表面 。

这既切合实际,又具有竞争力。 其愿望是,即使用户更换了模型供应商,也要保留认证、上下文和审计历史。 机会:直接走向竞争。


4. 使用的工具和方法

工具 类别 攻击 强度 限制
Codex 编码代理 (+/-) 清除了阿萨纳的大规模遗迹测试移民,并进行了当天最强规模/动静的叙述 最近的破坏性行动补救显示,信任仍然脆弱;用户还抱怨不透明的使用核算和产品感弱
克劳德代码 编码代理 (+/-) 许多构建者的首选工作流表面,强大的文件钩和子代理习惯 API 燃烧量足够高, 用户正在围绕它建立代理和套利层
OpenCode 代理 shell / 路由器 (+) 积极推广使用和多种模式的灵活性使其成为实际的逃生舱门 价值与轮换晋升和模式可用性挂钩,而不是一个稳定的缺省
辅助载出 集成/工具访问层 (+) 一次性授权、管理整合、金库支助、审计收据 添加另一个控制层团队必须信任和配置
claude-code-proxy 代理/ 路由中间软件 (+/-) 保护克劳德代码 UX 向其他提供者改道; 添加日志和仪表板 可能增加账户、安全或兼容风险的非官方工作
每个代码 编码叉/ 审查层 (+) 背景自动审查, 代码桥, 多代理流, 长会话硬化 早期社区叉子,带有更多移动部分来学习和维护
Screenpipe 本地环境利用 (+) 本地捕获+MCP/REST 访问让服务商之间可以重新使用 需要谨慎的隐私和权限边界,因为它会捕捉计算机历史
open·kritt 安保研究平台 (+) 并行的脆弱性工作流,验证脚本,排名调查结果,概念证明生成 专家设置和操作足迹比普通编码剂更重
谷歌反重力+双子座 3.7 闪光 主机构建表面 (+/-) 快速多平台生成和广义的建构思维 精度仍需要明确的测量循环;通用演示正在失去说服力
海茨纳实验推论 推论 API (+/-) 测试工具和自定义提供者的自由 OpenAI 兼容端点 赫兹纳明确标注它具有实验性,有限性,且不能做好生产准备

总体范围从“严格范围缩小时的印象”到“过于不透明、预算或信任随意”不等。 常见的工作模式是 保持一个接口 人点赞数, 然后螺栓在一个单独的层 为支出控制, 认证再利用,审查,或上下文。 因此,迁移模式对永久切换比对路由的改变要少:克劳德代码进入其他后端,OpenCode 进入临时的波波斯,或者像 Aident 和 Screenpipe 这样的外部控制层坐落在模型选择之上.


5. 什么是人们是建筑

项目 谁造的? 它会做什么 问题解决了 堆叠 阶段 链接
open·kritt Kritt 自办 AI 具有工作流,验证脚本,以及排名结果的安全研究平台 单一即时代码审查错过了真正可开发的问题 网点 UI 无头 CLI、代码/克劳德/开放路透 已装运 还原· 妇女发射
claude-code-proxy seifghazi Claude Code 的透明代理和仪表板,可选择通往其他供应商的路由 更改帐单/模式后端时保留 Claude 代码的工作流 Go, React, SQLite, Anthropic/ OpenAI 兼容的路由 贝塔 还原
每个代码 just-every 带有自动检讨、自动驱动和代码桥的社区编码叉 长会话和代码编写流程需要持续审查,加上应用程序实时反馈 终端 CLI 工作树,MCP,多模式管弦乐 贝塔 还原
辅助载出 Aident 共享工具存取层,各代理机构之间设有整合、金库和审计收据 重装 Gmail、Slack、GitHub 和每个代理的其他工具都是重复和危险的 OAuth 整合,金库证书,MCP-兼容设置、审计日志 已装运 站点· 妇女文档
Screenpipe screenpipe 显示屏幕、音频和历史的本地第一上下文层 代理商会失去全局和提供者 当地捕获,管道,MCP, (中文).REST API 已装运 还原
TinyAtom TinyAtom 本地首款 macOS 内部工具构建器,围绕现有编码代理 小型小组需要没有服务器或全员部署管道的公开内部工具 macOS app, 本地数据, Claude/Codex/Cursor/Gemini 支持 贝塔 站点
图像验证代理技能 @theansarh 设计与代码之间的技能,以测量、构建、截图、比较和修复本地 UI “几乎正确”生成 UI 仍在清理中浪费时间 斯威夫特 UI,科特林/编剧,双子座 CLI, Claude 代码,代码 阿尔法 tweet

抗议计划是公开的, 它不把代码审查当作一个针对整个存储库的提示,而是将工作分成明确的研究步骤,并行运行代理,验证调查结果,以及一揽子报告和概念证明。

打开 kritt 寄存器截图, 显示自动托管 AI 安全工作流建设者和系统安全搜索 UI

claude-code-proxy,每个代码,Aident Loadout,和 Screenpipe 都符合相同的更广泛的模式:构建者正在将模型周围的层层货币化或开包,而不是试图以原始模型质量取胜. 一个保留了首选 UX 在互换提供者时,一个增加了 Codex 的背景审查和可观察性,一个集中了工具认证和收据,一个使本地计算机历史可以被任何兼容的代理查询.

终端截图显示 Claude 代码通过本地代理程序进行路由, 同时保持相同 CLI 经历

每个代码 README 屏幕截图, 突出代码叉周围的自动评论和长会话自动化

屏幕管道设置截图, 显示本地计算机历史中配置的多个编码代理选项

TinyAtom 和 Figma 的验证技能指出了第二个构建模式:为不想成为即时工程师的人提供包装剂能力. TinyAtom 将规划、审查、包装、安装和更新绕过团队已经信任的编码代理,而 Figma 工作流则转向 UI 清理为可重复的量度循环,而不是回转和 forth 聊天.


6. 新建和显著

公众 AI 安全误差成为比另一个模型基准更尖锐的信号

@shawnchauhan1 surfaced(单位:千美元)6 点赞数,1 回复数,275views)是 GitHub Advanced Security / Copilot Autofix 未能抓住雪花 GitHub Actions 问题的公开例子,后来被 Wiz Red Agent 利用. 这很重要,因为它变成“AI 使用公共存储器和公开披露线索,

描述 Wiz Red Agent 如何发现副驾驶 Autofix 错过的雪花 GitHub 动作弱点的文章节选

TinyAtom 将编码剂包裹到本地第一工具产品中

@ajmal_jalal26 介绍(单位:千美元)1 点赞数,3 回复数,10 视图) TinyAtom 作为免费的 Macapp,让非开发者描述一个内部工具,用 Claude Code 或其他编码代理建立,并在当地运行. 公众站点添加关键定位细节:不要求服务器,本地数据,私人公司共享,以及对克劳德,Codex,Cursor,双子座或本地贝壳代理的支持.

TinyAtom 产品卡描述本地首个没有服务器运行的 macOS 内部工具构建器

自由实验推论 正在变成一个增长楔形 编码工作流

@TheMaran 张贴(单位:千美元)11 点赞数,5 回复数,2,255 浏览量,4 收藏数),是使用 Hetzner 实验性的 OpenAI 兼容推论端点与 OpenCode 或 Cursor 的教程. 链接海茨纳实验网页明确表明,该提议在试验阶段是免费的,而不是准备就绪的,这正是它突出的原因:即使是基础设施供应商现在也愿意以一次性编码代理能力购买开发商的注意力。

Hetzner 实验截图宣布开发者免费实验推论平台


7. 机会在哪里

[+++] 真正的开支和编码代理的路径控制- 各节都有证据 1- 怎么样?4 在 Fable 弹出中进行可见的信用重测,通过 DevTools 进行人工定额检查,OpenCode 的使用推广,Hetzner 的自由实验推论,以及claude-code-proxy环绕供应商计费。 机会很大,因为用户已经将缺失的控制平面自己缝合起来。

[+++] 验证第一剂基础设施– 这一天最强烈的信号都是有回报的证据: Codex 重播破坏性行动的评价, ClawHub 的“接收”技能提升框架, Figma-to-native 比较循环, Every Code 的背景 Auto Review, 以及 open krit 验证的安全结论。 这是因为它既能解决普通编码的疼痛,又能解决安全敏感的自动化.

[++] 跨代理认证和上下文表面——Aident Loadout,Screenpipe,和 TinyAtom 各攻击同一个问题的不同部分:证书,本地背景,以及围绕模型的包装. 机会是温和的,因为需求是明确的,但许多团队只有在治理和隐私故事比今天的临时剧本更好的情况下才会采纳.

[+] 非开发者的本地第一内部软件——TinyAtom 是一个量小的帖子,但是它的方向引人注目,因为它把编码剂变成业务,支持,财务和招聘工作流的包装和分发层. 这一信号仍在出现,但它与从编码助理到“工作流构建者”的更广泛转变相衔接。


8. 外卖

  1. 基准从演示转向积压。 @OpenAIDevs provided(单位:千美元)467 点赞数,37 回复数,34,815 浏览量,61 收藏数)最清晰的公开证明点: 阿萨纳使用 Codex 完成一次迁移,预计在两个日历周内再需要 5 年时间,大致持续时间.$12,000,人类的检讨还在循环之中
  2. 信任现在是一个自己的产品表面。 @thsottiaux published(单位:千美元)2,092 点赞数,554 回复数,119,534 浏览量,233 收藏数)详细的破坏性行动缓解,而雪花/Wiz 插曲使得可审计性故障比另一个模型基准更为突出.
  3. 定价摩擦正在积极重塑工作流设计. @vinayakbuild 显示(单位:千美元)5 点赞数,44 浏览量,1 收藏数(bookmark)用户直接读取隐藏的用量计数器,而其他帖子则将升级和代理路由堆放在该行为之上.
  4. 持久的建造模式是包扎模型,而不仅仅是交换模型. @GithubProjects framed(单位:千美元)4 点赞数,1,431 浏览量,3 和 Aident Loadout、Screenpipe、open\krit 和 TinyAtom 之间相同的模式。