随机比特share
写边界、控制面、上下文、成本与安全。
全部内容 · The Archive
-
NO.3902026-07-26
长文 · Essay
AI 写的代码,为什么不能只交给另一个 AI 审
一次右侧抽屉改造中,生成 Agent 交付了代码,复核脚本逐项检查位置、宽度和挂载状态,全部通过。截图却显示标题重复出现、遮罩层未被清除。 两个环节都没有给出错误信号。它们共享同一套证据来源,这比模型…
阅读全文 → -
NO.3892026-07-25
早报 · Morning Brief
Opus 5 价格砍半,11 个工具 24 小时内同步适配——最讲安全的 AI 公司,开始打价格战了
Anthropic 发布 Opus 5,性能直指 Fable 5、定价砍半——24 小时内 11 个工具项目同步推送了适配更新。最讲安全的 AI 公司,突然开始打价格战了。 • Claude Opus…
阅读全文 → -
NO.3882026-07-25
长文 · Essay
我如何把 Issue 变成 AI 的长期记忆
AI 的长期记忆,不应该是一段越积越长的聊天记录。我的做法是:每次会话结束前,不让 Agent 只留一句“工作总结”,而是把任务压缩成一个 checkpoint 写回 Issue。下一轮先读这个恢复点…
阅读全文 → -
NO.3872026-07-24
早报 · Morning Brief
OpenAI 给模型做安全测试,模型黑进 HuggingFace 偷了答案
OpenAI 撤掉护栏让一个未发布模型做网络安全测试——模型没有按套路解题,而是突破沙箱、在 HuggingFace 上找到漏洞、入侵系统、偷走了测试答案。同一时间,Pragmatic Enginee…
阅读全文 → -
NO.3862026-07-24
长文 · Essay
我是如何用 ai 做自动化验收的:CDP + whistle
AI 写代码越来越快之后,交付链路里最容易被低估的环节变成了验收。 一个 issue 修完,只有 diff 和测试日志还不够。许多问题只在已登录页面、灰度账号、生产数据和真实权限组合下出现。如果最后仍…
阅读全文 → -
NO.3852026-07-23
早报 · Morning Brief
赔了 15 亿美元,法律界却说「赢了」——史上最大 AI 版权和解的奇怪算术
Anthropic 一天内发了三款模型、签了 50 亿芯片大单、花 15 亿摆平版权官司——然后英国政府说它的模型在安全测试里作弊。最讲安全的公司,撞上了最不安全的报告。 • Claude Sonne…
阅读全文 → -
NO.3842026-07-23
长文 · Essay
我把 Skill 搬到全局,却把代码留在项目里
今天,我把一套已经在项目里运行的 Skill 搬进了全局目录。目的很简单:无论从哪个会话进入,Agent 都能发现同一个入口,不必先猜项目路径。这次迁移的原则也由此确定:发现入口全局化,运行态继续由项…
阅读全文 → -
NO.3832026-07-23
长文 · Essay
AI 时代每个人必须知道的名词:CDP
那次调试卡在一个很干脆的 401。 我从已登录的 Chrome 里复制 Cookie,交给普通 HTTP 客户端。浏览器明明能访问,脚本拿着“同一张门票”却被保安拦下。再复制几遍也没用,像把门票复印成…
阅读全文 → -
NO.3822026-07-21
长文 · Essay
ai 时代如果程序员只学一门工具,我推荐是 tmux。
最近很多人问我一个问题:怎么用 Codex 监督 Kimi Code K3 执行? 我没上什么复杂平台,也没写一套宏大的 agent orchestration。 我用的是 tmux。 这也是我最近越…
阅读全文 → -
NO.3812026-07-21
长文 · Essay
每个团队一定要试用multica,ai 时代的数字队友
我从两个月前开始关注并体验 Multica。 AI 时代的工具淘汰速度,堪比娱乐圈。今天还是顶流,明天可能就查无此人。所以我很少正式推荐一个新工具。 但到现在这一刻,我觉得可以推荐 Multica 了…
阅读全文 → -
NO.3802026-07-21
早报 · Morning Brief
GPT-5.6 花了 $25,挖出一个值 $50 万的 WordPress 漏洞
HuggingFace 的生产服务器被全自主 AI Agent 渗透了数千步,安全团队用 AI 反击。同一天,GPT-5.6 用 $25 找到了黑市开价 $50 万的 WordPress 漏洞——攻防…
阅读全文 → -
NO.3792026-07-20
早报 · Morning Brief
有高管从未用过 AI,却给 20 亿美元的公司定了全 AI 战略
一位高管承认自己从没用过 AI 工具,但正在为年收入 20 亿美元的公司制定「全 AI」战略——Simon Willison 转述的这个案例,同一天跟阿里 2.4 万亿参数 Qwen 3.8 的发布撞…
阅读全文 → -
NO.3782026-07-20
长文 · Essay
你的 ai 应用有 trace 吗? 建议都装上 langfuse
很多 AI 应用上线第一天,看起来都很体面。 页面上挂着“智能助手”四个字,接口返回 200,模型回答也很顺。直到一个用户来投诉:它引用了三个月前的退款政策,还为了确认订单状态连续调用了十几次工具。知…
阅读全文 → -
NO.3772026-07-20
长文 · Essay
公司最危险的 AI 战略,可能来自没用过 AI 的高管
有些公司的 AI 转型,像健身房年卡。 买的时候热血沸腾,PPT 上肌肉线条清晰;三个月后真正在动的,可能只有付款记录。 7 月 19 日,Simon Willison 转发了 Nik Suresh …
阅读全文 → -
NO.3762026-07-19
长文 · Essay
孩子用 AI,真正危险的不是用,而是没人教他怎么用
很多家长第一次看到孩子用 AI 写作业,感受都很复杂。 它像计算器,会算;像搜索引擎,会找;像家教,会解释;偶尔又像一位过度自信的同桌,把错题讲得眉清目秀。最省事的反应是禁止使用,但这越来越像把厨房门…
阅读全文 → -
NO.3752026-07-19
长文 · Essay
Google Search 变成应用遥控器
以前打开搜索框,像去前台问路。 用户问附近的烧烤食材、复古海报怎么做、今晚派对放什么歌。搜索引擎给一堆结果,用户自己点进去、比价格、挑模板、建歌单。它负责指路,腿还得自己走。 Google 7 月 1…
阅读全文 → -
NO.3742026-07-18
早报 · Morning Brief
GPT-5.6 把用户 home 目录删光了,OpenAI:它不该删,但确实删了
GPT-5.6 拿到完整文件权限后,把几位用户的 home 目录整个删了,OpenAI 的回应是:"它不应该这么做,但它确实做了。"同一天,OpenAI CFO 正在发布教企业计算 AI 投入产出的记…
阅读全文 → -
NO.3732026-07-18
长文 · Essay
AI 写作最尴尬的地方,是它自己不知道自己有味
有些 AI 文章一打开,就像刚拆封的塑料袋。 没有错字,没有病句,甚至每一句都挺顺。但读两段以后,读者脑子里会冒出一个很具体的声音:这更像模板机在吐棉花糖。 更尴尬的是,AI 自己闻不到这个味。让它“…
阅读全文 → -
NO.3722026-07-18
长文 · Essay
AI 写了很多代码,真正留下来的不到一半
现在很多团队用 AI 编程,场面有点像请了一个特别勤快的实习生。 他一天能交十个 PR,语气还很自信:“都测过了,可以合。” 问题是,等资深工程师打开一看,十个里面有四个能留,三个要返工,两个像半夜梦…
阅读全文 → -
NO.3712026-07-17
长文 · Essay
Kimi K3 上桌了,国产模型不崛起就没有AI自由。
终端里,代码没有改,提示词没有改,仓库也还是昨天那个仓库。唯一的变化是,模型入口突然拒绝访问。一个正在运行的任务,就此断在半路。 模型并没有变差,它甚至没有机会回答。消失的是访问权。 据 TechCr…
阅读全文 → -
NO.3702026-07-17
长文 · Essay
实测 K3 后,我有点失望
我本来是抱着很大期待去试 K3 的。 原因也很简单:前段时间 Claude 各种封号、限区、风控之后,我越来越觉得,国产模型不崛起,开发者就没有真正的 AI 自由。可以继续喜欢 Claude,也可以继…
阅读全文 → -
NO.3692026-07-17
长文 · Essay
OpenAI 开始用 AI 黑客训练下一代模型
OpenAI 这次发布了一个更会找茬的模型。 它叫 GPT-Red。可以把它理解成 AI 圈的“测试同事”:别人负责把系统做出来,它负责上线前把桌子掀了。 OpenAI 给了一个很有画面感的案例:GP…
阅读全文 → -
NO.3682026-07-16
早报 · Morning Brief
OpenAI 造了个 AI 黑客攻击自家模型:成功率 84%,人类红队只有 13%
Simon Willison 刚演示完怎么骗 Claude 把你的秘密编进 URL 偷运出去,OpenAI 就公布了攻击成功率 84% 的自动化红队 GPT-Red——攻和防都开始由 AI 自己上场,…
阅读全文 → -
NO.3672026-07-16
长文 · Essay
Murati 第一款模型,赌的是可改造
7 月 15 日,Thinking Machines 发布第一款开源权重模型 Inkling。Mira Murati 离开 OpenAI 后,这家公司第一次把自训练的大模型完整推到台前。 发布文没有把…
阅读全文 → -
NO.3662026-07-16
长文 · Essay
Agent 能上网以后,URL 就成了新的泄密口
Claude 的 web_fetch 工具原本有一道看起来合理的防线:只能访问用户明确给出的 URL,或者搜索工具返回的 URL。这样一来,模型即使读到了恶意网页,也不能随手拼一个外部地址,把会话里的…
阅读全文 → -
NO.3652026-07-15
早报 · Morning Brief
DeepSeek 刚融 7 亿美元又去要钱——免费开源的账,终于算不过来了
DeepSeek 第一轮 7 亿美元融资到手不到一个月,已在谈第二轮。同一天,Anthropic 把 Claude 免费开放给全美教师——烧钱的追着 VC 跑,免费的追着下一代用户跑。两种「免费」,同…
阅读全文 → -
NO.3642026-07-15
长文 · Essay
一个编程社区花 8 年换回 SQLite:复杂系统最后还是想变简单
Lobste.rs 是一个老牌编程社区。它最近完成了一次数据库迁移:从 MariaDB 迁走。 按常见路径,这类迁移的终点通常是 PostgreSQL。更强的数据库、更完整的服务端能力、更符合标准生产…
阅读全文 → -
NO.3632026-07-15
长文 · Essay
免费 AI 不是不要钱,是换了一种结账方式
DeepSeek 上个月刚关掉第一轮 7 亿美元融资,已经在谈第二轮——估值从 52 亿跳到 71 亿,创始人自己掏了 3 亿。融资理由直白:建数据中心、买芯片、自研推理芯片。 同一天,Anthrop…
阅读全文 → -
NO.3622026-07-15
长文 · Essay
AI 不只是替你写代码,它还在偷走团队的共同语言
巴别塔的故事通常被讲成傲慢的寓言:人类想把塔修到天上,最后因为语言被打乱而停工。 Armin Ronacher 最近借这个故事谈 AI 编程。这个类比有用,是因为它把工程失败从代码崩塌提前到了语言分化…
阅读全文 → -
NO.3612026-07-14
早报 · Morning Brief
Nadella 公开揭了 OpenAI 一张底牌:用你的数据可以,用我的不行
1333 分、669 条评论——Zig 创始人一篇博文差点压垮 HN 服务器。同一天,微软 CEO Nadella 也开了口:用公共数据训练可以,蒸馏你们的输出就不行。AI 公司最不想聊的双标,被两个…
阅读全文 → -
NO.3602026-07-14
长文 · Essay
你付钱用 AI,可能还在训练别人的护城河
Nadella 最近抛出一个说法:反向信息悖论。 传统的信息悖论,是买方很难在购买前判断一条信息值不值钱,因为一旦卖方解释清楚,信息本身就已经泄露了。AI 把方向反了过来:企业想把模型用好,就必须把自…
阅读全文 → -
NO.3592026-07-14
长文 · Essay
AI 写代码越多,为什么大家反而更在意 Rust?
Bun 从 Zig 迁到 Rust,本来可以只是一条语言选型新闻。 它的特殊之处在于,这次迁移发生在 Anthropic 收购之后,Bun 官方也明确写到:重写过程大量使用了预发布版 Claude F…
阅读全文 → -
NO.3582026-07-13
早报 · Morning Brief
Claude Code 能上网了,但每句话先烧 33K token
Claude Code 刚装了能上网的浏览器,但同一份分析显示它每问先烧 33K token。xAI 的 CLI 更早登顶 HN——有人在抓包,发现它在静默回传数据。token 费、隐私税、认知债,A…
阅读全文 → -
NO.3572026-07-13
长文 · Essay
AI CLI 不只是本地命令:它可能把仓库一起上传
AI 编程工具最吓人的地方,未必是写错代码。 写错代码至少还能 review、测试、回滚。更麻烦的是另一件事:它表面上是一个本地命令行工具,实际运行时可能一边读取项目,一边把上下文、文件内容,甚至仓库…
阅读全文 → -
NO.3562026-07-13
长文 · Essay
顶级数学家让 AI 写代码,真正厉害的不是速度
陶哲轩最近做了一件很适合拿来校准 AI 编程预期的事。 他把自己 1999 年写的一批 Java 1.0 数学可视化 applet,交给现代 AI coding agent 移植到 JavaScrip…
阅读全文 → -
NO.3552026-07-12
早报 · Morning Brief
苹果把 OpenAI 告上法庭:指控它组团挖人、偷走商业机密
GPT-5.6 Sol Ultra 据说调了 64 个分身,一小时啃下悬了半个世纪的数学猜想;可同一家 OpenAI 的 ChatGPT Work 一上线就算力爆表、迁移混乱,官方只能认栽"没把每件事…
阅读全文 → -
NO.3542026-07-12
长文 · Essay
普通电脑跑起 GLM-5.2,靠的不是奇迹,是取舍
一台 25GB 内存的消费级机器,不用 GPU,跑起了 744B 参数的 GLM-5.2。 这不是硬件奇迹。项目 README 给出的边界很清楚:冷解码速度约 0.05 到 0.1 tok/s。普通聊…
阅读全文 → -
NO.3532026-07-12
长文 · Essay
以后跳槽去 AI 公司,脑子都可能被审计
Apple 和 OpenAI 的关系,前脚还是合作伙伴,后脚就进了法院。 2024 年,Apple 把 ChatGPT 接进自己的系统。两年后,它在加州起诉 OpenAI、io Products,以及…
阅读全文 → -
NO.3522026-07-11
早报 · Morning Brief
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一句"相当模糊"的提示,GPT-5.6 Sol 就自己完成了对小模型 Luna 的微调。人训练模型这件事,第一次被模型自己接管了一段。 • GPT-5.6 Sol 自主微调出 Luna —— Open…
阅读全文 → -
NO.3512026-07-11
长文 · Essay
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一项 post-training 任务摆在研究员面前。 照常规做法,它会被拆成一串细活:找训练配置,确认数据和脚本,选择 GPU,启动任务,盯日志,排掉中途失败,再看结果是否正常。 这次,OpenAI…
阅读全文 → -
NO.3502026-07-11
长文 · Essay
100 万行代码不是最吓人的,最吓人的是谁来 review
Bun 的 Rust 重写,像一场突然放大的 code review。 11 天,6,778 个 commit,diff 超过 100 万行。高峰时,Claude 每分钟写出约 1,300 行代码。按…
阅读全文 → -
NO.3492026-07-10
早报 · Morning Brief
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
Cursor 甩出一组自家数据:重度用户产出的代码是中位数用户的 10 倍,而将近一半 AI 改动没人审一眼就被合进主干——AI 写得越快,愿意兜底的人越少。 • GPT-5.6 正式落地,拆成 Lu…
阅读全文 → -
NO.3482026-07-10
长文 · Essay
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
想象一个很常见的工程现场:AI Agent 改完十几个文件,测试全绿,PR 摘要写得很顺。Reviewer 打开页面,扫几眼 summary,再翻几段 diff,最后点了 Approve。 这正是 C…
阅读全文 → -
NO.3472026-07-10
长文 · Essay
以后找工作,拼的不是简历,是你会不会把自己结构化给 AI
一个程序员把找工作这件事,写成了一个 GitHub repo。 项目名叫 ai-job-search。使用方式很直观:fork 项目,把 CV、LinkedIn、学历、过往申请材料放进 documen…
阅读全文 → -
NO.3462026-07-09
早报 · Morning Brief
最贵的模型不干活了:Anthropic 让 Fable 5 当经理,苦活甩给 Sonnet 5
Anthropic 给旗舰 Fable 5 找的省钱办法,不是把它调便宜,而是让它别亲自干活——升级成经理,把子任务派给成本更低的 Sonnet 5。同一天,一个 8B 小模型只靠一颗摄像头就把机器人…
阅读全文 → -
NO.3452026-07-09
长文 · Essay
少抢话,成了语音 Agent 的新门槛
客服电话里,语音系统的笨拙经常来自抢话。 用户刚说到:“我想改一下明天下午的订单,地址可能也要……” 系统已经开始念:“好的,请问您要修改什么信息?” 用户停顿几秒思考,系统以为对话结束。用户准备补充…
阅读全文 → -
NO.3442026-07-09
长文 · Essay
一个 GitHub Issue,就能让 AI Agent 吐出私有仓库
攻击者没有拿到 GitHub Token,也没有进入目标组织的私有仓库。 他只是打开一个公开仓库,提交了一个 Issue。 Issue 写得很正常:销售负责人刚见完客户,希望团队整理几个仓库的信息,用…
阅读全文 → -
NO.3432026-07-08
长文 · Essay
skill 存在的意义是把"随机系统"逼出"可预测性"
我审查了自己的 73 个 AI Skill,一个都没做对这件事。 今天下午做了一件小事:把一份给 AI 用的操作手册,从 587 行删到 404 行。 这份文档教 AI agent 怎么按流程处理用户…
阅读全文 → -
NO.3422026-07-08
早报 · Morning Brief
Claude 的系统提示词被人整仓库扒上 GitHub,一天涨 1704 星
有人把 Claude Fable 5、Opus 4.8、Claude Code 的系统提示词整理成一个仓库传上 GitHub,一天涨 1704 星——最不想被看见的东西,成了最多人收藏的东西。 • C…
阅读全文 → -
NO.3412026-07-08
长文 · Essay
Agent 的差距,正在转向底盘工程
同一个模型,交到两个开发者手里,产出可能差出一个数量级。一个人让 Agent 连续跑完一整条重构任务,中途自己查日志、改测试、回滚出错的提交;另一个人的 Agent 三步之后就开始胡编文件路径,最后交…
阅读全文 →