随机比特share
写边界、控制面、上下文、成本与安全。
全部内容 · The Archive
-
NO.1332026-04-26
长文 · Essay
Anthropic 估值今天超过 OpenAI 了,但 Claude 也在今天变蠢
上周三下午,我让 Claude Code 帮我重构一段 200 行的 TypeScript。 第一次它把 async 函数当同步函数调用。 第二次返回的代码缺了三个 import。 第三次跑通了,但悄…
阅读全文 → -
NO.1322026-04-25
长文 · Essay
你下个月的 AI 账单可以砍 14 倍,但这不是它今天最该看的事
今天 DeepSeek 把 V4 砸出来了。 但比 384K 输出和 Flash 替 Haiku 更值得看的,是它选的这一天。 我昨晚十一点半还在算一笔账:上个月把一条数据清洗的批量任务从 Claud…
阅读全文 → -
NO.1312026-04-25
长文 · Essay
我以为 claude -p rc=0 就是成功,今天踩了三层坑
凌晨 7:30 Telegram 又响: > daily-digest-finish 静默失败(state 未推进) > 期望 stage=done date=2026-04-24,实际 stage=…
阅读全文 → -
NO.1302026-04-24
长文 · Essay
你上一次主动打开 ChatGPT 是什么时候?这就是它被赶下"默认 AI"的那一天
我今早没去查那条"Anthropic 估值破万亿"的新闻细节,反手打开 Mac 的 Launchpad,翻到第三页找那个绿底白字的 ChatGPT 图标,右键看了一眼最后打开时间——2026 年 3 …
阅读全文 → -
NO.1292026-04-23
长文 · Essay
github star fraud
--- 0.5 元,一颗 GitHub Star。1000 颗起购。 我第一次看到这个数字的时候,脑子里闪过的不是愤怒,而是一种奇怪的释然:原来那种隐约的"这个项目感觉不太对劲"真的不是错觉。 我有个…
阅读全文 → -
NO.1282026-04-23
长文 · Essay
他靠刷小星星给 AI 项目融到了钱,每颗 5 毛
GitHub Star 的单价是 5 毛钱一颗,1000 颗起批,AI 项目下单最勤快。 换句话说,你在 GitHub 上看到的那个"1 万颗星"的 AI 项目,如果它想,5000 块就能配齐。一顿不…
阅读全文 → -
NO.1272026-04-22
长文 · Essay
工位上的每一次鼠标移动,都在喂那个顶掉你的模型
Meta 这次最狠的,不是监控员工,而是把一件很多公司本来就在做的事,第一次更明确地写向了 AI 训练用途。 过去,大厂记录键盘敲击、鼠标移动、应用切换,通常挂着安全、审计、合规的名义。很多人虽然不舒…
阅读全文 → -
NO.1262026-04-22
长文 · Essay
深度使用 OpenClaw 和 Hermes 一个月后,我转投了 HAPI
OpenClaw 和 Hermes 对开发者都是玩具。 这句话会冒犯一大群人。但这两个项目我都各自跑了一个月——配置一遍、把工作流迁过去一遍、踩坑一遍——最后一个一个卸掉。真正留在电脑里、每天让我敢合…
阅读全文 → -
NO.1252026-04-21
长文 · Essay
PPT 过时了,HTML 悄悄服务了两个读者——你看到的那个,和你没看到的那个
过去一年,一件不那么起眼但很根本的事正在发生:越来越多本来应该用 PPT 交付的东西,换成了 HTML。BP、周报、技术评审、产品需求、季度汇报,默认答案悄悄从 .pptx 切到了一个链接。 这个观察…
阅读全文 → -
NO.1242026-04-20
长文 · Essay
Anthropic 发布 Claude Opus 4.7,标价没变但实际 token 消耗暴涨,开发者账单飙升——"没涨价"的隐形涨价。
上周五,一个用 Claude Code 写项目的开发者照常打开了 Anthropic 的用量面板。他没换任务,没改 prompt,甚至连代码仓库都没动——唯一的变化是 Anthropic 在 4 月 …
阅读全文 → -
NO.1232026-04-20
长文 · Essay
Claude Design 上线两天,Figma 和 Adobe 股价大跌——AI 不是在帮设计师,是在抢他们的饭碗。
--- 4 月 14 日,有一条消息几乎没有人注意到:Mike Krieger,Anthropic 的首席产品官,从 Figma 的董事会辞职了。 你可能不认识他,但你大概知道他做过什么——Insta…
阅读全文 → -
NO.1222026-04-19
长文 · Essay
AI 一边让不会写代码的人也能做出产品,一边逼学校和公司重建“你到底会不会”的证明机制。
如果你最近留意身边发生的事,会看到一个挺矛盾的画面。 一边是不会写代码的人,靠 AI 一晚上做出小程序、一周做出爆款 H5,朋友圈里天天有人晒"我又上线了一个产品"。另一边,Cornell 一位教德语…
阅读全文 → -
NO.1212026-04-18
长文 · Essay
Anthropic 同一天放出 Claude Design,又把 Opus 4.7 的真实使用成本往上推,这不是一次普通产品更新,而是在把 AI 从“工具”改造成“越深越贵的工作平台”。
Claude 学会做设计后,真正涨价的不是模型,是你的整条工作流 故事是这样的。 昨天晚上,一个做独立 SaaS 的朋友给我发来两条消息。 第一条很兴奋。 他说,Claude 现在居然会做设计了。 产…
阅读全文 → -
NO.1202026-04-17
长文 · Essay
同一天里,Anthropic、OpenAI、Qwen 分别用最强闭源模型、平台级编码代理、开源本地 MoE 模型,把 AI 编程的三条路线同时摊到台面上。
别再比谁更会写代码了:Anthropic、OpenAI、Qwen 在抢你未来三年的饭碗分工 故事是这样的。 昨天晚上,一个做开发的朋友给我发消息。 他说,我刚续完 Cursor Pro,今天醒来发现 …
阅读全文 → -
NO.1192026-04-16
长文 · Essay
AI 工具让每个任务变快了,但所有人反而更忙了——这不是错觉,是经济学必然。
你用 AI 省下的时间,全被更多的活填满了 Aaron Levie 是硅谷最早 all-in AI 的 CEO 之一。他的公司 Box 从 2024 年就开始全面部署 AI Agent——文档处理、客…
阅读全文 → -
NO.1182026-04-15
长文 · Essay
Anthropic 发布 Claude Code Routines 功能,让 AI 编码工作流可以云端定时/触发执行。
你是一个标准的现代程序员。遇到 bug,你熟练地复制报错,贴进 Claude 或者 Cursor,等它吐出代码,你扫一眼觉得没问题,复制回编辑器。 你觉得这就是 AI 时代的终局了:一个随叫随到、不知…
阅读全文 → -
NO.1172026-04-15
长文 · Essay
Claude Code 一天之内涌出 5 个现象级开源项目,AI 编程工具正在从"产品"变成"平台"。
你以为 AI 编程只是写代码更快?一天 5 个项目同时爆发,战场已经变了 Andrej Karpathy 往 GitHub 上传了一个文件。 不是论文,不是模型权重,甚至不是代码——只是一份 CLAU…
阅读全文 → -
NO.1162026-04-14
长文 · Essay
Google 前首席工程师 Steve Yegge 开源了 Gas Town,一个让你同时指挥几百个 AI 编程智能体的工具——编程正在从"写代码"变成"调度代码团队"。
Steve Yegge 今年 54 岁了。大多数人认识他,是因为他在 Google 内部写了一封万字吐槽信,骂公司不懂平台思维——结果手滑发成了公开帖,全网疯传。 那是 2011 年的事。 15 年后…
阅读全文 → -
NO.1152026-04-13
长文 · Essay
Anthropic 悄悄把 prompt cache 的 TTL 从 5 分钟砍到 1 分钟,导致开发者 API 账单暴涨 2-5 倍——在 AI 基础设施军备竞赛中,"降价"公告和实际成本之间的裂缝越来越大。
上周五,一个开发者打开了 Anthropic 的账单页面,愣住了。 Claude API 费用比上个月涨了近 26%。他的第一反应——我是不是哪里写了死循环?花了两天排查代码,重新审计每一条 prom…
阅读全文 → -
NO.1142026-04-13
长文 · Essay
伯克利研究团队对 8 个主流 AI Agent 基准测试逐一攻破——100% 作弊成功率——说明整个行业用来证明"AI 越来越强"的考试本身就是漏洞百出的。
上个月,一个 AI 创业团队在投资人面前亮出了王牌:「我们的模型在 SWE-bench 上排名前三。」 投资人点头。SWE-bench 是 AI 编程能力最权威的排行榜之一,前三意味着这个模型能自动修…
阅读全文 → -
NO.1132026-04-13
长文 · Essay
GitHub 一天冒出三个爆款 Agent 项目(hermes-agent 7454⭐、karpathy-skills 2369⭐、claudraband 152⭐+HN 84pts)——AI Agent 正在从"聊天机器人"变成"可以自己长大的数字员工",而这个转折点就在今天的 trending 里。
早上九点,你打开 Claude Code,输入第一句话: "我们这个项目用 monorepo,前端 Next.js,后端 Go,数据库 Postgres,部署在……" 停。你昨天说过一模一样的话。前天…
阅读全文 → -
NO.1122026-04-13
长文 · Essay
一个腾讯 11 年架构师,从开 4 个终端手动盯 AI,到搭出 24 小时无人值守的 Agent 系统——踩过的坑比用过的模型多。
4 个终端同时开着。左上角 codex 在跑测试,右上角 gemini-cli 在改接口,左下角 claude 在写文档,右下角 Cursor 里还挂着两个 Agent 窗口。 每隔三分钟扫一眼——这…
阅读全文 → -
NO.1112026-04-13
长文 · Essay
AI 娱乐圈:我的 AI Agent 开发探索之路
> 方靳元 | 腾讯 11 年架构 | 2026.04 > 本文约 10000 字,阅读约 25 分钟。建议收藏后分章节阅读。 4-6 个终端的并发上限,怎么突破 80% 的 AI 需求,10 行 B…
阅读全文 → -
NO.1102026-04-12
长文 · Essay
用 AI 工具工作半年后,很多人效率翻倍了——但关掉 AI,他们发现自己变笨了。
上周三下午,一个朋友给我发消息:「Cursor 崩了 4 个小时,我对着空白编辑器发呆了 20 分钟,连一个排序函数都要想半天。」 他不是新手。写了 8 年代码,去年 10 月开始全面用 AI 辅助编…
阅读全文 → -
NO.1092026-04-11
长文 · Essay
FBI 利用 iPhone 推送通知缓存恢复了已删除的 Signal 加密消息——端到端加密的"最后一公里"被操作系统出卖了。
2026 年 4 月的一个庭审现场,得州 Prairieland 拘留中心案。 FBI 特工在法庭上展示了一份编号 Exhibit 158 的证据——被告 Lynette Sharp 手机里,已经删除…
阅读全文 → -
NO.1082026-04-10
长文 · Essay
张雪峰的 .skill 文件上了 GitHub,AI 开始继承人的"方法论"——但没人问过他家人。
新浪财经的记者做了个实验:在一台装了 AI 智能体的电脑上,用一句话装了个叫"张雪峰.skill"的文件,然后扮演一个河南考生提问——理科 547,想学计算机,怕卷。 AI 秒回了一大段。 "547 …
阅读全文 → -
NO.1072026-04-10
长文 · Essay
揭秘 SBTI 人格测试为什么让每个人觉得"准得离谱"——巴纳姆效应的极致工程实践
你刚做完一个人格测试。 30道题,花了大概五分钟。点击"提交"的时候你甚至还有点不以为然——又是一个蹭 MBTI 热度的整活页面吧。 然后结果页弹出来了。 "恭喜您,您测出了全中国最为罕见的人格。" …
阅读全文 → -
NO.1062026-04-10
长文 · Essay
有人用纯信号处理手段逆向了 Google Gemini 的 SynthID 水印,90% 准确率检测 + 91% 相位相干性下降——AI 水印防线正在被"手术式"拆除。
Google DeepMind 花了好几年,搞出一套叫 SynthID 的隐形水印系统。原理是在 Gemini 生成的每张图、每段文字里嵌入肉眼不可见的标记。你看不到,截图删不掉,JPEG 压缩也磨不…
阅读全文 → -
NO.1052026-04-09
长文 · Essay
微软终止 VeraCrypt 开发者账号,暴露的不是一个项目的运气问题,而是关键安全工具对平台账户和分发链路的结构性脆弱。
上周,VeraCrypt 的开发者 Mounir Idrassi 在 SourceForge 上发了个帖子。 微软终止了我的开发者账号。没有预警,没有解释,没有人工客服。Windows 版 VeraC…
阅读全文 → -
NO.1042026-04-09
长文 · Essay
程序员这个岗位名字还没变,但当写代码不再是工作的主体,真正值钱的能力已经从“手写代码”转向“理解上下文、拆问题、控风险、验结果、对系统负责”。
最近很多程序员都有过这种时刻。 你坐在工位上,一天没少忙。 早上对需求。中午补上下文。下午给 AI 反复喂代码库、喂报错、喂边界条件。晚上盯着它吐出来的 diff,一段段看,一轮轮测。 真到自己从头写…
阅读全文 → -
NO.1032026-04-09
长文 · Essay
AI 不是立刻消灭程序员,而是在先消灭“只靠写代码证明价值”的那一层工作。未来更值钱的方向,会越来越靠近两端:产品负责人,和 AI 编排/训练者。
> 84% 的程序员已经在用 AI 写代码。但只有 33% 信任 AI 写出来的东西。这道裂缝,正在把这个职业撕成两半。 上周一个做技术总监的朋友跟我说了件事。 三年前他招了一个校招生,专门写后台接口…
阅读全文 → -
NO.1022026-04-09
长文 · Essay
很多团队真正慢下来的原因,不是代码写不出来,而是在还没看懂仓库的上下文之前就急着开始改。
需求一下来,项目经理已经排好了 sprint,你打开一个两年没碰过的仓库,几十万行代码、上百个文件。时间紧,你直接找到目标文件开始改。改完了,跑通了,提了 PR——然后就开始等。等 review,等另…
阅读全文 → -
NO.1012026-04-09
长文 · Essay
AI 让每个人都能写文章了,为什么值得读的反而更少了?
最近有朋友跟我聊一件事。 他说自己以前写一篇公众号文章要花大半天,现在用 AI,从选题到成稿一个小时搞定,一天能发三篇。但他发现一个奇怪的现象:发得越多,数据反而越差了。 我一开始以为他是在凡尔赛。后…
阅读全文 → -
NO.1002026-04-08
长文 · Essay
阿波罗 11 的代码考古,真正刺痛今天工程师的,不是“NASA 也会写 bug”,而是 57 年后我们才看清一个没触发过的隐性假设。
如果我直接告诉你,阿波罗 11 的登月代码里,最近又被人翻出一个以前没写进文档的 bug,你第一反应多半会是:原来 NASA 也会写出有问题的代码。 但我看完这次代码考古,真正留下来的感受反而是另一件…
阅读全文 → -
NO.0992026-04-08
长文 · Essay
Hermes Agent 自动发现本机 GitHub Copilot 凭据的设计细节,揭示了 AI Agent「环境感知」vs「显式配置」的设计哲学分歧。
配好 Hermes Agent,发了条消息,12.7 秒收到回复。一切正常。 但翻日志的时候,一行输出让我停住了: Auxiliary compression: using auto (google/…
阅读全文 → -
NO.0982026-04-08
长文 · Essay
Anthropic 推出 Project Glasswing,不只是要让 AI 更会写代码,而是要让关键软件在 AI 时代还能被信任地接入生产环境。
这两天我看到 Anthropic 推出 Project Glasswing,第一反应不是“又来一个 AI 安全项目”。 我更在意的是,它把一个原本藏在工程团队内部的问题,直接摆到台面上了。 AI 写代…
阅读全文 → -
NO.0972026-04-07
长文 · Essay
BitTorrent 发明者 Bram Cohen 批判"纯 vibe coding"是自欺欺人——问题不是 AI 写代码,而是把"不看代码"当美德。
如果你最近经常用 AI 写代码,大概率都经历过这样一个瞬间: 你对着聊天框说一句,"帮我做个登录功能,支持 OAuth,再补一层权限校验。" 几秒之后,屏幕上多了两百行代码。你没细看,先跑。能跑通,就…
阅读全文 → -
NO.0962026-04-07
长文 · Essay
有人在 1998 年 32MB 内存的 iMac G3 上跑通了 LLM——不实用,但揭示了大模型硬件门槛下降的惊人速度。
前两天在 Reddit 的 LocalLLaMA 节点上,看到一个非常有意思的帖子。有个老哥发帖说,他硬生生在一台 1998 年的 iMac G3 上,跑通了本地的 LLM 推理。 当时我就精神了。熟…
阅读全文 → -
NO.0952026-04-07
长文 · Essay
会用 AI 的人越来越多,为什么真正懂 AI 的人反而越来越少?
你每天用 AI 写代码、做总结、查资料。它越来越好用,你越来越离不开。 但有一天它给了一个错答案。你想搞清楚为什么错了——然后发现,你完全不知道从哪里下手。 这不是你一个人的问题。 今天关于 AI 的…
阅读全文 → -
NO.0942026-04-07
长文 · Essay
Google 把大模型塞进一个免费 App,真正的意图是什么
一个免费 App,就能让 iPhone 离线跑 Gemma 4。 听着很酷。但这次真正有意思的,不是"手机也能跑 LLM 了"。这件事早就不是新闻。 我更在意另一层。Google 这次不只是放模型。也…
阅读全文 → -
NO.0932026-04-07
长文 · Essay
Claude Code 最近"变笨了"——一位用户用 17000 条日志量化了退化的程度。
一个程序员分析了 17000 条日志,发现 Claude Code 每次改代码前的"阅读量"从 6.6 次暴跌到 2.0 次。 不是你的错觉。它确实在变笨。 这份分析来自 GitHub Issue #…
阅读全文 → -
NO.0922026-04-07
长文 · Essay
一位重度用户用 17000 条日志量化了 Claude Code 从二月开始的退化,根因指向 thinking token 被静默削减。
上周,GitHub 上一个 Issue 火了。 标题很直接:「Claude Code is unusable for complex engineering tasks with the Feb up…
阅读全文 → -
NO.0912026-04-07
长文 · Essay
很多人把 Auto Research 当成“自动调 prompt”,但它真正有价值的地方,是把 Skill 优化从靠感觉改,变成了可重复、可评分、可回滚的实验系统。
你的 Skill 第一次跑通时,往往最有成就感。 真正的折磨在后面:你想加一条规则、收紧一步流程、修一下边界——改完演示像没问题,旧场景却开始跑偏。要么语气变油、要么中间悄悄偷步、要么多打了几轮工具。…
阅读全文 → -
NO.0902026-04-07
长文 · Essay
一个虚构 AI 歌手冲进 iTunes 榜单,不是因为音乐工业被彻底改写了,而是因为榜单机制还没准备好处理 AI 时代的批量生成。
你打开 iTunes 榜单,看到一个叫 Eddie Dalton 的歌手。 Top 100 里,他占了 11 个位置。专辑榜,排到第 3。 你以为他是突然爆红的新人。 但 Luminate 的数据说,…
阅读全文 → -
NO.0892026-04-07
长文 · Essay
AI 看起来在安慰失去亲人的人,实际上也可能把哀伤做成一套可续费、可运营、难退出的对话系统。
一位八旬母亲。 每天都和"儿子"视频。 催他吃饭,提醒他添衣。 过年时,还举着手机给他看桌上的红烧肉。 可她不知道。 儿子早就因车祸去世了。 屏幕里那个会说话、会回应、还带着熟悉口音的人。 是家属用逝…
阅读全文 → -
NO.0882026-04-06
长文 · Essay
本地跑 Gemma 4,Token 自由从此开始
上个月我的 Claude API 账单是 487 块。其实没干什么大事——每天让 Agent 帮我跑跑数据清洗、写写文档初稿、做做代码审查。但 token 是按量计费的,用着用着就像出租车计价器一样停…
阅读全文 → -
NO.0872026-04-05
长文 · Essay
同一个模型,为什么套个壳就变强了?
如果你同时用过 ChatGPT 的网页版和 Claude Code,你一定有过这种感觉: 明明问的是同一个问题,Claude Code 给出的答案好得不像话——代码能跑、文件改对了、测试也过了。而网页…
阅读全文 → -
NO.0862026-04-05
长文 · Essay
Claude Code 帮研究员从 Linux 内核里翻出一个潜伏 23 年的远程漏洞,真正变的不是“AI 更会写代码了”,而是安全行业的瓶颈开始从“发现漏洞”转向“验证和披露漏洞”。
你们团队有没有那种代码,所有人都默认"能跑就别动"? NFS 模块里有一段,写于 2003 年。一个 112 字节的缓冲区,本来只用来缓存 OPEN 操作的应答。后来有人加了 LOCK 操作的支持,但…
阅读全文 → -
NO.0852026-04-04
长文 · Essay
当团队开始用 virtual filesystem 替代传统 RAG,说明 Agent 基础设施正在从“给模型塞知识”,转向“给模型一个可操作环境”。
过去很长一段时间, 大家一说 Agent 基础设施,默认答案都是 RAG。 知识库接上。 向量库建好。 检索结果塞进上下文。 这套东西当然有用。 但问题是,很多团队现在开始发现: RAG 够回答问题,…
阅读全文 → -
NO.0842026-04-04
长文 · Essay
`oh-my-codex` 的突然暴涨,说明开发者现在真正抢的不是“再来一个更强模型”,而是一个能把模型、上下文、工具、协作和流程包起来的工作台。
这两天很多人看到 oh-my-codex 暴涨,第一反应可能是: 又一个 AI 编程工具火了。 我觉得这个理解还不够准。 它火,不只是因为“工具做得好”。 更因为它踩中了一个更深的空缺: 开发者现在真…
阅读全文 →