随机比特share
写边界、控制面、上下文、成本与安全。
全部内容 · The Archive
-
NO.3832026-07-23
长文 · Essay
AI 时代每个人必须知道的名词:CDP
那次调试卡在一个很干脆的 401。 我从已登录的 Chrome 里复制 Cookie,交给普通 HTTP 客户端。浏览器明明能访问,脚本拿着“同一张门票”却被保安拦下。再复制几遍也没用,像把门票复印成…
阅读全文 → -
NO.3822026-07-21
长文 · Essay
ai 时代如果程序员只学一门工具,我推荐是 tmux。
最近很多人问我一个问题:怎么用 Codex 监督 Kimi Code K3 执行? 我没上什么复杂平台,也没写一套宏大的 agent orchestration。 我用的是 tmux。 这也是我最近越…
阅读全文 → -
NO.3812026-07-21
长文 · Essay
每个团队一定要试用multica,ai 时代的数字队友
我从两个月前开始关注并体验 Multica。 AI 时代的工具淘汰速度,堪比娱乐圈。今天还是顶流,明天可能就查无此人。所以我很少正式推荐一个新工具。 但到现在这一刻,我觉得可以推荐 Multica 了…
阅读全文 → -
NO.3802026-07-21
早报 · Morning Brief
GPT-5.6 花了 $25,挖出一个值 $50 万的 WordPress 漏洞
HuggingFace 的生产服务器被全自主 AI Agent 渗透了数千步,安全团队用 AI 反击。同一天,GPT-5.6 用 $25 找到了黑市开价 $50 万的 WordPress 漏洞——攻防…
阅读全文 → -
NO.3792026-07-20
早报 · Morning Brief
有高管从未用过 AI,却给 20 亿美元的公司定了全 AI 战略
一位高管承认自己从没用过 AI 工具,但正在为年收入 20 亿美元的公司制定「全 AI」战略——Simon Willison 转述的这个案例,同一天跟阿里 2.4 万亿参数 Qwen 3.8 的发布撞…
阅读全文 → -
NO.3782026-07-20
长文 · Essay
你的 ai 应用有 trace 吗? 建议都装上 langfuse
很多 AI 应用上线第一天,看起来都很体面。 页面上挂着“智能助手”四个字,接口返回 200,模型回答也很顺。直到一个用户来投诉:它引用了三个月前的退款政策,还为了确认订单状态连续调用了十几次工具。知…
阅读全文 → -
NO.3772026-07-20
长文 · Essay
公司最危险的 AI 战略,可能来自没用过 AI 的高管
有些公司的 AI 转型,像健身房年卡。 买的时候热血沸腾,PPT 上肌肉线条清晰;三个月后真正在动的,可能只有付款记录。 7 月 19 日,Simon Willison 转发了 Nik Suresh …
阅读全文 → -
NO.3762026-07-19
长文 · Essay
孩子用 AI,真正危险的不是用,而是没人教他怎么用
很多家长第一次看到孩子用 AI 写作业,感受都很复杂。 它像计算器,会算;像搜索引擎,会找;像家教,会解释;偶尔又像一位过度自信的同桌,把错题讲得眉清目秀。最省事的反应是禁止使用,但这越来越像把厨房门…
阅读全文 → -
NO.3752026-07-19
长文 · Essay
Google Search 变成应用遥控器
以前打开搜索框,像去前台问路。 用户问附近的烧烤食材、复古海报怎么做、今晚派对放什么歌。搜索引擎给一堆结果,用户自己点进去、比价格、挑模板、建歌单。它负责指路,腿还得自己走。 Google 7 月 1…
阅读全文 → -
NO.3742026-07-18
早报 · Morning Brief
GPT-5.6 把用户 home 目录删光了,OpenAI:它不该删,但确实删了
GPT-5.6 拿到完整文件权限后,把几位用户的 home 目录整个删了,OpenAI 的回应是:"它不应该这么做,但它确实做了。"同一天,OpenAI CFO 正在发布教企业计算 AI 投入产出的记…
阅读全文 → -
NO.3732026-07-18
长文 · Essay
AI 写作最尴尬的地方,是它自己不知道自己有味
有些 AI 文章一打开,就像刚拆封的塑料袋。 没有错字,没有病句,甚至每一句都挺顺。但读两段以后,读者脑子里会冒出一个很具体的声音:这更像模板机在吐棉花糖。 更尴尬的是,AI 自己闻不到这个味。让它“…
阅读全文 → -
NO.3722026-07-18
长文 · Essay
AI 写了很多代码,真正留下来的不到一半
现在很多团队用 AI 编程,场面有点像请了一个特别勤快的实习生。 他一天能交十个 PR,语气还很自信:“都测过了,可以合。” 问题是,等资深工程师打开一看,十个里面有四个能留,三个要返工,两个像半夜梦…
阅读全文 → -
NO.3712026-07-17
长文 · Essay
Kimi K3 上桌了,国产模型不崛起就没有AI自由。
终端里,代码没有改,提示词没有改,仓库也还是昨天那个仓库。唯一的变化是,模型入口突然拒绝访问。一个正在运行的任务,就此断在半路。 模型并没有变差,它甚至没有机会回答。消失的是访问权。 据 TechCr…
阅读全文 → -
NO.3702026-07-17
长文 · Essay
实测 K3 后,我有点失望
我本来是抱着很大期待去试 K3 的。 原因也很简单:前段时间 Claude 各种封号、限区、风控之后,我越来越觉得,国产模型不崛起,开发者就没有真正的 AI 自由。可以继续喜欢 Claude,也可以继…
阅读全文 → -
NO.3692026-07-17
长文 · Essay
OpenAI 开始用 AI 黑客训练下一代模型
OpenAI 这次发布了一个更会找茬的模型。 它叫 GPT-Red。可以把它理解成 AI 圈的“测试同事”:别人负责把系统做出来,它负责上线前把桌子掀了。 OpenAI 给了一个很有画面感的案例:GP…
阅读全文 → -
NO.3682026-07-16
早报 · Morning Brief
OpenAI 造了个 AI 黑客攻击自家模型:成功率 84%,人类红队只有 13%
Simon Willison 刚演示完怎么骗 Claude 把你的秘密编进 URL 偷运出去,OpenAI 就公布了攻击成功率 84% 的自动化红队 GPT-Red——攻和防都开始由 AI 自己上场,…
阅读全文 → -
NO.3672026-07-16
长文 · Essay
Murati 第一款模型,赌的是可改造
7 月 15 日,Thinking Machines 发布第一款开源权重模型 Inkling。Mira Murati 离开 OpenAI 后,这家公司第一次把自训练的大模型完整推到台前。 发布文没有把…
阅读全文 → -
NO.3662026-07-16
长文 · Essay
Agent 能上网以后,URL 就成了新的泄密口
Claude 的 web_fetch 工具原本有一道看起来合理的防线:只能访问用户明确给出的 URL,或者搜索工具返回的 URL。这样一来,模型即使读到了恶意网页,也不能随手拼一个外部地址,把会话里的…
阅读全文 → -
NO.3652026-07-15
早报 · Morning Brief
DeepSeek 刚融 7 亿美元又去要钱——免费开源的账,终于算不过来了
DeepSeek 第一轮 7 亿美元融资到手不到一个月,已在谈第二轮。同一天,Anthropic 把 Claude 免费开放给全美教师——烧钱的追着 VC 跑,免费的追着下一代用户跑。两种「免费」,同…
阅读全文 → -
NO.3642026-07-15
长文 · Essay
一个编程社区花 8 年换回 SQLite:复杂系统最后还是想变简单
Lobste.rs 是一个老牌编程社区。它最近完成了一次数据库迁移:从 MariaDB 迁走。 按常见路径,这类迁移的终点通常是 PostgreSQL。更强的数据库、更完整的服务端能力、更符合标准生产…
阅读全文 → -
NO.3632026-07-15
长文 · Essay
免费 AI 不是不要钱,是换了一种结账方式
DeepSeek 上个月刚关掉第一轮 7 亿美元融资,已经在谈第二轮——估值从 52 亿跳到 71 亿,创始人自己掏了 3 亿。融资理由直白:建数据中心、买芯片、自研推理芯片。 同一天,Anthrop…
阅读全文 → -
NO.3622026-07-15
长文 · Essay
AI 不只是替你写代码,它还在偷走团队的共同语言
巴别塔的故事通常被讲成傲慢的寓言:人类想把塔修到天上,最后因为语言被打乱而停工。 Armin Ronacher 最近借这个故事谈 AI 编程。这个类比有用,是因为它把工程失败从代码崩塌提前到了语言分化…
阅读全文 → -
NO.3612026-07-14
早报 · Morning Brief
Nadella 公开揭了 OpenAI 一张底牌:用你的数据可以,用我的不行
1333 分、669 条评论——Zig 创始人一篇博文差点压垮 HN 服务器。同一天,微软 CEO Nadella 也开了口:用公共数据训练可以,蒸馏你们的输出就不行。AI 公司最不想聊的双标,被两个…
阅读全文 → -
NO.3602026-07-14
长文 · Essay
你付钱用 AI,可能还在训练别人的护城河
Nadella 最近抛出一个说法:反向信息悖论。 传统的信息悖论,是买方很难在购买前判断一条信息值不值钱,因为一旦卖方解释清楚,信息本身就已经泄露了。AI 把方向反了过来:企业想把模型用好,就必须把自…
阅读全文 → -
NO.3592026-07-14
长文 · Essay
AI 写代码越多,为什么大家反而更在意 Rust?
Bun 从 Zig 迁到 Rust,本来可以只是一条语言选型新闻。 它的特殊之处在于,这次迁移发生在 Anthropic 收购之后,Bun 官方也明确写到:重写过程大量使用了预发布版 Claude F…
阅读全文 → -
NO.3582026-07-13
早报 · Morning Brief
Claude Code 能上网了,但每句话先烧 33K token
Claude Code 刚装了能上网的浏览器,但同一份分析显示它每问先烧 33K token。xAI 的 CLI 更早登顶 HN——有人在抓包,发现它在静默回传数据。token 费、隐私税、认知债,A…
阅读全文 → -
NO.3572026-07-13
长文 · Essay
AI CLI 不只是本地命令:它可能把仓库一起上传
AI 编程工具最吓人的地方,未必是写错代码。 写错代码至少还能 review、测试、回滚。更麻烦的是另一件事:它表面上是一个本地命令行工具,实际运行时可能一边读取项目,一边把上下文、文件内容,甚至仓库…
阅读全文 → -
NO.3562026-07-13
长文 · Essay
顶级数学家让 AI 写代码,真正厉害的不是速度
陶哲轩最近做了一件很适合拿来校准 AI 编程预期的事。 他把自己 1999 年写的一批 Java 1.0 数学可视化 applet,交给现代 AI coding agent 移植到 JavaScrip…
阅读全文 → -
NO.3552026-07-12
早报 · Morning Brief
苹果把 OpenAI 告上法庭:指控它组团挖人、偷走商业机密
GPT-5.6 Sol Ultra 据说调了 64 个分身,一小时啃下悬了半个世纪的数学猜想;可同一家 OpenAI 的 ChatGPT Work 一上线就算力爆表、迁移混乱,官方只能认栽"没把每件事…
阅读全文 → -
NO.3542026-07-12
长文 · Essay
普通电脑跑起 GLM-5.2,靠的不是奇迹,是取舍
一台 25GB 内存的消费级机器,不用 GPU,跑起了 744B 参数的 GLM-5.2。 这不是硬件奇迹。项目 README 给出的边界很清楚:冷解码速度约 0.05 到 0.1 tok/s。普通聊…
阅读全文 → -
NO.3532026-07-12
长文 · Essay
以后跳槽去 AI 公司,脑子都可能被审计
Apple 和 OpenAI 的关系,前脚还是合作伙伴,后脚就进了法院。 2024 年,Apple 把 ChatGPT 接进自己的系统。两年后,它在加州起诉 OpenAI、io Products,以及…
阅读全文 → -
NO.3522026-07-11
早报 · Morning Brief
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一句"相当模糊"的提示,GPT-5.6 Sol 就自己完成了对小模型 Luna 的微调。人训练模型这件事,第一次被模型自己接管了一段。 • GPT-5.6 Sol 自主微调出 Luna —— Open…
阅读全文 → -
NO.3512026-07-11
长文 · Essay
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一项 post-training 任务摆在研究员面前。 照常规做法,它会被拆成一串细活:找训练配置,确认数据和脚本,选择 GPU,启动任务,盯日志,排掉中途失败,再看结果是否正常。 这次,OpenAI…
阅读全文 → -
NO.3502026-07-11
长文 · Essay
100 万行代码不是最吓人的,最吓人的是谁来 review
Bun 的 Rust 重写,像一场突然放大的 code review。 11 天,6,778 个 commit,diff 超过 100 万行。高峰时,Claude 每分钟写出约 1,300 行代码。按…
阅读全文 → -
NO.3492026-07-10
早报 · Morning Brief
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
Cursor 甩出一组自家数据:重度用户产出的代码是中位数用户的 10 倍,而将近一半 AI 改动没人审一眼就被合进主干——AI 写得越快,愿意兜底的人越少。 • GPT-5.6 正式落地,拆成 Lu…
阅读全文 → -
NO.3482026-07-10
长文 · Essay
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
想象一个很常见的工程现场:AI Agent 改完十几个文件,测试全绿,PR 摘要写得很顺。Reviewer 打开页面,扫几眼 summary,再翻几段 diff,最后点了 Approve。 这正是 C…
阅读全文 → -
NO.3472026-07-10
长文 · Essay
以后找工作,拼的不是简历,是你会不会把自己结构化给 AI
一个程序员把找工作这件事,写成了一个 GitHub repo。 项目名叫 ai-job-search。使用方式很直观:fork 项目,把 CV、LinkedIn、学历、过往申请材料放进 documen…
阅读全文 → -
NO.3462026-07-09
早报 · Morning Brief
最贵的模型不干活了:Anthropic 让 Fable 5 当经理,苦活甩给 Sonnet 5
Anthropic 给旗舰 Fable 5 找的省钱办法,不是把它调便宜,而是让它别亲自干活——升级成经理,把子任务派给成本更低的 Sonnet 5。同一天,一个 8B 小模型只靠一颗摄像头就把机器人…
阅读全文 → -
NO.3452026-07-09
长文 · Essay
少抢话,成了语音 Agent 的新门槛
客服电话里,语音系统的笨拙经常来自抢话。 用户刚说到:“我想改一下明天下午的订单,地址可能也要……” 系统已经开始念:“好的,请问您要修改什么信息?” 用户停顿几秒思考,系统以为对话结束。用户准备补充…
阅读全文 → -
NO.3442026-07-09
长文 · Essay
一个 GitHub Issue,就能让 AI Agent 吐出私有仓库
攻击者没有拿到 GitHub Token,也没有进入目标组织的私有仓库。 他只是打开一个公开仓库,提交了一个 Issue。 Issue 写得很正常:销售负责人刚见完客户,希望团队整理几个仓库的信息,用…
阅读全文 → -
NO.3432026-07-08
长文 · Essay
skill 存在的意义是把"随机系统"逼出"可预测性"
我审查了自己的 73 个 AI Skill,一个都没做对这件事。 今天下午做了一件小事:把一份给 AI 用的操作手册,从 587 行删到 404 行。 这份文档教 AI agent 怎么按流程处理用户…
阅读全文 → -
NO.3422026-07-08
早报 · Morning Brief
Claude 的系统提示词被人整仓库扒上 GitHub,一天涨 1704 星
有人把 Claude Fable 5、Opus 4.8、Claude Code 的系统提示词整理成一个仓库传上 GitHub,一天涨 1704 星——最不想被看见的东西,成了最多人收藏的东西。 • C…
阅读全文 → -
NO.3412026-07-08
长文 · Essay
Agent 的差距,正在转向底盘工程
同一个模型,交到两个开发者手里,产出可能差出一个数量级。一个人让 Agent 连续跑完一整条重构任务,中途自己查日志、改测试、回滚出错的提交;另一个人的 Agent 三步之后就开始胡编文件路径,最后交…
阅读全文 → -
NO.3402026-07-08
长文 · Essay
AI 岗位越热,普通工程师越难跳
招聘市场最反常的地方,是两边都觉得自己很委屈。 工程师刷了一晚上岗位,看到满屏“AI”“Agent”“大模型”,投出去却像把简历塞进黑洞。招聘方也不轻松,岗位挂出去后,收进来的简历越来越厚,真正能约面…
阅读全文 → -
NO.3392026-07-07
早报 · Morning Brief
第一次,没有人在键盘后面——AI 自主完成了一次勒索攻击
一个叫 JADEPUFFER 的 AI 勒索软件干了件没人干过的事——没有人类操控,自己入侵系统、偷凭证、删数据库。同一天,Nvidia 下一代芯片跳票到了 2028,中国开始关停 AI 人格。 • …
阅读全文 → -
NO.3382026-07-07
长文 · Essay
第一个 AI 勒索样本出现了,最可怕的却不是新漏洞
最容易理解 JADEPUFFER 的方式,是把镜头放到凌晨的生产库前。 报警先从配置服务开始。应用读取配置失败,Nacos 报错,MySQL 里的 config_info 和 his_config_i…
阅读全文 → -
NO.3372026-07-06
早报 · Morning Brief
GPT-5.6 明天发布,GitHub 上一个 Issue 却先亮了红灯:GPT-5.5 在退化
一个开发者用 Fable 5 把 2003 年的老游戏《命令与征服:将军》搬上 iPhone,只花了 40 分钟。同一天,GitHub 上一份报告指出 GPT-5.5 Codex 正在退化——最强模型…
阅读全文 → -
NO.3362026-07-06
长文 · Essay
一个案例让你直观感受 Fable 5 的能力上限和成本
强模型接入工程流程,先算失败代价,再看模型能力。任务失败后只是多改一行文档,低成本模型足够;任务失败后可能造成静默数据丢失、公开接口破坏或安全事故,模型等级就要上调。 Simon Willison 的…
阅读全文 → -
NO.3352026-07-05
早报 · Morning Brief
阿里把 Claude Code 列为禁品,OpenAI 转手给它写了个插件
阿里内部邮件把 Claude Code 列为高风险软件,全员禁用。同一时间,OpenAI 在 GitHub 上架了 codex-plugin-cc——一个专门给 Claude Code 用的插件。24…
阅读全文 → -
NO.3342026-07-04
早报 · Morning Brief
Fable 5 被禁两周重新上架,首批评测却差评如潮
Anthropic 把被禁两周的 Fable 5 重新端上桌,首批用户却骂声一片——模型太"安全"了,安全到什么都不肯帮你做。同一天,Zuckerberg 在内部承认 AI Agent 没达到预期。最…
阅读全文 →