《Claude Code橙皮书》出纸质版了,但有两种人我劝你别买
出书本来是件开心事,该好好跟你们说一声。不过在你掏钱之前,我想先说句实话:这本书,有些人真没必要买。
做过的事,走过的路,都写在这里。
选一个手上的问题,从一篇实践开始。
AI工具、独立开发、内容创作,边读边动手。
出书本来是件开心事,该好好跟你们说一声。不过在你掏钱之前,我想先说句实话:这本书,有些人真没必要买。
这还真是个挺有代表性的事,以后你的Agent真的能替你花钱了… 但是我想大家更希望的应该是发个指令,让Agent直接给自己收钱赚钱去…
昨天用Claude Fable 5开发的开源项目Fanbox,不到24小时,又改了10多个版本...
上周,我基于微软最新的SkillOpt论文和开源项目,对我达尔文.skill项目做了升级,纳入了SkillOpt的skill进化策略。 没想到这周就看到微软的官方GitHub上提到了他们的框架被我采纳的事。 这种开源社区的互动还挺有趣的。
这两个月我一直在折腾Agent skill的事,一是想持续把自己日常的工作流标准化,抽象成skill;二是在想怎么让 AI 自己搞定技能。
前几天,海外的AI圈和基础科学的学术圈有个传闻挺热闹的:尹希,哈佛史上最年轻的华人正教授,弦理论这门基础科学里最难啃方向的顶尖学者,据爆料离开哈佛去了OpenAI。当然,到目前为止OpenAI、哈佛和他本人都还没正式回应,也有人说他只是停薪留职去那边待一阵。
前阵子Opus 4.8出来,我印象最深的不是分数,是它新增的Dynamic Workflows:你描述一件大事,它自己写出一段脚本,一口气调起几十上百个子agent并行干活,把活拆开同时跑完。
前天凌晨Anthropic发了Opus 4.8。
我前阵子在GitHub上开源了一个有点意思的skill,叫达尔文(darwin-skill)。
昨天在X上刷到 Artificial Analysis 一条推文。
今天对我而言,算是解锁了一个新体验。上了CCTV-1和新闻频道的焦点访谈节目,而且居然不是打酱油的角色,还有不少台词。
最近我在重读亚当·斯密的《国富论》。作为一个本科学经济学的,其实挺不好意思的是我从来没完整读完过这本经济学的开山之作。
这本《创始人行动手册》是 Anthropic上周发布的官方手册,原版 36 页。从Anthropic产品两天一小版,每周一大版的更新节奏来说,我觉得他们是这个时代最AI Native的大公司了。这本手册里融入了不少他们内部的经验以及他们所服务的最先进的AI native初创公司的做法。
https://weread.qq.com/r/weread-skills
前几天看姚顺宇在张小珺最近那期4小时访谈里说,他在Google DeepMind主要做ML Coding和Long Horizon(长程任务)。后者就是让模型能够连续干好几个小时甚至好几天才能完成的复杂活。他说的是让单个AI变得更聪明。
一昨天,我突然收获了一个人生少有的顿悟时刻。过去两三年,关于AI最主流的两种叙事几乎是相反的。
花了大半天把张小珺访谈姚顺宇的4小时长访听了一遍。这位去年刚从Anthropic跳到Google DeepMind的哥们,参与过Claude 3.7/4.5和Gemini 3。他给了很多实诚的头部大模型一线研究员的视角。访谈信息密度相当高。说几条我觉得最有意思的:
花叔:AI 编程进入多 Agent 阶段后, 真正稀缺的不是执行力, 而是人类的注意力、判断力和调度力。
我是也成老登了么😢最近常常在各种场合被要求给年轻人提供学AI的建议。 昨天在参加一个黑客松圆桌的时候,又面对了这样的问题。
最近一个月模型发布太卷了。Claude Opus 4.7、GPT-5.5、DeepSeek V4 一个接一个,我每天打开 X 都觉得自己快被新模型淹没。
一家公司里,真正在发生的「数据」,有一大半根本不在线上。而缺乏数据这件事,让AI在企业内的落地变得尤其困难。
最近,我的女娲.skill 和 Huashu Design 似乎太出圈了。
在我看来,DeepSeek不是一个冲破天花板的SOTA模型。它真正的价值是把百万上下文、Agent原生能力、能接受的价格这三件事第一次绑在了一起。
写完文章后,我已经拿Codex中的GPT-5.5测了不少长步骤的复杂任务:做动画、做PPT、做网站。