「闪电.skill」发布!用Anthropic的方法论把你的产品提速3倍!
前几天,Anthropic的三位工程师在自家开发者博客claude.dev上发了一篇复盘,讲他们8月怎么用两周时间,把claude.ai网页版和Claude桌面端的核心体验整体提速了3倍左右。
做过的事,走过的路,都写在这里。
选一个手上的问题,从一篇实践开始。
AI工具、独立开发、内容创作,边读边动手。
前几天,Anthropic的三位工程师在自家开发者博客claude.dev上发了一篇复盘,讲他们8月怎么用两周时间,把claude.ai网页版和Claude桌面端的核心体验整体提速了3倍左右。
我觉得把这个过程公开露骨的直播出来会挺有趣的(算是对小米Mimo-V2.6公开训练过程的一个拙劣模仿吧)👉https://huasheng.ai/huashu-jev/
Hugging Face今年3月出的报告里,过去一年的模型下载,中国占了41%,美国是36.5%;Artificial Analysis的开源权重模型榜,前六名全是中国实验室;OpenRouter上按token量排,前五名里有四个是中国模型。
Claude刚刚更新了Opus 5.5,一句话说完:比Opus 5更快也更便宜,跑分上还赢了自家最贵的Fable 5.1和GPT-6 Astra。然后A社这次还给每个订阅用户送了一次reset,点一下额度就回满,你把Claude Code更新到最新版,今天就能直接用上了。
前几天刷X,刷到罗福莉发的一条帖子,说小米在直播MiMo-V2.6的后训练,训练步数、评测曲线、烧了多少钱,全都挂在一个网页上实时直播放出。我第一反应是这种发布模型的方式还挺有趣的,尤其是隔了两天又点进去,发现它还在跑,并且发现这模型训练也是真特么贵,2天就少了200万美元😓
大家都懂现在大厂的work类产品竞争得多激烈,所以我一直挺关注这几个产品的动向的,毕竟需要给各位粉丝姥爷做评测。
两年前我发过一条动态,说我在给自己的网站做i18n翻译,明明早就可以用AI翻译了,但一大堆文章要通过对话方式跟AI沟通还是很烦人,长文本得自己截断,复制黏贴几次之后就觉得自己是AI时代的纺织工,不想干这种体力活了。
我最近在X上刷到了一大堆夸赞GPT-6 Astra在computer use方面有多强,然后操控blender做出了各种3D模型的案例,说实话有点看麻了。。。
北京时间9月4日凌晨,OpenAI把GPT-6 Astra发出来了。距离Anthropic发Claude Fable 5.1,正好两天。
上面这张图是Lovart画的,一次出图没返工。它说的也正好是我这篇想讲的事:好的设计不是给你一个答案,是把候选摆出来让你自己挑。
早上在群里刷到个截图,看得我有点乐😂这是V2EX上一个帖子,标题叫《我们开始倒班考勤了》。
前几天在家,我跟豆包说了句「做一个可爱卡通布丁小狗主题的记账app」,@上我自己搓的那个图标技能,选「工作任务」模式让它在我这台电脑上跑,看它起了个头,我就出门了。去公园遛了个弯,中间又约了朋友吃饭。
是的,《DeepSeek Harness橙皮书📙》,总共120页,免费!开源! https://github.com/alchaincyf/deepseek-harness-orange-book
我随手往下翻,翻到一张有点眼熟的卡片:「花叔设计助手」,作者写的是花叔😳
DeepSeek V4 Pro正式版发布! DeepSeek刚刚悄无声息的更新了V4 Pro的版本号,看起来是明天会有正式的发布信息。 以我自己最近使用DeepSeek V4 flash的体感来说,那是个又快能力又基本接近Opus 4.8的模型。这次V4 Pro的正式版我估计会是接近Opus 5/Fable 5的表现。
豆包昨天正式上线Seedance 2.5了,我干的第一件事是,第一次给我豆姐充钱:500块,专业版高级套餐,三档里最贵的那一档。
上周在X上刷到吴恩达开源了他做的OpenWorker。
昨天Anthropic发了篇文章说,他们把Claude Code系统提示词删掉了80%以上,编码评测表现没有明显下降。然后写了篇文章,把这次删减背后的判断做了波阐述,标题叫《The new rules of context engineering for Claude 5 generation models》,作者是C…
在加勒比海上收到了OpenAI的工作邀约,看邮箱后缀本以为是钓鱼,没想到经过X网友验证,居然是真的…
这个七月我在纽约。有天下午在中央公园的长椅上歇脚,一只松鼠蹦上来,扒着我的星巴克冰咖啡,嘴都快够到吸管了。
这两天新模型跟不要钱一样往外冒。7月8日Grok 4.5,7月9日更热闹,GPT-5.6和Meta的Muse Spark 1.1挑了同一天发。
【花叔注】我最近一直在美国旅行,正好赶上他们的250周年独立日,美国人对这事还真挺重视,到处都是各种庆典活动。
今天Anthropic可解释性团队发了篇新论文,官方推文几个小时就冲到320万+浏览。
昨天我在X上刷到一张排行榜,Arena的Code Arena: Frontend,前端代码能力的真人盲投对战榜。发现榜上有多家国产模型在列,而且许多排名比我预期的高不少。