花叔的工作台 / 视频手记

跟着花叔,动手试试。

AI工具实测、独立开发与内容创作。先看要点,感兴趣再看完整实践。

全部视频 146条

16:28
25摘要与章节

【首发】Claude4.5发布,首款AI操作系统上线!深度解读+实测

本期解读Claude Sonnet 4.5发布及相关产品更新,介绍编程、电脑操作、Agent SDK和编辑器插件,并重点试用Imagine with Claude动态生成界面的体验。演示包含主题桌面、天气、计算器和进化论小游戏,也检查了多类网页原型。作者认为交付稳定性有所改善,但前端设计尚无明显飞跃,更复杂的长期任务仍需进一步测试。

看摘要与章节 →ClaudeAI编程
10:28
26摘要与章节

OpenAI发布GPT-5!全网首发解读&对比评测!

本期在GPT-5发布后梳理模型系列、自适应思考和编程方向,并结合公开评测讨论其与Claude Opus 4.1的差距。由于录制时作者尚不能直接使用GPT-5,末尾采用发布会展示的提示词,让Claude生成法语学习网站和财务仪表盘,再与官方演示比较。作者认为代码表现有进步,但这一展示并不是两款模型在相同环境下的直接实测。

看摘要与章节 →GPT-5Claude
13:58
27摘要与章节

【解读+实测】马斯克发布Grok4,登顶全球最佳大模型!

Grok 4发布后,花叔从订阅用户视角梳理官方公布的评测、第三方综合指标和后续产品计划,并解释不同测试主要考察哪些能力。随后他用同一网页生成需求,对照Grok、Gemini、Claude和DeepSeek的前端结果,观察页面结构、审美和图片引用。实测中高榜单分数没有直接转化为令他满意的网页表现,视频因此把模型评测成绩与具体工作体验分开讨论。

看摘要与章节 →Grok模型对比
11:49
28摘要与章节

突发!DeepSeek R1重磅更新,五大场景实测!

DeepSeek R1更新后,花叔用交互专题页、小游戏、画板、翻译、风格写作和图片画廊等任务观察变化。演示中既有页面交互失效、画线偏离鼠标等问题,也有通过自然语言反馈修好画板的过程;翻译与脱口秀脚本则留给观众对照判断。最后他把画廊的图片对应和动画效果与Claude生成结果比较,同时明确单个小任务的优势不足以证明整体编程能力领先。

看摘要与章节 →DeepSeek模型实测
8:04
29摘要与章节

【AI深度思考神器?】7个实测场景告诉你夸克到底有多强!

本期用七类任务体验夸克的AI功能,包括新闻影响分析、PPT制作、学习计划与概念解释、平台风格写作、长报告总结、健康问题追问,以及生成照片重命名脚本。花叔关注的是工具如何结合背景、组织资料并形成可修改的结果,而非只比较模型参数。结尾归纳三种用法:讲清目的与场景,关注分析方法,并通过多轮追问细化要求;各示例仍是有限体验,未作系统准确性验证。

看摘要与章节 →夸克使用场景
9:10
30摘要与章节

AI智能体耳机真的有用吗?三大场景佩戴实测!

花叔从日常佩戴体验出发,测试Ola Friend开放式智能耳机的语音交互:散步时练习英语口语、讨论抽象问题,写作卡住时请AI提供比喻和思路。他关注的是不用频繁打开手机的交流方式,以及开放式结构与环境声音共存的感受,也提到嘈杂地铁中仍会换用降噪耳机。视频据这些个人场景讨论AI进入常用硬件的价值,侧重体验而非参数测量。

看摘要与章节 →AI硬件Ola Friend
30:42
31摘要与章节

Manus能做哪些事儿?和DeepSeek的区别是什么?UP主们实测回答!【趁热聊聊| 老蒋×朋克周×花生×鹅厂程序员】

在Manus内测引发讨论的时期,花叔参与圆桌,和其他UP主区分大模型、聊天应用与智能体,并现场查看象棋游戏、旅行攻略、个人主页等任务结果。花叔结合信息采集与应用开发体验,分享任务拆解的价值,也指出长上下文中断、细节控制和交付可靠性的问题。讨论进一步延伸到通用与专用智能体的关系,以及普通人如何从具体生活需求出发试用AI。

看摘要与章节 →Manus智能体
48:12
32摘要与章节

【全网首发】Manus最真实测试,无加速无剪辑

本期保留Manus执行任务时的等待与操作过程,观察它如何调研蜜雪冰城、整理数据、制作分析网页并部署。途中花叔临时加入与星巴克比较的要求,检查任务能否继续推进。视频展示了待办与过程文档的价值,也记录登录墙、弹窗、报错和速度变化;最终网页虽交付成功,仍有标题重叠、图表展示和疑似数据错误,需要进一步核对与修改。

看摘要与章节 →Manus智能体
9:54
33摘要与章节

全球首款通用AI Agent——Manus发布!3大场景实测!

本期展示Manus内测中的三个任务:搜集自身产品信息、按投稿要求创作长篇小说,以及为作者的DeepSeek入门书设计营销方案。视频着重观察任务清单、浏览器与代码工具、过程文档和中途补充信息的协作方式,认为规划能力有助于完成较长任务。书籍销量与社群规模属于生成方案中的目标,并非已经实现的经营结果。

看摘要与章节 →Manus智能体
10:56
34摘要与章节

DeepSeek R1 API实战:从零开发一款AI吐槽神器

本期把DeepSeekR1的文本生成与Claude的开发能力组合起来,用Cursor制作「红薯吐槽机」。用户输入公开主页链接后,网站先获取适合模型阅读的内容,再调用模型生成幽默文案;随后逐步补充头像昵称、界面样式和Firebase数据保存。视频强调一次只交给AI相对有限的任务,并用实际抓取结果补足上下文。内容展示开发与迭代,部署步骤则指向已有教程。

看摘要与章节 →CursorDeepSeekR1
8:10
35摘要与章节

【实测】我用AI做了一个猫咪鉴定师! 零基础也能上手

旅居时常遇到猫咪,花叔由此搭建一个能通过图片和视频交流的「猫咪顾问」。他在阿里云百炼创建应用,连接知识库、选择视觉模型,并写清角色、品种辨别与评分流程,再分别用图片和视频通话测试。发布后,他在曼谷街头对着一只猫进行实地演示,观察回答速度和是否遵循资料中的评价标准。教程展示了知识检索、多模态理解与可视化配置如何组合成小应用。

看摘要与章节 →阿里云百炼多模态应用
9:57
36摘要与章节

AI从会聊天到会干活,差的到底是什么?(赠129页学习pdf)

本期用AmazonQuick的实际任务解释,AI能否交付成品取决于模型、执行环境和上下文共同配合。花叔迁入自己的设计等Skill,展示方案选择、截图检查、数据分析与定时任务,并讨论知识资料、连接器和应用分享怎样让个人方法在团队中复用。视频也区分云端持续运行与本地工具访问,强调权限确认和产出标准。结尾给出选择智能体的检查框架:能力够不够、方法能否装进去、是否理…

看摘要与章节 →AmazonQuickSkill
36:38
37摘要与章节

买了最贵的模型,为什么还是用不好AI?|B站AI圆桌全程回放+Reaction

花叔与三位创业者、开发者从各自的AI投入聊起,讨论同样的模型为何会产生不同工作成果。花叔分享按项目组织文件、渐进读取上下文和维护工作流程的方法,并提醒一人公司仍要找到真实需求、交付产品、接触用户。圆桌还结合自行车研发、供应商会议和软件验证,展示知识库如何进入实际业务;视频作者在回看中补充团队转型与公开分享的实践反思。

看摘要与章节 →AI工作流知识库
15:07
38摘要与章节

我雇了三个AI员工开发我的产品,今天正式开源!

本期把已有录屏插件迁到CNB,借云端NPC完成开源前的收尾:补许可证、更新文档、设置打包发布流程,并修复录制时跨标签页跟随的问题。花叔创建产品、开发和评审三个角色,通过Issue派工,让它们基于仓库讨论并提交PR。协作中也产生重复提交和未解决的评审问题,最后再请NPC整理修复,并下载发布包验证功能,展示云端协作仍需要明确分工与验收。

看摘要与章节 →自家产品多智能体
12:18
39摘要与章节

你敢让手机里的AI替你付钱吗?全球首款大模型原生智能体手机拆解!

本期以桌面智能体的使用经验为参照,拆解阶跃智能体手机与StepAOS的系统设计思路。视频认为手机智能体需要原生接口、工具协议、跨任务记忆及端云调度,才能把目标转化为跨应用操作,并讨论感知、权限、过程留痕和撤回机制。旅行规划等场景是基于发布会资料的推演;作者明确表示尚未拿到真机,因此这是一组架构判断与体验预期,而非产品实测结论。

看摘要与章节 →智能体手机系统架构
17:07
40摘要与章节

Claude Fable 5最后的绝唱!我用它 5 小时做了个桌面App,已开源!【B站AI创造公开赛】

本期先介绍ClaudeFable5发布时的能力与使用安排,再展示花叔用其开发的Mac桌面应用。这个开源工具围绕终端智能体工作流,把文件浏览、上下文提供、结果预览和任务提醒放到同一界面,减少在Finder、终端与编辑器之间切换。视频还演示图片标注、HTML查看、浏览器录屏和跨平台图文填充等小工具,强调从自己的具体工作障碍出发,用AI快速实现并持续完善产品。

看摘要与章节 →自家产品Claude
16:14
41摘要与章节

我逆向了Claude Design!一句话帮你生成任何出色设计,开源后狂揽GitHub 1.6万+stars!【B站AI创造公开赛】

花叔展示将AI设计工作整理为可复用流程的尝试,围绕演示稿、个人主页、待办应用原型和产品宣传动画做四个案例。流程从确认听众、目标与风格开始,先提供样稿,再根据反馈继续制作,并通过截图检查和修复布局。个人主页案例还演示从一张饮料店照片提取色彩与视觉规则。视频关注的是如何让设计更贴近具体内容、品牌和用途,而不只生成一个页面。

看摘要与章节 →AI设计交互原型
13:42
42摘要与章节

我让一个AI,帮我装另一个AI

花叔用MAVIS演示让AI操作电脑完成任务的过程,从安装Ollama、查询设备配置并选择本地模型开始,再延伸到技能适配、文件整理和手机远程交办。后半段同时推进软件安装、知识解释、文章配图、桌面归类与文件查找,展示任务如何分给不同执行模块,以及遇到安装错误后继续排查的过程。视频关注自然语言指派到实际操作之间的衔接,也保留任务耗时和检查结果的环节。

看摘要与章节 →MAVIS电脑自动化
11:20
43摘要与章节

我的「一人公司」有了数据分析部和编辑部,年薪0元

本期围绕敏感资料不便上传云端的工作场景,在一台大内存笔记本上演示本地模型与Claude Code、Skill配合。作者先运行GPT-OSS,再用千问模型分析模拟公司的财务表,生成网页、Excel和PPT;随后展示在原Word文档中加入批注与修订。核心思路是按数据敏感性划分本地和云端任务,让分析与审稿交付更接近实际工作。

看摘要与章节 →本地AISkill
11:59
44摘要与章节

我用Tabbit浏览器造了一个AI分身

本期把女娲Skill提炼出的个人表达与决策规则交给Tabbit智能代理,用于起草B站评论回复。花叔区分妙招、脚本和浏览器代理的职责,选择按单个视频处理、人工审阅后发布,并用定时任务观察新视频评论。实践中跨页面复杂流程更易出错,而粉丝分享个人处境的留言仍由本人回应,形成自动化与真人交流的分工。

看摘要与章节 →女娲SkillTabbit
36:11
45摘要与章节

DeepSeek V4是怎么训练出来的?73页PPT深入解析

本期借助技术报告、73页演示材料和网页解读DeepSeek V4,区分Pro与Flash的定位,重点说明MoE架构、mHC残差连接、分层注意力、Muon优化器及专家训练后蒸馏的思路。作者把百万上下文与成本下降视为主要价值,同时指出竞赛解题、实际工程、长链工具调用和创意写作的表现并不一致,建议根据任务选择,并讨论论文局限与下一代可能方向。

看摘要与章节 →DeepSeek模型训练
18:27
46摘要与章节

我蒸馏了17个大佬给我打工(开源免费)

本期以公开人物资料的整理为例,展示一套从收集素材到构建AI工作规则的流程:分别检索著作、长访谈、表达习惯、他人评价、决策记录和时间线,再提炼分析框架,并做已知问题、边界与风格测试。花叔通过同题回答比较观察流程效果,也展示用多个模拟视角讨论问题。视频中的人物回答均为AI生成案例,可用于观察不同提问框架,不能等同于本人观点。

看摘要与章节 →公开资料知识整理
14:15
47摘要与章节

谷歌最新模型Gemma4发布!深度解析+送42页资料

Gemma 4发布后,花叔梳理不同尺寸模型、多模态输入和本地部署的定位,讨论小模型如何在手机、电脑等设备上承担文档识别与简单任务。视频还用较通俗的方式介绍参数效率、缓存与长上下文设计,并尝试生成一张鹦鹉介绍网页,与其他模型结果比较。案例中出现图片引用失败,因而作者建议把端侧可运行和具体任务是否合适放在一起判断。

看摘要与章节 →Gemma端侧AI
18:15
48摘要与章节

Claude Code源码泄露!首发解读51万行代码!

围绕一次Claude Code源码泄露事件,花叔借助AI阅读相关文件,讨论模型之外的工程系统如何影响编程工具的体验。视频重点解读静态与动态提示词、权限审查、记忆提取、上下文压缩和文本搜索等设计,并联系自己的开发与写作使用习惯说明其意义。结尾分析这些工程经验对同类产品的启发,同时把源码可见与团队持续迭代能力区分开来。

看摘要与章节 →Claude CodeAI编程

公开视频提供字幕整理的摘要与章节;充电专属内容请到B站查看。