9:22仅需10分钟,无代码也能做AI应用!
本期在阿里云百炼搭建一个实时英语学习智能体:选择支持视觉交互的模型,设定角色、学习水平、直接回答与主动引导流程,再配置调用并进行摄像头测试。应用根据场景提供词汇和短句,随后生成体验链接,在手机商店场景继续测试。花叔借此展示,无代码配置也能把多模态模型转成个性化学习工具;遇到回答不符预期时,仍需要修改提示词并重复体验。
花叔的工作台 / 视频手记
AI工具实测、独立开发与内容创作。先看要点,感兴趣再看完整实践。
用AI做产品 74条
9:22本期在阿里云百炼搭建一个实时英语学习智能体:选择支持视觉交互的模型,设定角色、学习水平、直接回答与主动引导流程,再配置调用并进行摄像头测试。应用根据场景提供词汇和短句,随后生成体验链接,在手机商店场景继续测试。花叔借此展示,无代码配置也能把多模态模型转成个性化学习工具;遇到回答不符预期时,仍需要修改提示词并重复体验。
16:23本期用扣子的应用功能重做「拍照学单词」,展示不写代码也能搭出图片上传、词汇标注和双语描述的小应用。作者通过拖拽配置界面,再把图像理解、翻译和画板节点串成工作流,明确各节点的输入输出与变量传递。由于当时图像节点只能输出中文,额外加入翻译步骤;最后演示试运行、定位节点问题和发布链接的方法。
19:41以给已有校对网站增加个人主页链接为例,本期对比Cursor普通Composer、Agent模式与WindsurfCascade的操作过程。普通模式在缺少上下文时改错文件,指定相关文件或代码库后才能完成;两个智能体模式则自行查找文件并修改。由此解释AI编程中上下文和多步工具调用的作用,同时比较当期网页读取、规则配置等差异,并提醒复杂项目仍可能因文件读取不完整而…
17:37本期记录花叔用Cursor准备并提交小猫补光灯相关专利申请的过程:让AI读取项目代码、解释申请材料、起草权利要求与说明书,再尝试用图形代码生成附图并反复修正。视频的启发在于把已有项目上下文直接用于规范文书制作,减少转述成本。作者最后明确表示自己不具备专利专业知识,尚不确定提交材料是否合格或申请能否获批。
12:27本期使用CodeGeeX配合VS Code,以花叔开源的image2046图片工具项目演示如何读懂和修改现有代码。内容从安装插件、克隆仓库开始,依次介绍项目地图、中文功能解释、普通注释与幽灵注释,再展示代码补全和新增PDF下载功能的修改建议。重点是借助AI理解开源项目的结构与实现路径,帮助新手从已有作品中学习和扩展功能。
16:42本期以屏幕补光工具为例,说明学习Cursor和AI编程可以从一个小需求开始,尽早完成并发布。花叔展示如何从社交平台观察已有需求,分别制作网页和iOS版本,逐步调整亮度、色温、全屏界面,处理编译错误并准备图标与上架资料。视频也强调,做出功能只是开始,还需形成差异和推广能力,不能把有讨论热度等同于真实使用。
21:50本期集中展示花叔用Cursor制作的九个案例,包括图片工具站、AI教程与编程内容站、文本改写、用户反馈分析、穿搭与猫咪评价、拍照学单词App,以及长文本翻译脚本。视频围绕实际界面与功能说明自然语言开发能覆盖哪些任务,尤其展示分类、接口串联、分块处理和多种输出方式;作者强调从项目实践中学习,并持续完善产品。
25:05本期用Cursor与Xcode开发语音笔记App「Voice Memo」,串联录音、转写、润色、标签、历史记录和发送到flomo的功能。视频完整保留了目录选择、接口文档引用、编译错误、权限、模型名称及音频格式等问题的调试过程。作者通过补充日志和反复反馈定位故障,再逐步完善交互,展示从自然语言需求到真机可用功能的实际路径。
6:46花叔把早期使用Cursor开发插件、网站和本地工具的经验整理成十条建议。核心围绕项目管理和协作:在正确的项目目录启动,清楚而克制地描述需求,持续更新README、保留注释,并用Git记录可回退的节点。视频也演示当时Composer的修改确认流程,以及通过代码库、文档引用和规则设置补充上下文,帮助初学者在测试和修复中保持对项目的理解。
33:42本期从桌面截图难以查找的需求出发,用Cursor制作读取图片文字、调用模型总结名称并批量重命名的本地工具。视频保留网页方案失败、依赖安装、接口报错和改换实现路径的过程,随后调整命名提示词、重启程序验证,并处理SVG等格式问题。最终大部分文件得到可理解的名称,但仍有识别与命名偏差,展示了真实开发中的反馈和迭代。
12:22本期把Cursor作为带AI能力的文本编辑器,演示从新建Markdown文档到选题、大纲、续写、改写、翻译和校对的完整写作流程。视频强调在原文中直接修改、逐块查看差异并决定是否接受,以及通过时间轴找回历史版本。作者也展示了续写重复等问题,说明人仍需掌握方向、筛选结果,使AI融入写作过程而非反复搬运文本。
18:37以Chrome网页二维码插件为例,本期演示不会写代码的人如何用CursorComposer描述需求、生成多份文件,并把插件安装到浏览器测试。视频完整保留二维码不显示、布局溢出、网站图标缺失等问题,再通过报错和具体反馈逐步修复,最后加入收起展开功能。随后补充Chat、局部编辑、代码补全与模型选择,展示自然语言开发也需要反复运行、观察和细化要求。
16:25本期围绕当时的ChatGPTPlus功能,演示GPT-4与免费模型回答方式的差别,以及绘图修改、网页浏览、代码解释器和GPTs的用途。核心案例是一份旅行行程单:明确日期与安排要求后,继续要求表格化、检查景点距离,并导出文件。视频也测试了定制GPT的实际表现,介绍指令、知识文件和Actions的配置思路,帮助观众按真实任务判断订阅价值。
6:26花叔复盘自己制作GPTFinder的过程:面对大量GPT导航站难以检索的问题,先解决自己的需求,采用规则搜索快速完成最小可用版本,再通过公开分享获取用户与反馈。他比较了爬虫数据库、静态知识表和直接搜索的成本,解释为何选择维护负担较低的方案。视频据第三方使用量榜单介绍当期成绩,重点提炼「做自己需要的东西、快速上线、公开构建」三条实践经验。
6:12本期承接Gemini Pro免费API获取教程,演示如何把API接入一个自己的聊天网页。流程包括复制GitHub上的GeminiProChat项目、关联Vercel账户、设置环境变量并部署;随后展示通过Cloudflare配置DNS,将自有域名接入网站。视频也提醒,共享体验入口会受调用频率限制,平台默认域名在当时的网络环境下可能无法访问。
13:00本期系统演示早期ChatGPT的代码解释器、网页浏览和第三方插件。代码案例涵盖豆瓣观影数据分析、Python纠错、图片压缩、视频转GIF、批量文件处理、插件打包与动态二维码;联网部分展示行情、赛事和论文查询,第三方插件则用于机票与酒店搜索。视频保留了报错、搜索失败和地点错误,并通过继续沟通修正结果。








公开视频提供字幕整理的摘要与章节;充电专属内容请到B站查看。