花叔的视频手记 · 实践记录

谷歌新的AI模型Gemini比GPT-4更强?这是你目前能看到的解释最充分的视频了。

15:27字幕整理
谷歌新的AI模型Gemini比GPT-4更强?这是你目前能看到的解释最充分的视频了。的视频封面

点击后加载播放器,播放由你开始。

在B站观看 ↗

从感兴趣的地方开始

章节根据字幕内容整理,点击可定位到相应片段。

先读这一段

这段视频讲了什么

本期在Gemini首次发布后介绍其多模态定位,区分Ultra、Pro与Nano,并说明录制当时能体验的主要是Pro。作者对「超过GPT-4」的说法提出评测方式、任务差异、安全调整和工具生态等疑问,主张等待实际产品表现。后半段收录Google官方演示,展示画图识别、游戏、物体关系与视频场景理解等可能用途。

值得带走的几点

  1. 01宣传中的旗舰Ultra与当时可用的Pro不是同一个版本。
  2. 02基准比较要关注提示方式、工具条件及任务是否可比。
  3. 03日常体验还受浏览、代码执行等配套能力影响。
  4. 04官方多模态演示提供应用想象,但不能代替独立验证。

摘要、要点与章节根据视频字幕整理;机器字幕可能误识别人名、产品名与数字,细节请以原视频为准。

后半段为官方演示片段,不是作者独立实测;中英文机器字幕均有专名及语句错识,产品可用状态属于发布当期。

Gemini多模态模型评测历史解读

这次看完了,下次一起动手。

花叔的插画头像

《一本书玩转DeepSeek》作者,小猫补光灯、女娲Skill生态创作者。不会写代码,用AI做产品,分享独立开发、AI工具与内容创作的实践。

全部视频 →
11:44
摘要与章节

GPT-6 Astra做3D绝了!我两天建了一座能开车的巴黎(赠300页手把手教程)

花叔把此前的巴黎地图项目升级成可驾驶的3D场景,演示Codex与Tripo分工完成素材和交互的流程:先生成参考图,再制作模型、调整网格、拆分部件、绑定动作,最后由AI编程接入游戏。近景地标、车辆和树木使用生成资产,远景街区与河流则保留程序化建模,以兼顾细节和性能。视频还展示Unity游乐园与小王子星球,说明素材生成之后仍需要组装和功能实现。

看摘要与章节 →AI3DTripo
24:07
摘要与章节

DeepSeek 19大使用技巧,从入门到精通

围绕DeepSeek R1发布后的使用体验,花叔先解释推理模型与指令模型的不同,再梳理分词、知识截止、模型自我描述、上下文和输出长度等限制。随后用写作、增长方案与会议材料等例子,讲解明确目标、补足背景、说明知识水平以及逐步收敛需求的方法。末尾复盘此前常用的提示词策略,提出在R1上减少机械约束、给模型留出解题空间的使用建议。

看摘要与章节 →DeepSeek推理模型
15:11
摘要与章节

Cursor教程:实现自动化写文章,让AI 7*24小时为你打工|ChatGPT|AI进化论-花生

本期以批量生成书籍介绍为例,用Cursor制作自动化脚本:逐行读取Markdown书单,调用OpenAIAPI,把结果按书名保存成本地文件。演示包含依赖安装、环境变量、模型选择和提示词调整,也出现书单重复、AI误改模型名称等问题。花叔建议先生成一两篇检查效果,再修改提示词并扩大批量运行;重点展示任务编排和文件保存流程,成文内容仍需另行核实与编辑。

看摘要与章节 →Cursor自动化