花叔的视频手记 · 实践记录

谷歌Gemini造假风波完整盘点:演示视频造假?测评放水?Bard垃圾?|AI进化论-花生

12:30字幕整理
谷歌Gemini造假风波完整盘点:演示视频造假?测评放水?Bard垃圾?|AI进化论-花生的视频封面

点击后加载播放器,播放由你开始。

在B站观看 ↗

从感兴趣的地方开始

章节根据字幕内容整理,点击可定位到相应片段。

先读这一段

这段视频讲了什么

围绕Gemini初次发布后的争议,本期分别讨论演示视频的制作方式、评测提示条件差异,以及Bard中实际可用模型的体验。花叔指出剪辑演示不能直接当作实时交互表现,并用部分相同图片和提示词测试GPT-4V;在基准比较中,他强调不同提示方法会影响成绩。最后更正上一期对Bard使用条件的演示,并对联网问答作比较,主张等待实际产品表现再判断模型优劣。

值得带走的几点

  1. 01区分图片加文字测试、剪辑演示与真实低延迟交互。
  2. 02用部分相同素材检查GPT-4V的多模态理解表现。
  3. 03解释示例提示与多次回答策略不同,成绩不能简单横比。
  4. 04更正此前Bard演示,并观察联网搜索的触发与答案质量。

摘要、要点与章节根据视频字幕整理;机器字幕可能误识别人名、产品名与数字,细节请以原视频为准。

视频包含作者对厂商动机与未来能力的判断,不构成已核实事实;使用条件均属当期版本。

Gemini模型评测技术解读

这次看完了,下次一起动手。

花叔的插画头像

《一本书玩转DeepSeek》作者,小猫补光灯、女娲Skill生态创作者。不会写代码,用AI做产品,分享独立开发、AI工具与内容创作的实践。

全部视频 →
11:44
摘要与章节

GPT-6 Astra做3D绝了!我两天建了一座能开车的巴黎(赠300页手把手教程)

花叔把此前的巴黎地图项目升级成可驾驶的3D场景,演示Codex与Tripo分工完成素材和交互的流程:先生成参考图,再制作模型、调整网格、拆分部件、绑定动作,最后由AI编程接入游戏。近景地标、车辆和树木使用生成资产,远景街区与河流则保留程序化建模,以兼顾细节和性能。视频还展示Unity游乐园与小王子星球,说明素材生成之后仍需要组装和功能实现。

看摘要与章节 →AI3DTripo
24:07
摘要与章节

DeepSeek 19大使用技巧,从入门到精通

围绕DeepSeek R1发布后的使用体验,花叔先解释推理模型与指令模型的不同,再梳理分词、知识截止、模型自我描述、上下文和输出长度等限制。随后用写作、增长方案与会议材料等例子,讲解明确目标、补足背景、说明知识水平以及逐步收敛需求的方法。末尾复盘此前常用的提示词策略,提出在R1上减少机械约束、给模型留出解题空间的使用建议。

看摘要与章节 →DeepSeek推理模型
15:11
摘要与章节

Cursor教程:实现自动化写文章,让AI 7*24小时为你打工|ChatGPT|AI进化论-花生

本期以批量生成书籍介绍为例,用Cursor制作自动化脚本:逐行读取Markdown书单,调用OpenAIAPI,把结果按书名保存成本地文件。演示包含依赖安装、环境变量、模型选择和提示词调整,也出现书单重复、AI误改模型名称等问题。花叔建议先生成一两篇检查效果,再修改提示词并扩大批量运行;重点展示任务编排和文件保存流程,成文内容仍需另行核实与编辑。

看摘要与章节 →Cursor自动化