花叔的视频手记 · 实践记录

DeepSeek V4将发布!梁文锋连发3篇论文,我读完发现一个规律

16:00字幕整理
DeepSeek V4将发布!梁文锋连发3篇论文,我读完发现一个规律的视频封面

点击后加载播放器,播放由你开始。

在B站观看 ↗

从感兴趣的地方开始

章节根据字幕内容整理,点击可定位到相应片段。

先读这一段

这段视频讲了什么

围绕当时的DeepSeek V4发布传闻,花叔选择Engram、mHC和R1论文更新三个切口,讨论模型如何减少不必要的计算。视频把条件记忆比作查字典,用层间连接解释训练稳定性,再关注R1补充披露的训练过程和失败尝试。作者从这些材料提炼出「用更少计算做更多事」的共同方向,并据此提出对下一代模型的预期,强调的是技术线索与个人判断。

值得带走的几点

  1. 01Engram案例讨论记忆与计算的分工
  2. 02mHC案例关注层间连接的稳定性
  3. 03R1更新提供训练过程与失败尝试的材料
  4. 04从共同研究方向推测下一代模型

摘要、要点与章节根据视频字幕整理;机器字幕可能误识别人名、产品名与数字,细节请以原视频为准。

V4发布时间与技术整合为当时预测;Engram和数学术语多处误识,字幕中的矩阵条件与训练成本表述不宜脱离论文口径引用。

DeepSeek论文解读模型架构AI科普

这次看完了,下次一起动手。

花叔的插画头像

《一本书玩转DeepSeek》作者,小猫补光灯、女娲Skill生态创作者。不会写代码,用AI做产品,分享独立开发、AI工具与内容创作的实践。

全部视频 →
11:44
摘要与章节

GPT-6 Astra做3D绝了!我两天建了一座能开车的巴黎(赠300页手把手教程)

花叔把此前的巴黎地图项目升级成可驾驶的3D场景,演示Codex与Tripo分工完成素材和交互的流程:先生成参考图,再制作模型、调整网格、拆分部件、绑定动作,最后由AI编程接入游戏。近景地标、车辆和树木使用生成资产,远景街区与河流则保留程序化建模,以兼顾细节和性能。视频还展示Unity游乐园与小王子星球,说明素材生成之后仍需要组装和功能实现。

看摘要与章节 →AI3DTripo
24:07
摘要与章节

DeepSeek 19大使用技巧,从入门到精通

围绕DeepSeek R1发布后的使用体验,花叔先解释推理模型与指令模型的不同,再梳理分词、知识截止、模型自我描述、上下文和输出长度等限制。随后用写作、增长方案与会议材料等例子,讲解明确目标、补足背景、说明知识水平以及逐步收敛需求的方法。末尾复盘此前常用的提示词策略,提出在R1上减少机械约束、给模型留出解题空间的使用建议。

看摘要与章节 →DeepSeek推理模型
15:11
摘要与章节

Cursor教程:实现自动化写文章,让AI 7*24小时为你打工|ChatGPT|AI进化论-花生

本期以批量生成书籍介绍为例,用Cursor制作自动化脚本:逐行读取Markdown书单,调用OpenAIAPI,把结果按书名保存成本地文件。演示包含依赖安装、环境变量、模型选择和提示词调整,也出现书单重复、AI误改模型名称等问题。花叔建议先生成一两篇检查效果,再修改提示词并扩大批量运行;重点展示任务编排和文件保存流程,成文内容仍需另行核实与编辑。

看摘要与章节 →Cursor自动化