Logo
出海数字营销宝典
Cross-Border Digital Marketing Playbook🧡
首页
LinkGate 短链接

简单、安全、高性能的短链接服务。

UTM 链接生成器

核心工具。生成、校验与追踪链接。

OG 标签模拟器新品

实时模拟您的链接在 Facebook, X (Twitter), LinkedIn 等社交媒体上的分享效果。

随机密码生成器

掷出安全感。一键生成高强度、无法破解的安全密码。

免费发票生成器新品

免费发票生成器。包含多种经典模板、手写签字及 PDF 打印导出。

全球营销日历2026

全球营销节点与预设 UTM 参数。

艺术二维码

创建品牌级、艺术风格的二维码。

Markdown 在线编辑器Beta

实时编辑,即时预览。最好的写作体验。

绘图白板

实时协作绘图白板。

本地文件预览器

100% 本地离线预览 Office、PDF、CAD 等文件。

多维文档比对与评测推荐

本地双栏文档比对与服务端/SaaS方案技术评测。

Featured

LinkGate

A simple, secure, and ultra-high-performance short URL system.

Explore Now
Featured

UTM 链接生成器

为数字营销人员打造的专业链接追踪工具,快速生成、校验并生成艺术二维码。

Explore Now
动态
SEO 最佳实践新

现代 SEO 终极指南与实战技巧。

UTM 最佳实践

掌握 UTM 命名规范的艺术。

GEO 最佳实践

AI 搜索出海与境内增长的 GEO 优化操作标准。

AI Agent 最佳实践新

AI Agent 与 Prompt 工程最佳实践与执行方案。

认知偏差手册

提升转化率的心理学原则手册。

广告&SEO术语/黑话

解锁数字营销领域的“行话”与缩写。

中英文案排版指北 v0.1

统一中英文案、排版的相关用法,增强文案气质。

Markdown 语法速成班必备

掌握语法,让排版更高效、更美观。

Shopify 运营指南

独立站追踪配置、广告防欺诈及数据指标体系。

Featured

GEO 最佳实践

针对 AI 大模型搜索引擎的可见性提升指南。

Explore Now
Featured

SEO 实战大师课

从基础概念到技术审计,助您登顶搜索排名。

Explore Now
团队信息
关于我们联系我们更新日志
法律条款
使用条款隐私政策
LinkGate
Logo
出海数字营销宝典
Made with🧡by 虾兄

专为跨境出海卖家、全球化品牌与数字营销人打造的一站式增长知识库与效率工具箱。深度聚合搜索引擎 SEO 实战策略与SEO 大师课、大模型 GEO(生成式引擎优化)指南、AI Agent 智能体自动化工作流与Shopify 独立站运营体系;集成UTM 智能链接追踪、流量归因、文档比对评测与全球营销日历等全套免费营销工具,助力捕获全球全域流量,实现业务持续增长。

ECOSYSTEM & PARTNERS•数字营销生态认证
Google
Partner
MetaPartner
S
ShopifyPartner
B
CertifiedCorp

产品功能

  • LinkGate 短链接
  • UTM 生成器
  • OG 标签模拟器
  • 随机密码生成器
  • 免费发票生成器 NEW
  • 绘图白板
  • Markdown 在线编辑器
  • 本地文件预览器
  • 文档比对与方案评测 HOT
  • Shopify GTM 生成器
  • Shopify 流量审计工具
  • 营销日历

探索

  • AI Agent 最佳实践 HOT
  • GEO 最佳实践
  • SEO 最佳实践
  • SEO 实战大师课
  • Shopify 运营专栏
  • 最佳实践
  • 认知偏差手册
  • 广告&SEO术语/黑话
  • 中英文案排版指北 v0.1
  • Markdown 语法速成班
  • 动态

关于

  • 关于我们
  • 联系方式
  • 更新日志

法律信息

  • 使用条款
  • 隐私政策

© 2026 出海数字营销宝典. All rights reserved.

Made with love by虾兄
复制链接
返回顶部
  1. Home
  2. AI Agent 最佳实践
  3. 腾讯学堂:AI 原生思维——像训练大模型一样训练自己
返回 AI Agent 最佳实践专栏

《腾讯学堂:AI 原生思维——像训练大模型一样训练自己》

作者: 宝玉 @dotey

格式: 专栏文章
阅读时间预估: 8 分钟
嘉宾: 宝玉 @dotey (AI 自媒体博主 /《软件工程之美》作者)•发布日期: 2026-09-01•腾讯学堂内部精选分享
腾讯学堂:AI 原生思维——像训练大模型一样训练自己

引言

腾讯学堂出品,本文整理自 AI 博主、《软件工程之美》专栏作者宝玉在腾讯内部的分享。

他以自己做了三年的字幕翻译 App 为主线,讲了 AI 产品从找需求、判边界、最小验证、重设计到落地交付的完整过程;问答环节回应了另一个问题:每个个体如何与 AI 共同进化。做产品的、写代码的、带团队的,都能从这份一线实操记录里拿到能用的东西。

演示文稿:《AI 原生思维》腾讯内部高清完整讲义(PDF)
查看原件

嘉宾介绍

宝玉,AI 自媒体博主、资深技术人,《软件工程之美》专栏作者。2000 年起自学编程,历任工程师、开发经理、开发总监,后出国留学,毕业后重新从工程师做到工程经理,技术栈从 ASP、.NET、iOS 前端一路切换到 AI 开发。近年以 AI 主题写作和分享为主,他写的 Nano Banana 城市天气画图提示词曾火到海外,Google CEO 在推特上公开致谢。


前言:像训练大模型一样训练自己

今天讲 AI 原生思维,分两个部分:一是 AI 产品怎么做,怎么找需求、判边界、落地交付;二是个体怎么跟 AI 共同进化。选这两个题目,是因为我做 AI 博主这些年,被问得最多的就是两类问题:一类是 AI 焦虑,AI 会不会替代我们,该学什么;另一类来自做 AI 产品的人,AI 产品跟传统产品到底有什么不一样。

先简单介绍自己。我大学学的力学,因为喜欢做软件转到软件工程;2000 年左右自学编程,从 ASP、PHP 做到 .NET、iOS 前端,再到 AI 开发;职位从工程师做到开发总监,出国留学后又从工程师做到工程经理。写自媒体也一样,最早写《软件工程之美》专栏,这几年主要写 AI。我一直在转型,所以 AI 来的时候没那么恐惧,以前的经验告诉我,无非就是要去学、去转。

这些年的经历用一个比喻说,就是像训练大模型一样训练自己。我做自媒体本质是费曼学习法:要学 AI,就把学到的东西分享出来;为了分享,得去学更多理论;写出来收到反馈,反馈又帮我建立新的循环。模型也一样,预训练之后靠微调、对齐不断进化。而且模型一直在变:GPT-3 是自动补全,ChatGPT 会聊天,现在 Agent 能自主完成任务。模型在进化,知识也得跟着进化,很多时候要敢于推翻自己的旧权重。这是贯穿全场的暗线。

贯穿全场的暗线:建立反馈循环→跟着模型一起进化→敢于推翻旧权重
▲ 贯穿全场的暗线:建立反馈循环 → 跟着模型一起进化 → 敢于推翻旧权重

一、找需求:盯着模型能力的边界线

上半场我用一个自己做的 AI 产品贯穿始终:一个转录翻译 App(BaoCut),给它英文视频,输出中文字幕。选它不是因为它多好,而是我自己做的、踩过很多坑,每个判断和每个坑都能讲出当时的真实想法。别人的案例只能讲结果,自己的案例才能讲决策。

想法的起点很早。年轻时《反恐 24 小时》正火,人人字幕组第一时间把美剧翻译出来,我觉得这件事很了不起。后来有了 AI,我自己要看吴恩达的教学视频,就想:能不能像字幕组一样,也做出双语字幕?

但需求不是拍脑袋就值得做。你觉得大家都需要的东西,做出来可能没人用;没人用就没反馈,慢慢就做不下去了。做之前我先问自己三件事:

判断一个 AI 需求的三问:痛点够不够硬、我是不是用户、AI 是不是刚好够到
▲ 判断一个 AI 需求的三问:痛点够不够硬、我是不是用户、AI 是不是刚好够到
🔥 痛点够不够硬

真痛点:很多人想看英文深度内容但听力跟不上,刚需真实存在。

🙋‍♂️ 我是不是真实用户

我自己做自媒体天天翻视频,自己天天用,能拿到最及时的直接体感。

⚡ AI 是不是刚好够到

Whisper 能听写、大模型能翻译、Agent 能自动对齐时间轴。AI 让以前不可能的事变得可能。

1.1 一个提示词的三级命运

关于第三问“AI 是不是刚好够到”,插一个例子。我有个做得很成功的画图提示词,就是后来很火的 Nano Banana 城市天气图,Google CEO 在推特上公开致谢过它。

这个提示词迭代了很多版本。GPT 刚出画图模型时我就在用,但那时要手动输入城市、天气一大堆信息,才能画出一张很酷的图,有人围观,不火。到了 Nano Banana 这代,Gemini 内置搜索能自己查天气,我把提示词简化到只输一个城市名:输入上海,就生成一张带当天天气效果的上海地标图。这一下有了传播性,每个人都想试自己的城市,生成后贴回来分享,从中文圈火到英文圈,最后 Google 官方都注意到了。

同一个提示词的三级命运——体验差一步,命运差十倍
▲ 同一个提示词的三级命运——体验差一步,命运差十倍

同一个需求,模型没有检索能力时,它只是个普通提示词;能力到了,就能让所有人参与。需求一直都在,是能力边界刚好扫过了它。另一点是品味:人人都能用 AI 生成东西,想流行还是得有自己的品味,品味就是门槛。

1.2 跟着模型进化的方向走

回头看模型的几次跃迁:GPT-3 时代是自动补全,能做的事有限,比如写营销文案;ChatGPT 有了对话能力,聊天机器人这类需求一下迸发出来;这一两年有了 Agent 能力,能按目标调工具自动完成任务,Claude Code、Manus 就是基于新能力长出来的。

所以找需求要盯着模型能力进化的方向。每次升级,边界线外扩一圈,扫过的地方全是新需求。不是想到一个需求做出来就有人用,在边界线上找,才最容易发现新机会。


二、判边界:能力、成本、价值,一个需求要连闯三关

找到需求,接下来评估值不值得做。我看三个角度:AI 的能力现在做不做得到?成本成不成立?交付的价值是不是用户真要的?多数人只盯着第一关。

AI 产品的三条边界:能力线会动、成本线会动,价值线锚在人性上不动
▲ AI 产品的三条边界:能力线会动、成本线会动,价值线锚在人性上不动

2.1 能力边界:同一个想法,两种命运

2023 年 GPT-4 刚出时,有个叫 AutoGPT 的项目:通用 Agent 雏形,你输入任务,它就不停调 GPT-4、调 Google 搜索,汇总成报告。GitHub 上 Star 涨得飞快,但火了一阵就凉了。原因很简单:那时 Agent 能力没到,任务经常打转;调 Google API 要付费,GPT-4 又非常贵,烧大把 Token 交付不了结果。

Manus 是同一个“通用 Agent”的想法,但它出现在能力刚好够到的时刻:模型已经能自己列 to-do list、逐条执行、交付结果,于是一夜刷屏。想法不是关键,能力边界才是。想法太早,烧的只是 Token。

AutoGPT 与 Manus:同一个想法,边界两侧,两种命运
▲ AutoGPT 与 Manus:同一个想法,边界两侧,两种命运

边界线没有停。Claude Code 用最简单的命令行循环调工具写代码,至今是最火的 Coding Agent,形态服务于能力,不服务于潮流。“小龙虾”(OpenClaw)又进一步:通过电报、微信、QQ 就能指挥它干活,还把 Skill 用到极致。模型只训练过公共知识,我用 Markdown 文件就能教它给文章配图、发布,把私有知识装进去。再往后 Codex 的创新是 GUI 和 Computer Use:能操作浏览器和 App,写完网页自己点鼠标、敲键盘完整测一遍,以前要人全程参与的中间过程,现在最后验收就行。到现在各家都在推“Work”类产品,Agent 从写代码泛化到办公。边界每次外扩后还有小的溢出点,盯住就能发现新需求。

我的产品也是一层层解锁的:Whisper 解锁听写,大模型解锁翻译和拆字幕,Agent 解锁自主执行和验收。最早翻半小时字幕,我要校对一两个小时;现在 Codex 翻完,我花五分钟看一遍就行,时间轴对得非常准。每解锁一层能力,产品就能重设计一次。

BaoCut 的三层能力解锁:Whisper→大模型→Agent
▲ BaoCut 的三层能力解锁:Whisper → 大模型 → Agent,每解锁一层产品就能重设计一次

2.2 成本边界:账单会直接杀死产品

第二个因素是成本。GPT-4 时代翻半小时视频要几美元,我自己勉强接受,普通人太贵,那个版本我一直自己用。现在 DeepSeek 这类模型出来,一小时视频几毛钱就能翻完。但成本要动态看:Token 单价在降,Agent 模式下消耗量上去了,不能只看单价。公式很简单:调用次数 × 每次 Token 量 × 单价,降成本就从这三个因子下手。

我有过一次真实优化。最早让模型直接输出结构化 JSON,十句字幕加标记就有几十 K Token,结构越复杂单次处理量越小,半小时视频要几十上百次请求,用户抱怨一个视频用掉 20% 周额度。后来改成纯文本和 HTML 输出,HTML 对模型友好,就像网页翻译,单次量大了,次数降了。代价是解析变复杂:润色后要用 diff 算法找改动、对回时间轴。但这就是取舍:模型输出简单格式,复杂解析交给程序。翻译用便宜模型,只有对齐才用贵一点的。一轮下来,调用从 33 次降到 12 次,单集处理从 31 分钟降到 18 分钟。

一次真实的成本优化:调用 33→12 次,单集处理 31→18 分钟
▲ 一次真实的成本优化:调用 33 → 12 次,单集处理 31 → 18 分钟

2.3 价值边界:用户买的是结果,还是结果背后的人

第三关是价值。字幕翻译用户要的是确定性结果,英文进去、准确中文出来,不在乎谁翻的。但不是所有东西都这样:AI 自动写小说、做视频,很多人天然抵触,叫“AI 垃圾”;哪怕我只让 AI 润色文章,都有读者评论“AI 味很重”。如果产品只是在生产更多 AI 垃圾,就要想想值不值得做。用户买的是结果还是结果背后的人,这条线锚在人性上,不随模型升级移动。

两条会动的线上找机会,在那条不动的线内侧建护城河
▲ 两条会动的线上找机会,在那条不动的线内侧建护城河

🧭 交互工坊:AI 产品“三道边界与三问”闯关评估器

滑动测算你的 AI 想法
AI 原生产品综合健康指数
280 / 100
🚀 极佳黄金窗口 (Prime Timing)

该需求处于模型能力外扩的黄金边界线上,成本可控且具备真实自用场景,建议立刻用 Claude Design 做高保真原型验证!


三、最小验证:让坏想法死得早

决定做了,下一步是怎么快速做出来。这个项目我两三年前就开了,一直没发布:视频编辑器工作量大,Whisper 早期时间戳对不准,业余时间老被打断,眼看要进“半成品坟场”。破局靠两个选择。

第一个是 Claude Design:用指令直接生成高保真交互原型,不用写代码,配模拟数据,几分钟就能上手测试。从头做没人做过的东西,靠写代码反馈周期太长;用原型,周期压到几小时,马上知道哪里不对。MVP 决策也在这步做:只做 Mac、只做最简单的播放和字幕。

第二个有点阴差阳错:我用了完全不熟的 Swift 加 AppKit。这些年我主要做前端,Electron、TypeScript 特别熟,用熟的语言有个坏处,你老想自己控制代码,一控制你就成了瓶颈,不放心让 AI 写。Swift 不熟,只能交给 AI,我只管验收,代码都不怎么看。正因为不熟才能放手,几天就做出能跑的 MVP。在不熟悉的领域开始,反而更接近 AI 原生思维。

BaoCut 差点死掉:高保真原型与一门不熟悉的语言救了它
▲ BaoCut 差点死掉:高保真原型与一门不熟悉的语言救了它

最小验证的另一面是让坏想法死得早。反例:我嫌刷推特微博太花时间,用 AI 一小时做了个客户端原型,挺漂亮,但做出来发现还不如网页方便,没有每天想用的冲动,砍掉。字幕 App 相反,比脚本好用太多,我每天都在用,就一直迭代到现在。


四、重设计:不要让 AI 模仿人

4.1 V1:模拟人类字幕组

GPT-4 时代的第一版,直觉做法是模拟字幕组:Whisper 听写、转 SRT、大模型翻译、人工校对、算法处理时间轴。能做,但问题多:模型翻译时自作主张把两条字幕合并,时间戳对不上;校对要完整看一遍视频,翻一集要一两个小时;长句还要靠大模型拆。V1.5 用工作流编排和算法打补丁,有效,但旧框架里打补丁,收益递减。

V1 模拟人类字幕组:工具替代了大量人工,但校对依然繁重
▲ V1 模拟人类字幕组:工具替代了大量人工,但校对依然繁重

4.2 V2:以终为始,三连追问

到了 Agent 时代,我重新思考这个产品,思路一句话:以终为始。终点很简单,把英文视频翻译成中文字幕。不问“原流程哪步还能优化”,从终点倒推,连追三个问题:

1第一问:为什么对不齐?

中英文语序不同,英文倒装、中文正序,SRT 条目级对不上,模型为了对上就把两段合并。但句子级一定能一一对应,为什么非要先拆 SRT?因为在模仿字幕组。Whisper 有个选项叫 word timestamp,每个词都有时间戳。我转录时保留词级时间戳,翻译按句子对齐,再回头按词级时间戳重拆,时间轴不用人工对。

2第二问:为什么翻译质量差?

一小时字幕太长,必须分页翻,分页后术语不一致。改进:先做整体分析提取术语表,每页翻译时注入本页术语,保证全局风格一致。

3第三问:为什么这么多人工?

因为在模仿字幕组每步人工校验。V2 里每步都给 Agent 验证工具,比如用脚本校验每条英文是不是正好对应一条中文,Agent 自己验收,人只兜底。配套地,界面从 GUI 变成命令行工具加 Skill 文件,数据从数据库改成静态文件。整个流程 Agent 自主完成,人只在两头:输入视频,最后验收。

V2 推倒重来:以终为始三连追问
▲ V2 推倒重来:不问原流程哪步能优化,以终为始三连追问
一页看懂:从模仿人到围绕 Agent 重设
▲ 一页看懂:从“模仿人”到“围绕 Agent 重设”

4.3 三条设计准则

  • 准则一:让 Agent 操作它最擅长的格式。 HTML、Markdown、纯文本在训练数据里管够,选型先问:这个格式模型见得多吗?
  • 准则二:给设计规范,不给模板。 模板是专家捷径,规范加模型能力是笨办法,但“苦涩的教训”说通用方法终将战胜专家捷径。模型每升级一次,产品不改代码自动变强,这就是“搭架子等模型”。
  • 准则三:把 App 做成 Agent 的插件。 用户现在不是先打开你的 App,而是先打开 Agent。最诚实的信号是我自己:BaoCut 是我写的 App,但现在连我都不打开它的界面了。Codex 里丢个视频链接,说一句“帮我翻译这个字幕”,它调 BaoCut 命令行翻完,我只确认。作者本人都绕过了自己的图形界面,这就是入口迁移最诚实的证据。
作者本人都绕过了自己的图形界面——入口迁移最诚实的证据
▲ 作者本人都绕过了自己的图形界面——入口迁移最诚实的证据

五、落地验证:流程没变,人的角色变了

新功能怎么上线?上周的真实案例:用户有两台电脑,一台性能好不常用,一台常用性能弱,希望“远程转录”,用常用的机器指挥另一台的显卡跑字幕。好需求,我按固定流程推进,但没打开编辑器。

落地五关:流程没变,执行主体变了
▲ 落地五关:流程没变,执行主体变了,人的位置在关键节点上
复盘四句话
▲ 复盘四句话:角色变了、确认合并不省略、验证题给 Agent、瓶颈在两侧

• 第一关 可行性:Agent 分析罗列方案,人做判断拍板;

• 第二关 设计文档:文档是一等公民,对人是确认载体,对 Agent 是跨 Session 上下文接力棒;

• 第三关 高保真原型:数据全模拟,看见实物才知道差距,把需求、原型、UI 合成一次确认;

• 第四关 模块化实现:拆成小里程碑,一次一个小版本,代码交给 AI 写;

• 第五关 测试验收:把自己当普通用户凭直觉乱用,抓功能、性能与安全,把问题扔回给 Agent 改。

整个功能时间跨度一两天,实际投入几小时,以前至少要几周。流程还是传统那套,一个没少;变的是我的角色:不再是程序员,而是产品经理加测试,更像管理者。确认可以合并,不能省略。验证题给 Agent,判断题留给人。


六、结语与一页落地地图

一页落地地图:找需求→判边界→最小验证→重设计→落地五关→持续进化
▲ 一页落地地图:找需求 → 判边界 → 最小验证 → 重设计 → 落地五关 → 持续进化

总结一下。做 AI 产品,先找符合 AI 特点的需求:痛点够不够硬、自己是不是用户、AI 是不是刚好够到;再看三条边界:能力、成本、价值。做的时候先做高保真原型快速验证,让坏想法死得早。设计时站在 AI 的角度:给它工具自己验证,用它熟悉的格式,给规范不给模板。开发时人的精力放在定义和验收两头,确认可以合并,不能省略。

模型一直在进化。今天 Agent 能力强,明天可能是一群 Agent 协作。每次边界线外扩,都值得重新想一遍:这个能力边界下,对 AI 最好的设计是什么,有什么新需求冒出来了。就像训练大模型要推翻旧权重,做产品的人也要敢于推翻自己的旧答案。


腾讯内部精彩问答 (Q&A 完整记录)

AI 原生思维腾讯学堂精彩问答
▲ 腾讯学堂现场精彩互动问答
Q1在和 AI 协作的过程中,有没有一个具体的习惯或方法,对个人成长帮助最大?

我的经验就一条:先用起来。只有实践才有真实感悟,我今天讲的开发过程,你不自己做一遍,能带走的东西很有限。最根本的是建立反馈循环:定义想做的事,AI 帮你做成,你验收;分享出去收反馈;把经验写出来,AI 帮你整素材,输出又倒逼你系统思考。小循环做项目,大循环做分享。把人的成长做成一套 Loop Engineering。

Q2哪些事情该交给 AI 做,哪些事情要留给人这个 Human in the Loop?

执行层交给 AI,不用有心理负担。写代码、生成 PPT 样式让 AI 做就很好。程序员别把自己当写代码的,当 Tech Lead 或 Engineering Manager,AI 是你的员工。你的价值在两头:定义问题和验收结果。定义问题靠反复练习,验收靠品味。

Q3品味感觉有点虚无缥缈,怎么界定和提升品味?

有点像模型的监督微调。编程、数学有客观标准,跑测试就知道;写作没有。我的办法是大量输入加自己上手:读很多文章,自己也写;好的差的一对比,品味就出来了。画图、视频也一样。这件事 AI 短期替代不了,就像大模型靠数据训练涌现能力,人也一样。

Q4作为非工程师,怎么判断 Vibe Coding 出来的代码是否靠谱?

不用太在意代码细节,整不整洁不是关键。你把自己当 QA,看三件事:功能完不完整;性能好不好(CPU/内存占用);安全是最高优先级(SQL 注入、弱密码这类常识测试)。其他实现细节当黑盒就好。

Q5传统硬件、创意或销售岗位,不知道怎么用 AI 提效,有什么上手建议?

先把 Agent 用起来,别停在 Chatbot。日常重复的、知识类的工作都可以让它试。买东西让 Agent 比价选型;处理保险、法律资料;申请苹果开发者证书这种生疏流程让 Codex 代劳。跟工种关系不大,多试探它的边界,就像打游戏开地图,地图越开越大。

Q6长生命周期的老项目,文档少、测试不足,AI 一改就出问题怎么破?

两点最关键:第一上下文,维护一个 AGENTS.md 或 CLAUDE.md 作为项目结构与规范地图;第二让 Agent 能自己验证,补跨模块集成测试,做需求改 Bug 时同步补,老项目也能改得动。

原文整理自:宝玉 (@dotey) 在腾讯学堂的公开技术分享《AI 原生思维 —— 像训练大模型一样训练自己》。