刘嘉 - 为什么我不推荐下班学AI

项目 内容
来源 https://v.douyin.com/QcCIe1jsi2Y/
时长 42分0秒
转录时间 2026-08-31 20:23
字数 15189
分段方式 AI智能分段(含Markdown标题)

📝 章节标题由AI根据内容结构生成,非原文内容

📝 AI摘要:AI工具的实际使用体验与媒体宣传的“丝滑”存在差距,用户需要投入大量时间检查结果,甚至可能因AI而工作量增加,但这正是掌握工具的表现。面对AI,人们更需要关注自身不可替代的能力,并在具体领域深耕,通过克制与聚焦来创造独特价值。AI能生成看似专业的成果,但无法替代个人成为真正的专家。


一、开场与核心问题回应

【野说商业】如果说现在AI都能生成了代码,你是怎么考核你的学生的?

【刘嘉】我们这个行业会把你们所有使用工具的摩擦力终将降到最低。媒体视角里面就觉得说AI真的就是无所不能的。正因为产生多了垃圾,我们才能产生出多样性。当年看莎士比亚还还都是垃圾呢。什么时候你发现你使用AI工作量增加了好多倍,恭喜你,你AI入门了。比如说我的身边有很多技术中心主主义吧,他觉得技术可以解决一切问题,可能消弭一切的什么认知的差别。至少在我的实践中,我会觉得说我跟AI的磨合度没有那么的丝滑,我需要大量时间去check它的结果。但是在媒体视角里面就觉得说AI真的就是无所不能的,AI太惊爆了。媒体上阐述的东西和我真实使用的体感,并不是太相似的。

二、AI使用的具体方法与心态调整

2.1 方法一:用AI检查AI(左右手互搏)

【刘嘉】首先回答一件事儿,就是check这件事儿其实是可以交给AI做的。我我们一般都叫做左右手互搏,啊,就是你拿A模型生成的什么东西,你可以交给B模型,跟B模型说这是A模型给我的答案,你帮我挑刺儿,帮我找茬儿,然后拿B模型找茬的结果再给A模型,你说你再帮我挑刺儿,这这是这是B模型给你的挑刺儿挑刺儿和找茬,你来你来你来试图回回复一下。多轮之后你就会个人能力会有提升的,你要仔细看它的这个回复过程,你的品味、你的审美,你就有可能会提升。从概率的角度来说,我们大体上认为两个模型同时在某一处出现幻觉的概率是相对比较低的。哎,如果一个模型的出错的概率是百分之十,而另一个模型出错概率百分之十,它们在相同的地方同时出错的概率可能就百分之十乘百分之十,那就只有百分之一。

2.2 方法二:理解媒体展示与个人体验的差异

【刘嘉】第二件事儿是,你觉得别人用AI用得很丝滑,媒体上,而我们用AI用得不是很丝滑,这是非常正常的一件事。

【野说商业】第一点是因为网上出现的那些内容是你喜欢的内容,你你看的东西都是你喜欢的东西,你喜欢的和你需要的可能是两件完全不同的东西。

【刘嘉】你喜欢很多男明星,哥哥、弟弟、儿子、侄子的这样,但是你真的需要他们跟你共度一生吗?

【野说商业】喜欢和需要可能是两件不同的事情。

【刘嘉】第二件事,网上的所有视频,大模型的所有demo,都非常有可能是最好的一次结果,就是它无数次的测试之后,对,而不是它平均结果。

【野说商业】而对你来说,你用的每一次都是那个特例的结果。

【刘嘉】最好的结果、平均结果和你特例结果,它之间存在差异是很正常的事情。

【野说商业】我们要做的就稳定自己的工作系统,然后在中间不断地去完成这件事。

2.3 心态:AI使人更忙是熟练的标志

【刘嘉】什么时候你发现你使用AI反而会让你更忙了,工作量增加了好多倍,恭喜你,你AI入门了。

【野说商业】对,你想想当年用手机是不是更忙?是的。

【刘嘉】原来原来只有固固定电话,有邮件系统变得更忙了。就是你所有变得更忙,就是因为你熟练地使用了当下最流行的工具。不要害怕,不要焦虑。你真正焦虑的是什么?是你有没有超越AI的能力的那个能力。你要焦虑这件事。什么事儿是AI做不了的,但你能做,那这就是你的最大价值。

【野说商业】只要我越熟练地掌握一个工具,我的时间贫困就会来得更早一点。

【刘嘉】对对,是这样的。

2.4 实践:从多线程发散到单点收敛

【野说商业】我现在都不敢太用AI完成多线程的工作。为什么?

【刘嘉】因为我的工作会太忙。大家理解就是我们原来有多个agent帮我写论文,帮我找这个idea,然后帮我做实验,帮我封闭一个晚上,它生成了二十篇研研研究过程,我得花两三天、三五天不断地去check这二十二十中间的每一个细节,我觉得我太累了,我根本根本跟不上AI的速度,那怎么办?我就所以现在我要分步来做,我要先去收敛,我不能让它完全发散,因为它发散中间那那十那十八个、那十七个、那十五个可能是完全没有用的。我在最开始要把它摒弃掉。这样才能让我的聚焦focus在某一个点上面,然后把那个点做深,然后展开。是。我我不希望有二十个平均水平的答案,我需要有三个非常我经过我思考的、非常我有品味的、非常深入的答案。所以在这个过程中间,我们使用AI的是多轮交互,而不需要它长链条。

2.5 核心原则:AI是工具而非主力

【野说商业】不要去把精力完全放在AI工具的学习上。听起来就是,我觉得AI工具应该变成我们所思所想的一个延长线。

【刘嘉】对。

【野说商业】它不能是那个所谓的主力。

【刘嘉】对,现在没有人会说我会熟练使用智能手机,熟练在。

【野说商业】淘宝上买东西,我会熟练看抖音,没有人会说这件事。

【刘嘉】因为我们这个行业会把你们所有使用工具的摩擦力,未来终将降到最低。那么问题就是,我能不能在淘宝上卖东西?我能不能在抖音上做一个好视频?我能不能完成我所谓的数据分析的结果的判定?这才是变得更更难。而这个差距反而会变拉拉大。如果你有品味,你有审美,你有这个能力,你反而会把你那个能力的价值变得更大。一个好的导演,他能分辨出一个好的故事,他能分辨出一个好的分镜头运用,他能分辨出一个好的受众的这个这个接受程度。那么AI对他这个这个稀缺能力的放大反而会变放得更大。

【野说商业】但是如果你根本就不是一个导演,你没有这样的审美,那么AI只会让你生成一个你看上去还不错的东西,但因为大家都能生成同样的还不错的东西,你是没有办法获得比较优势的。

【刘嘉】我用AI做一个东西。你也不要那么沮丧,对。

三、核心能力:判断力

3.1 AI兴奋感的根源

【刘嘉】我说我其实我只是在想,就是说我们所谓的用、使用AI的这种兴奋感或者幸福感,不是因为你在那个领域不专业,你当然会有兴奋感。我在二三年的四五月份,Midjourney出来之后,就文生图那个那个软件出来之后,我生成了好多好多图片,然后发给我艺术学院的同事朋友,我就跟他们讲,我说你们的学生现在转行还来得及吗?非常的这个这个傲慢,傲慢,对,偏见,对。然后他们就会,他关系非常好了,他就跟我解释这个图上有哪些问题。我突然当时二三年的时候意识到,当你觉得AI给你的东西非常好的时候,不是因为AI能力强,这个结果是你在这个领域不专业。

3.2 观点提出:不专业导致无品味

【刘嘉】因为你不专业,所以你没有品味,你不知道什么叫好。你不知道在这种场景下什么叫好,你不知道针对某种客户、某种用户、某种这个审美状况下什么叫好。

3.3 对比说明:专业与不专业的区别

【刘嘉】如果你专业,你应该像我们看到AI生成的所有东西一样,代码一样,或者是我的研究、研究的这个论文或者实验一样,我能找出一堆问题。因为我们毕竟没有办法把我们的所有思考、所有的上下文、所有的约束条件完全讲清楚给AI,那么AI一定会有一些偏差,而我又能准确地看到这些偏差,那么我才在这个领域上是有专、是有专业性的。那么我使用AI才能提升我的效率,因为我有超越AI的稀缺性,我使用AI才能把我的稀缺性放大。

3.4 AI使用能力的现状

【野说商业】那你刚才一直强调的几种能力,可能很多人他没有意识到,就是说在AI时代我应该具备哪些能力?然后他可能因为没有意识到,所以也没有刻意培养过自己的能力。他面对AI可能更像是一个所谓的聊天的对象,比如说我把我的心事、我工作中遇到的难题,或者说我跟朋友之间遇到的一些,这挺好的。对,跟跟AI讲。他可能更多的是一个所谓的陪伴者的角色。

3.5 核心能力:判断力

【野说商业】那如果说以我们要更多的交付,或者说我们要更多的以产品的思维去构建自己如何使用AI的话,那么对于普通的这种上班族或者白领,他下班之后应该如何去构建自己这样的能力呢?

【刘嘉】我认为使用AI最核心的能力就是三个。字:判断力。就是AI给你的东西,你要判断对错,判断好坏,判断我要修改什么,判断我能不能交付,判断这个我交付之后会带来什么样的结果,然后判断我应该怎么改。所以最核心的就是判断力这三个字。而判断力就来自于所谓的品味啊、审美啊,这每个领域都有自己的品味啊、审美啊,或者包括这些这些东西。

3.6 判断力的培养:AI Off训练

【刘嘉】我认为年轻人是不需要专门学这些东西的。你说不需要学这个技术,还是不需要学什么?不,不需要去专门上一门课叫做判断力。不需要专门上一门课叫做审美。不需要专门上一门课叫品味。我觉得这个上不了,这件事儿是我们教育的问题。我们教育没有办法,通过一门课提高你的判断力。判断力是通过你的主动性、你的好奇心,在你的现实工作中间不断培养的。所以没有说我下班的几个小,下班几个小时你好好刷刷视频,好好休息休息,锻炼锻炼身体,陪陪家人,这最最好的事情。这句话可能可能很多人会把它无限播放,说老师告诉我们要多刷视频放松放松。所以我认为所有使用AI都应该在你的工作环境中间。紧紧围绕你的工作。

【野说商业】那么判断力是怎怎么提升的?

【刘嘉】你要有一些AI off的能力。就是我个人认为在AI时代最好的训练是关闭AI之后的能力。你们理解就是我们现在有很多人健身,那么深蹲、卧推、硬拉三大动作,在我们现实生活中间有用吗?说你因为你的这个东西放得比较高,所以我要引体向上,所以才能把东西拿下来,不可能。所以那我们为什么要练深蹲、练硬拉?还有人跑马拉松,是你上班需要跑步上班吗?不可能,你你骑骑共享单车都比跑步快。那你为什么要跑步?为什么要练这些?为什么呢?那是因为我需要提高我的身体素质,我要提高我的血氧量,我要提高我的心肺功能,这样我能在我的工作中间保持最好的精力。这叫我们叫基本素质、基本能力。判断力也是一样的,它也是一个基本能力、基本素质,而这个素质也得训练,而这种训练不应该说这。个训练有没有用。说我原本AI可以帮我生成邮件,所以我不应该写邮件了。原本AI可以帮我写作文,所以我不应该写作文了。原本AI可以帮我总结一篇文章的内容,所以我不要看文章了。我觉得反而不是这样。就在这个时代,阅读然后理解写作可能变得更重要。就是你什么时候把AI关掉,然后面对一个问题,然后你你你自己有一个答案,然后你问AI我的答案。批评一下我的答案,找到我没想到的一些思路,然后他会给你一些思路,然后你反复跟他跟他聊,然后看到自己的局限性,然后你的判断力就提升了。特别是你领域里面的工作领域里面的审美和品味会提高。所以这是我觉得每个学生都应该干的事儿。包括我们现在大学生是最需要做这件事的,因为AI能生成作业,所以他以为自己作业做完了,他就获得了,但其实没有。我我们现在因为老师没有办法来判定你的产出成果和你是不是真的理解、有有这个能力之间之间的这个对应关系已经消失了。所以学生要主动地关掉AI来做一些事儿,然后根据AI再反过来评审自己的东西,让自己提高。AI是个好老师。

四、AI生成内容的特征与人类价值

4.1 识别AI生成内容的困难与特征

【野说商业】那你是怎么考核你的学生呢?如果说现在AI都能生成了代码,第二个问题就是你如何看他们答案,发现他们是AI生成的还是不是AI生成的?

【刘嘉】目前我们看答案判断它是不是AI生成的是很难的。我们当然有些办法,但是理论上来说,我们是不能判别AI是不是生成的。你当然能感受到,就是因为正常人不会这么讲话。目前最常见的就不是而是,AI使用不是而是这个句式是普通人的大概四五倍。所以当你看到一篇文章里面大量的不是而是,大概率是AI写的。这就会导致了我们,当然这是题外话,导致了我们人类未来写东西,为了避免看上去像AI,我们得把把AI的不是而是全改改掉。对,就类似这样的一些特征。我觉得AI写的东西太工整了,就他们缺少人的灵动在里面。我们讲AI给你生成的答案是好的平均水平。对。对,它给你生成了一个非常好的水平,但是它没有个性化。你当然可以让AI写得更个性化,但是AI的个性化也也是不是那么稳定。你要足够的上下文,你要去训练它,你要去把把那个表述方式要要给它,但这个是比较复杂。那么绝大部分人做不到这件事儿。但是普通的AI生成当然一定是有一些模式的,但是理论上来说,我们未来仍然是没有办法能够百分之百确定是不是AI写的,因为我们在实验中也已经出现大量的这种情况。很多著名作家的文字。,被AI认为它有百分之七十的AI生成,可是那帮那帮那帮作家已经去世了。对,他他他他没有经历过AI,AI,AI这个时代,所以大概就是说他没有经历AI这个时代,但被AI判定为,他这他是百分之七十是AI生成。对,因为那个文章的权重过高,他可能写得非常好,所以他的权重比较高,那么AI训练的时候,他就模仿他的他的状况。所以年轻的孩子,年轻的人拥抱这个时代最好的方式就是熟练使用工具,以及拥有没有工具的时候的能力。

4.2 警惕性与习惯

【刘嘉】啊,这两者是矛盾的,但是它又是同时存在的。哦,我觉得可能就是人要有一种所谓的警惕性,这种警惕性是当我对AI过度的使用的时候,然后我要警惕说这些东西是不是我关掉AI之后我能成立。

【野说商业】因为现在很多大,我觉得你,我觉得你太焦虑了。

【刘嘉】啊,是吗?

【野说商业】对,年年年轻人不需要警惕性,他需要习惯。

【刘嘉】我觉得年轻人更需要像健身一样的,他就是每每天或者每一个礼拜三天我到健身房,做一些毫无意义的动作。

4.3 具体建议

【刘嘉】对,然后追求那毫无意义的数据。对,这这这干这件事儿,就是他每每两天关掉AI做点事儿,做点训练就得了。啊,我觉得这就可以了。

4.4 AI能力与案例引入

【野说商业】AI对于我们大部分人来说,其实产生的最重要是文本能力嘛,或者图片能力。

【刘嘉】有一些我的朋友们,他就试图去蒸馏我的文字风格,我给他一个命题作文,说比如说一次愉快的旅行之类的,然后你就会发现,就是AI生成的东西,在我看来就是一塌糊涂。对,一塌糊涂有几个问题啊,第一个就是所有文字东西最难的其实不是文字的流畅性,所有文字或者所有文章,我们喜欢看小说,我们喜欢看这些公众号,我们喜欢看一些视频,它最难的是角度,那个角度的选择,任何一件事儿都会有多种角度来看。

4.5 核心问题:视角选择

【刘嘉】那么,一个好的作家是找到那个特别恰当的角度,但是AI可以生成无数个角度,但是到底哪个角度是最好的,最适合你的听众的,或在当下这个环境是最恰当、最适合传播的,或者或者最有洞见的,别人没有想到的,AI没有想到的视角,这个是第一个就是视角的问题。你觉得很多文章看太太像流水账了,或者太太太像白开水了,那是因为你的视角已经比他们高了。这就本质上跟我们做研究一样,我们研究选择一个题目切口,也得是它有独特的角度,独特地解决现实的问题。然后第二件事儿才是文字问题。

4.6 AI文本能力的第二个缺陷

【刘嘉】那么AI文字确实非常公正,优秀的平均水平。

【野说商业】但是人有些时候喜欢看残缺。

【刘嘉】,人最有价值的就是残缺,就是不完美。你真正给你一个完美的人生是毫无乐趣的。你就是喜欢不完美,因为你所有的记忆都来自于不完美。像你们出去玩,你印象最深的是你按照计划走完了所有地方打卡点拍的照片吗?不是的,是因为有一次走错了,走到了其他的小巷,看到了一片风景,遇到了一个人,遇到了一个小店,然后成为你整个旅程中间最美好的回忆。但是你用AI,你是体会不到那个走岔路了,然后走到那个误入藕塘的那种感觉。

4.7 AI文本能力的第三个缺陷与乐观展望

【刘嘉】第三个件事,我认为当所有人看惯了AI的短剧,看惯了AI写的文章,我觉得大众的审美也会提高,他们也会追求不同不一样的东西。

【野说商业】人嘛。

【刘嘉】贪婪,欲壑难填,这就是就是人最最主要的特点。所以他们会有更高的要求,而更高要求靠谁来填补?一定是靠人来填补。对,就是一定是人来创造一些东西,来填补一些流派。人创造了一个新的流派,AI再去学那个流派。我个人觉得人会引导着AI往前走,然后我们的审美也会提高的。

【野说商业】啊,这是乐观乐观的状况。

4.8 悲观展望

【野说商业】那不乐观的?

【刘嘉】不乐观的状况就是跟我跟用耳机一样。对,用耳机我就,我这辈子也,我估计可能,在没有训练的情况下,我也听不出两千块钱和两万块钱耳机有什么不一样。那两两千块钱对我来说就是我的审美的上限,对,耳机审美的上限。啊,那那么我就可能得得认同这件事。

4.9 个体审美差异

【刘嘉】但是我我仍然认为人的需求是多种多样的。我在耳机上没有审美,但是我可能在软件的论文上有审美,或者我对某一个课,它这个课怎么上,怎么组织材料,我可能有审美。我大概觉得,哎,这个这个组织得非常好。业余很多长工作是在看MIT啊、CMU啊这些学校的,我我是公开课,它内容的组织,然后我们来看能不能融入到我们的教育中间去,然后去学习和借鉴。那我对这些就有审美。我觉得有些虽然名气很大,但是结构并不那么好,但有些课就非常好。

【野说商业】所以你会知道,就是每个人一定在某一个领域有足够的好奇心,或者有足够的专专业性。

五、代际差异与底层能力的重要性

5.1 AI时代的垃圾与多样性

【野说商业】那比如说现在很多就是信息过载嘛,然后AI产生了很多垃圾信息,你觉得年轻人如何在这种高度的喧嚣的情况下去保持自己的内心的秩序,构建自己的第一性?

【刘嘉】随着技术越来越发展,我们的垃圾本来就越来越多。我讲的就是一个好工具生成一个好东西的难度远大于一个好工具生成一个垃圾的难度。关键是,你认为的垃圾是从所谓的文学上或者从专业上考虑垃圾,那也许它在传播上,它在温暖人上,它在给人意义上会产生额外的价值也不一定。正因为产生多了我们打引号的垃圾,我们才能产生出多样。性,而产生多样性,我们才能涌现出,足以改变人的某些风格,或者足以影响这个世界的某些风格。你,你当年看莎士比亚还还都是垃圾呢。所有的严肃的作者都觉得莎士比亚做的是垃圾。那么这个东西成长出来了,涌现出来了,流传下来了,那么未来我们觉得莎,莎士比亚的东西写得非常好,也是一种非常好的风格。那当年觉得毕加索是垃圾,所有我们当时看到的垃圾,其实是增加了这个世界的多样性。所以我对AI生成垃圾,我没有那么那么那个,因为时代总会沉淀出一些更好的东西出来。

【野说商业】啊,你刚刚说的垃圾会不会是outlier?

【刘嘉】不完全,就差不多吧。就是我不是最主流的东西。对对,不是最主流的东西,或者是有些奇奇怪的东西,对,那当然就是垃圾。那它有稀缺性。也也有可能因为AI能生成特别主流的东西,导致了一堆人类创作者不得不去找那些非主流的角度去切入,而找非主流角度切入的人越多,产生出未来可能经典的东西就可能变得越多。

5.2 新一代学生的特质与短板

【野说商业】比如说你已经教学那么长时间了,你觉得你现在接触的本科生和研究生和过往你,比如说十年前接触的本科生和研究生有什么区别吗?

【刘嘉】对我认为所有特质,就是所有盔甲都是他的软肋,一定是一体两面的。现在学生最主要的特点是什么?那么年轻就接触到这个世界最好的东西,能够接触到最好的工具,最先进的知识,能够零距离接触到这个世界最好的课程,然后能够在网上随时随地低成本地获得这个世界最具有才华、最具有思想的人的演讲或者是观点或者是报告。他们能够更快地接受这个世界正在发生的事情,他们思维更加的广阔,然后同时越来越去思考我们所谓他所谓自我的价值、自我的意义,然后想选择自我的生活。我我个人认为这都是这一代年轻人和十年前、二十年前的年轻人。最大的差异性。但是它会带来另外一个反面的过程。我老师的那代人到我学生的这一代人,这么这么中间几代人中间,他们在基础能力上的差异性是非常巨大的,是逐步下降的。大家对于核心东西的理解越来越浅的,但是他们对新鲜事物的接受和制造是越来越能力会会提升的。

【野说商业】核心的东西是指什么呢?

【刘嘉】啊,就是比如说机器是怎么工作的,那些最底层的原理,他们就不理解了。年轻人的理解的这个能力或者程度或者那个细节或者那个准确度是比以前的学生要差一些的。对于数学的理解是差一些的,因为他们经历过大量的数学的计算,而对数学本身的应用和理解就好像会反而会变差。我对我认为是这样的情况,就是当你获得一样东西越来越容易的时候,你对这件事儿的理解反而会越差。比如说我们现在从小就能获得自行车,那你谁谁能讲清楚自行车的原理是什么?可是你要回到几百年前,做真正拥有家里拥有自行车的人,一定是对自行车本身是非常理解的,因为它非常稀缺,所以大家会研究它,去深入地研究它。而你只把自行车当成工具的时候,你就不会去理解它。那么现在有有人理解拉链是为什么能合上吗?就很少。但是以前拉链刚出来的那些,那那些制制造工人那些人是非常深刻地理解为什么拉链能合上,怎么才能咬合住,怎么出来,然后坏了会怎么办。所以这就是我觉得一代人和一代人的差别,也就是当一个事物刚刚发生的时候,大家去专注于这个事物底层的东西;当一个事物开始流行的时候,大家只专注这个事物的使用,而不去关注底层的东西。那么不关注底层的东西,实用主义来说是非常好的,但是从另外一个角度来说,你不关注底层的东西,你也许在对这个世界的有些理解上,你可能会有些偏差。就像我们为什么现在的社会,我们还有很多人要去学古代的历史、古代的观点、古代的一些东西,虽然这个东西在对于现实可能没有那么适用了,但大家为什么要学习这件事?

六、技能价值与时代差异

6.1 理解世界流转

【刘嘉】因为所有的观点的流的状况都是有一个流转的,它像一条河流的河流一样的,它有一个流转的过程,新的东西取取代了旧的东西,解决了旧东西的问题,然后又带来新的问题,然后再更新的东西来解决这个新问题带来的问题,这时候它会有一个流转的过程。当你理解这个流转的过程之后,你对这个世界的看法或者你对这个这份工作的认知,你会达到一个比较高的高度。可是你如果不理解这件事儿,你可能完成这个东西的感觉是没有问题的,但是真的它出问题了。

【野说商业】,你就没办法去去解决这件事。

6.2 底层技能与极端情况

【野说商业】我怎么听起来好像是现在的学生越来越像一个工蚁的逻辑?

【刘嘉】也没有了。现在学生我觉得就每代人都这样。我我们我们以前也不用学某些技能,但是这些技能也许在某某一个时刻就会突然有用。我当然知道我们现在是会越来越好的,但是你在一个具体的工作中间,你并不知道在这个工作中间会不会回到史前,是吧?你知道我在一万年前我最需要学的技能是什么?是钻木取火,是闻动物的粪便,是了解动物的气息,是和所有的人共同狩猎。那这个能力已经我们已经完全没有了,这叫人生存的底层能力已经没有了。我们现在不不会要求这件事了,但是你并并不能保证在你的工作中间不会出现类似像你突然被投送到荒岛,这个系统突然崩溃了,你所有的工具都没有办法没法使用,你必须要从底层的那个一行一行代码最底层的代码去去去 debug,去来找到问题,或者是原本所有坚信的东西突然因为某件事崩溃了,那我得从底层构建我所谓的底性原理,我得从底层构建我对这个世界的信仰。那我我完全我不了解了,那你可能构建自己的幸福或者构建自己信仰的能力可能会有缺失。啊,就是极端情况下你就丧失了理解这个世界的能力。但是因为是极端情况,所以对绝大部分人来说并没有那么重要。你这辈子可能不会遇到这样的事儿。

6.3 以修自行车为例

【野说商业】我们得到自行车太容易了,所以我们就非得了解自行车吗?

【刘嘉】不是的,是因为如果你在川藏线上,如果你在新藏线上,自行车坏了怎么办?你当然得学会补胎,你学会调那个螺丝,你会上重新上链条。那这个能力对你来说在那个过程中间是很重要的。也许那就是一份工作。你的工作也许会大量的遇到在新藏线上骑自行车这样这件事儿。但如果你的工作就是在城里骑自行车,那你就不需要学这件事儿。你明,你完全可以把它交给一个分工的一个一个公司去来完成这件事儿。呃只是以前全。来完成这件事。只是以前全世界的人都会修自行车,而现在可能只有一部分人会修自行车。

6.4 新旧时代差异

【野说商业】那我认为,如果只有一部分人会修自行车,对于大家来说,这叫差异。

【刘嘉】我不,不是说好坏,就就就会就是你刚刚问的,就年轻人和以前的人有差异性在什么地方?这叫差异。他们更希望让他们通过骑自行车带来更多的收益,带来其他的收益,是吧?一个普通自行车变成共享单车,创造一个创造一个新的商业模式。他不需要去了解自行车该怎么修。对,我觉得这是,这就是新一代人和旧一代人的差异。

七、AI不确定性与应对心态

【野说商业】那比如说你之前的研究方向就是,比如说智能软件的测试啊,或者深度学习的这种框架的质量保证。传统的软件就是要输出A,一定要输出B。但现在其实AI有很多的幻觉,就软件如果自身或者说AI的应用自身就是一个不确定的情况下,像现在有很多的智能投顾,就它可能用AI的软件或者说直接让你去做一些投资的决策,或者甚至有一些AI的应用是说帮你去确诊或者是医疗的这类东西,在这种不确定里面或者幻觉里面,就是我们怎么更好的去利用它?然后你们从你们的专业角度来说,你们去如何测试这样的一些软件,使得它们更加确定性,或者说你们如何测试一个这种不确定性的软件?

【刘嘉】啊,就是不确定不代表不能用。OK。天气预报也是不确定的。那我们也要用天气预报。是。医疗检查也是不确定的,因为它有假阳性、假阴性。但我们也不能不去用医疗检查。所以不确定性不代表不能使用。OK。而使用的最主要是你要得知道它的不确定,你得知道如何去check它的不确定,如何去接受它不确定的后果。我觉得这是现代人需要去面对的问题。而不是去想说不确定性我该怎么办?啊,就是我我我我不能用或者怎么样。我们面对的这个世界就是不确定的。这波AI就作为大语言模型,这波AI其实给我们所有人类带来一个更新的一个体验。我们在追求确定性,但是这波AI告诉我们这个世界就是不确定。的。你未来用的所有工具、所有东西都是不确定的,都是人和机器或者人和AI的共创的一件一件事情。我觉得这就是每个人需要接受的一个现实。我们现在接受的是,只要计算机就是确定的。我银行里面存款的余额是零点三二,它就得是零点三二,它不能变成零点四八。那我们未来可能要接受这个世界有确定的系统,也有不确定的系统。所以大概就是我们要接受的事儿。然后我们可能面对这件事儿之后,因为我的专业是比较跨学科的,我本科是学数学的,然后学系统工程,然后又来搞软件。

八、三个底层认知

【刘嘉】我大体上觉得这个世界可能有这几个更底层的东西,如果能够知道,会安抚自己的这个状况。第一件事就是数学,数学就是,数学最大的特点不是做题目了,也不是难不难这件事儿。啊,数学最大的问题就是所有数学的东西都必须得有前提条件,连数学这样完全正确的道理,它满足它都必须要有前提条件。比如说我们说这个这个纸的周长,那是我们要在可观测范围之内,否则这个纸是没有周长的,它只不过是分子的聚合物,分子之间是离散的,哪来的周长?所以我们所有东西的提出都是有约束条件的。

8.1 概率:接受不确定性

【刘嘉】第二件事就是关于不确定性的问题。如果你学概率或者学统计学,你会发现一件事儿,数据或者是我们获得的证据,它并不是为了得到一个真相,它只是把这个世界的不确定性变少一点。所以这个世界不存在,本身就不存在零和一的关系,就是这边是完全不确定的、随机的,然后这边是完全确定的,在零和一之间有个广阔的天地。而我们的所有信息也好,你所有的决策也好,你学到的所有知识也好,你对这个世界认知也好,本质上是在这个零到一的坐标上,你去往左边还是往右边移动一点。那么这就是我们的一个状况,我们要接受这个世界本质就是这样的。

8.2 系统工程:局部非全局最优

【刘嘉】然后第三个就是系统工程学,我们我硕士博士都读的是系统工程学,系统工程学有一个非常重要的一个道理或者是一个底层的逻辑,就是局部最优不一定能带来全局最优。我们如果每天都焦虑,然后我们想每天都往好的方向找到一个好的结果,往前走一步,那你获得的永远是局部最优,你是获得不了全局最优的。我们每次决定或者我们每次学习都希望它有用,都希望它有价值,这件事相当于什么呢?相当于把你随机的丢在这个喜马拉雅山脉,你每一步都往上爬,你是能爬上珠峰吗?是不可能的,因为你大概率会在一个六千米的山坡就停下来了,周围全是向下坡路,所以你是爬不了珠峰的。人要爬到自己理想中的珠峰,是不能每一步都往上爬的。想获得全局最优,你有些步骤就一定不是最优的。

九、AI本质与AGI终局

9.1 AI思考与人类思考

【野说商业】那你觉得就是大模型是在进行真正的思考,还是说它不过是一个数理世界的拟合?

【刘嘉】关键取决于你对思考什么定义。如果你的思考就是接收信息、处理信息,得到类人的结果,那么大模型已经已经在思考了。但你的思考是要一致性,需要有自己的价值观,需要留痕,需要变化,需要沉淀,需要有意识。大模型还远得很。这个人工智能这个行业最大的问题啊,就是我们太喜欢拟人化了。我们所有的学习方程,所有的这个这个结论,我们都去拟人,说这个大模型就跟人一样拥有了什么样的能力。

【野说商业】是的。

【刘嘉】因为这样比较好让大家理解。但是其实机器和人就是完全不一样的,它的方式和我们思考的方式,它获得情感的方式和我们获得情感的方式,它有有没有意识和我们有意识的方式可能完全不一样。我虽然不知道有哪些不一样,没有办法那么明确或者准确或者是科学的把这些事儿区分开来,但我认为这就可能就不一样的事,就不能完全因为我们能做同样的事儿,我们就把这件事儿的底层逻辑说成是完全一样的,说成完全一样的类。比方式只适合理解,不适合描述它的这个真实状况。所以我认为大模型的思考和我们的思考可能是两条完全不同的路。你,我我可以认为它的思考是一种拟合。但是这种拟合也是非常非常复杂的拟合。我们我们自己的思考是不是拟合,我不知道。啊,也许我个人认为我的思考是有另外一种方式,因为我毕竟是我是少样本学习的。我不用看一万张猫的照片我才会识别猫,我看一张猫的照片就会识别猫。那么这这两者可能是不太一样。所以我不建议大家永远地讨论人工智能要拟人化。我认为大家就应该把它当成一个合作伙伴,当成工具有点低看它了,当成当成人又有点不太恰当,当成你的一个机器伙伴,然后跟你一起共同成长。然后你需要什么样能力去找它要,它如果能提供最好,如果不能提供你就自己自己搞。

9.2 AGI何时到来

【野说商业】那你觉得AGI的终局是什么?它什么时候会到来?

【刘嘉】我要知道它什么时候到来,我就我就all in那个到来那家公司的股票了。没有,不知道,不知道。它技术的发展是非常断层的,它可能会突然一个飞跃。两千年到二零一零年左右,我们一直困在关于神经网络参数计算上面。那后来突然吴恩达写了那篇论文,我们知道可以不用CPU算,用GPU算,跳跃了。一七年一八年,注意力机制出来,Transformer出来,那我们突然发现又又跳跃了。这些跳跃都是不可预测的。我们知道一定会有跳跃,但是什么时候来,我们并不知道。就是我们知道天一定不会像今天那么热,它一定会冷下来,但是哪天冷下来,我们并并不了解。所以我认为AGI一直在路上,它在不断地逼近人类,或者在不断地解决人要需要解决的问题。但它到底哪天来,能够做到什么程度,我们都没有办法,我们只能等待它的到来。

十、AI大模型发展阶段

10.1 引入:AI大模型发展阶段

【野说商业】你觉得AI就发展大概经历了哪几个阶段?

【刘嘉】我们只说大模型,AI发展经历时间就就久了。

10.2 引入与起点

【刘嘉】大模型大概就是一开始是从一七年的Transformer那篇论文开始。OK,然后大家黄仁勋那篇论文开始,OK,然后大家觉得我不需要写规则,我不需要用人的智慧来教AI怎么做,我只要把人类这个世界上所有的数据给AI,让AI就能拟合出来或者学习到人类的规律或者是规则,然后让AI自己来完成这件事。当时很多人不相信这件事,觉得机器那么笨,我必须要我来告诉他我的理解,我的抽象,我我对这个世界的这个看法,他才能学会人类的这样。但是OpenAI最后发现不是这样的,只要数据拟合得够多,AI涌现出来的智能是足够强的,所以叫 scaling law。这是第一个阶段,我们突然发现了足够的数据,足够的参数,我们能让AI拥有跟人相似的能力。

【野说商业】这是第一个阶段。

10.3 第二阶段:推理大模型

【刘嘉】第二阶段就开始大家发现,因为是随机系统,就概率模型,所以导致了我问问题,它可能会有会有幻觉,我问问题会有会有会有会会有不同的情况。大家就想了一个办法,就要从工程上开始开始做努力。

【野说商业】那怎么努力呢?

【刘嘉】就是叫推理大模型,就是我不把你的问题直接问给AI,我把如何解决你的问题,对你的问题如何思考发给AI,让它生成一个思考过程,然后我针对思考过程进行进行进行评估,然后把思考过程每一个步骤拿出来,反复的跟大模型交互,最后给你生成一个答案。那我们希望反复的交互过程之后生成的答案质量更高,这叫做推理大模型,这第二个大阶段。

10.4 Agent方向开启

【刘嘉】然后二五年,二四年二五年的时候,我们就开始了另外一个方向,就是叫 agent。所以我不仅跟你聊天,我还要操作这个世界。我我先操作的是数字世界,那么未来我可能在具身智能上操作物理世界。

10.5 系统调用与MCP

【刘嘉】那我要我要干活,我要去做这个具体的事儿,那咋办呢?那就是我要调用系统。那我们开始用各种各样的方式来调用系统,就不同公司会有不同方式。最后收敛成 MCP 的方式,我们用统一标准的方式来完成对于这个所谓系统的调用。

10.6 防出错与Harness工程化

【刘嘉】那么既然有系统调用,这中间就叫防出错,防出错中我就大量的去去去做这件事儿,要有约束条件啊,要有工程化的逻辑,我们就开始有 harness 这样的所谓的东西,就是我怎么用工程化的手段能够让它的那个行动过程能够稳定,能够持久,能够长链条,能够得到一个我想要的工作。然后可能未来大模型又会能力提升,那么你这些工作都都都都不重要了,因为大模型就能。完整的把你这个长链条做完,本身模型本身就可以做完。那么人类就会提出更复杂的要求,又变成长链条了。相对这个模型本身又变成比较复杂的。那么模型能力和工程能力是一个犬牙交错的往上走。

10.7 阶段稳定与应用崛起

【刘嘉】所以我个人认为,每个人都追不上这个时代的,这个能力都是非常随机的过程。然后每每一年或者每一个月或者每一个季度都有可能产生新的东西,新的工程化的方法,或者是原来工程化方法方法马上就失效了,因为模型本身能力在提升,会失效。那模型能力到底能不能提升,我们也并不完全确定。所以在这个混乱的时间,我觉得就就不要追求这件事。

【野说商业】但是这个混乱的时间就一定会有一个犬牙交错的过程,可能达到一定程度就稳定了,我们叫所谓最佳实践,就是模型能力稳定了,然后约束模型的那个所谓的工程能力,hardness,这种工程方式的框架也稳定了。

【刘嘉】那么这这就稳定下来之后,我们可以全面的应用了。所谓那些应用公司的崛起,大的类似像阿里啊、腾讯啊,他们在互联网时候、移动互联网时候的崛起,那么在AI时代的崛起,就等我个人觉得是在等那个模型的能力稳定了,然后那个工程能力也稳定了,那么我们一批这样公司就会崛崛崛起出来,我们就能看到这些公司创造出来的价值。因为这些东西稳定了之后,我们的token的这个价格随着时间就会下降,然后成本就会就会降低,那么覆盖度就会提升,大家使用会就会更多。那么这时候我们就会看到这样的过程。

10.8 未来展望:具身智能与总结

【野说商业】所以我现在认为这大概是AI的第三个阶段,这个阶段可能还需要稳定。那未来的AI可能就要需要跟物理世界相交互,就是我的对虚拟世界的理解,我要落到物理世界,我要去拿这杯水,我要去操纵某个机器,我要去做做某些事儿,那么这是具身智能的事情。具身智能现在最大的问题其实还没有数据,大家很多人在在在在在一边做着家务一边戴个摄像头来来记录我做家务的数据,啊,现在还在等等数据的过程,这可能还有一段时间。除了它机械的问题,还有一些这个智能和感知的问题。具身智能可能还有五到十年,然后AI的稳定性我不知道还有还有多还有多久,所以大体上是这样的情况。

11、核心启示与收尾

【野说商业】那你肯定看前两天梁文锋的那个文章啊,那你就,他其其实特别坚定说AGI一定会到来。

【刘嘉】对,那他,我也很坚定啊,我说不知道什么时候到来啊,我不知道我不知道有生之年能不能看得到而已。

【野说商业】他说就是说只要给我团队稳定,我就是一定能实现。你怎么看待他那篇文章通篇表达的东西?

【刘嘉】哦,他那篇文章讲了非常多非常基础的道理。呃大家觉得有些文人觉得非常好,原因只是因为他讲的道理我们有些时候做不到,但他确实是个非常基础的道理。人员稳定是非常重要的一件事,能够带来更宽松的环境。他一半时间工作,一半时间是创造,那么有有助于你的创造力。但是真的能稳定团队吗?我我并不看好。我认为一家非常优秀的初创公司最大的问题就是如果这个公司发展过快,那么这个公司里面的很多人一定会获得外在的召唤,他们获得更好的待遇或更好的成就自我的机会,那么他就一定会分开。OpenAI已经证明了这一点。当一个好的公司获得了一个长足的进步,那面对的就是就是人才的流失,就是优秀人才的独独立出来门户或者被别人挖走,这是很正常的事。所以他想稳定人,这是他的目标,但他很难做到。最大的我个人觉得对所有人的启示或者有有价值的东西是克制,就是我们千万不要觉得我们什么都能做,我们一定要把专注力放在一个小的领域,特别当AI能力变强之后,我们更要把我们的能力放在一个非常小的领域,把那个稀缺价值给给做大。我经常看我们的学生或者是我我的那些朋友们创业啊或者怎么样,一旦我看到他东西做得特别全,功能特别多,我一般都是非常不看好的,原因是因为他不知道自己稀缺在什么地方,哪一个能力是他最最厉害的,最能打动别人的,就是因为你不知道你哪一个能力能打动别人,所以你希望你的东西做得越广,功能越多,你希望也许有些功能能打动某些人,这样我就用户就多了,呃这反而是对自自我的不信任不自信。我认为我觉得一个明确的或者对自我信任的。或者一个正常的逻辑,就是应该把一点打透。包括OPC,OPC千万不要觉得我用AI工具我就什么都能做,千万不要,你一定要只做一件非常具体的东西,然后只为那个东西交付结果。那么我觉得你的成功概率会、会变得更大。这个东西是不是真的都不一定啊。但是我认为克制这件事本身来说,是我觉得大家都可以有启发的。我自己也会觉得,就是有些事是不是想太多,然后没有把一件件事做完。我们自己在在自我反省吗?

【野说商业】当然当然。

【刘嘉】我们在我们在做AI时代的教、教育改革的时候,你也会一样。我们现在最大的问题,就像我这样的老、很多老师们,有热情,希望在AI时代能够赶上这个时代,能够培养出符合这个时代的学生。但是我们面对问题,我们想想得太多,我们想做的东西太多,我们越想让他基础也扎实,越想他的工具链也熟悉,又希望他能面对未来的那种品味、审美和表达也能做得非常好。这时候我们一门课容纳的东西太多了。任何一门课或者一个训练也好,它得有、得有一个小的目标,或者更直接的目标。我越来越希望老师们不要想太多,我们只干一件事儿,一门课只解决一个问题,不一定要,去用一门课来应对整个事情。如果你一门课解决太多的问题,那说明你对核心问题的解决没有那么大的自信,认为你的课程没有办法解决核心问题。所以我觉得克制、收敛,然后做一些绝对价值的东西,然后减少所谓不重要功能,不要让自己看上去那么花、花枝招展的,或者是完美的这个这个过程,可能是对每个创业者或者每个我们讲这种每个工作,我自己自自己觉得是最需要做的事儿。哎,所以我对于克制这个词,我还是很有很有很、正好有感触,对,非常好的感触。

【野说商业】所以最后的话,如果你要有一句话的总结或者分享给大家,你会怎么去阐述?

【刘嘉】我对年轻人可能就一句话吧,就对我的学生啊。,就类似我学生这样年轻人就一句话,就是AI能够做出让你像专家的东西,但它不能让你自动成为专家。

【野说商业】这就是这一期的节目所有内容。那如果你对我们的话题感兴趣的话,欢迎点赞、收藏、转发、评论。大家再见,拜拜。

via ht3.space