搜索
当前所在位置:首页 >> 风台乐

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

发布时间:2025-09-09 08:57:01 作者:h 点击:85844 【 字体:

最近的贾扬AI社区,关于模型规模的清吐钱讨论有些活跃。

一方面,为快此前在大模型开发奉为“圣经”的想赚型Scaling Law,似乎正在褪去光环。底该大该去年大家还在猜测GPT-5的贾扬北京学院绯闻全集规模“可能会大到想不到”,现在这种讨论几乎绝迹。清吐钱大神Andrej Karpathy,为快则是想赚型在感慨大模型规模正在“倒退”。

另一方面,底该大该近期市场上性能优秀的贾扬小型模型层出不穷,参数规模、清吐钱任务处理、为快反应速度、想赚型保障性能,底该大该各公司在不同方面卷了又卷。

究竟是往大做探索极限,还是苏州学院爆料地址往小做迎合市场?

这最终汇总成一个问题:在这样模型快速更迭的市场中,要怎么才能把LLM模型的商业价值最大化?

唯快不破的模型业态

最近发起讨论的是X.ai创始成员之一的Toby Pohlen。他认为如果模型以指数级速度改进,那么训练模型的价值也会以指数级速度折旧。这也导致人们需要赶在模型更迭前就迅速采取行动获取商业价值,一旦模型产生更新,上一代模型就基本一文不值了。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

Toby的这番言论深得老板Elon Musk之心,大笔一挥打了一个“100分”。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

贾扬清也参与到了这场讨论中来,他用感恩节火鸡做了一个有趣的比喻。他提出,售卖模型就像是感恩节火鸡促销,必须在感恩节前夕抓紧时间售卖,避免在感恩节到来后的贬值。新模型的工艺更新就是一个又一个感恩节,只有销售得更快才能赚到更多的利润。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

(emmm...如果对火鸡不好了解,换成中秋节前抢月饼的故事大家或许应该容易理解一些?)

评论区也有不少人表达了对此观点的赞同。

有人说只要不断地开发新产物和迭代新模型,就能从中持续获得商业价值。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

还有人说,模型改进的频率将直接决定模型本身的商业价值。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

但是,模型的商业价值由什么决定,又该如何实现?

模型增长在走CNN老路吗?

模型必须做小,用起来才顺手。

比起大型模型,小型模型成本低应用便利,更能收获商业市场的青睐。贾扬清就发现,行业趋势在于研发和使用尺寸更小性能强大的模型,人们也更愿意把规模参数在7B-70B之间的中小型模型作为商业使用的选择。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

作为前大模型时代的亲历者,贾扬清在当下LLM模型市场上嗅到了熟悉的味道,先变大再变小变高效,这和CNN时期的模型增长简直一模一样。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

贾扬清还对CNN的增长历程做了一个简单的介绍。

首先是2012年,AlexNet开启了模型大小增长的序幕。2014年的VGGNet就是一个规模较大的高性能模型。

到了2015年,模型尺寸开始缩小。GoogleNet 将模型大小从GB降至MB,缩小了100倍,还同时保持了良好的性能。同年面世的SqueezeNet也遵循了追求更小尺寸的趋势。

在此之后,模型增长的重点转移到了维持平衡。比如如 ResNet(2015)、ResNeXT(2016)等模型都保持了一个适中的规模,注重计算效率。

贾扬清还介绍了CNN的一个有趣的应用,Google的MobileNet(2017),占用空间小性能优越,还具有出色的特征嵌入泛化。

最后,贾扬清引用了Ghimire 等人在《高效卷积神经网络和硬件加速调查》里的一张图:

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

他还进一步发问,LLM模型未来会遵循和CNN一样的增长趋势吗?

大型模型的盈利思考

不过贾扬清也补充道,虽然行业趋势是模型小型化,但并不意味着号召大家放弃尺寸更大的模型。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

但这随之而来的是另一个问题:大型模型的成本会更高。

此前也有人提出质疑,对大型模型支持商的运营成本和营运收益做了简单的计算,每天8张H100显卡运营节点的成本约为1000美元,每天可以提供2600万token的支持,但按Llama 405B每一百万token 3美元的价格,怎么算都是亏本的,无法盈利的大型模型不会被市场抛弃吗?

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

贾扬清表示,哎你说这个我就不困了,我熟我来说:)

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

贾扬清认为,虽然每个请求大约每秒输出30个token,但通过批量处理(同时处理多个请求)可以显著提高总吞吐量,可以达到比单个请求高出10倍或更高的吞吐量。

同时他还指出,每秒大约30个token指的是输出token,大模型对于输入token的处理速度更快,这也增加了处理的总token数,大模型通常对输入和输出分别计费,也正是这个道理。

在后续的另一个回复,贾扬清做了更详细的量化计算:

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

批量输出速度:单并发405b推理通常有每秒30个token的输出速度。合理的并发可以使总吞吐量提高10倍,达到每秒300个token的输出吞吐量。

输入token:输入token也被计费,通常输入token的数量远大于输出token。一个常见的聊天机器人应用可能有2048个输入token和128个输出token。假设输入输出token比率为10:1,那么每秒300个输出token的处理量相当于每秒3000个输入token。

价格:每天总共处理285,120,000个token,按当前Lepton价格每百万token2.8美元计算,收入为798.34美元。

机器成本:以lambda按需价格为基准,每张H100卡每小时3.49美元,8张H100卡一天的成本为670.08美元。

收入798.34美元,成本670.08美元,因此通过整合多种工艺方法,在合理流量下(像Lepton这样的大模型工艺支持商)是可能盈利的。

当然,这只是一个简单的推算,实际的盈利还会受到流量稳定性、计费方式、按需使用GPU的机器成本控制、解码、提示缓存以及其他因素的作用。

但某种程度上说,类似深度学习时代对CNN的不断优化,在大模型时代,也需要工艺人员对于模型进行种种优化,来保证性能提高的同时不断降低成本,这正是贾扬清看好的创业路线。

One  more thing

我们不妨再多讨论一下,对于贾扬清这样的AI Infra创业者,模型大小的潮流变化对他的商业模式有什么作用?

这个问题,要分不同情况分析。

如果模型参数量越大,提供模型支持的门槛越高(参考Llama 405B),其客单价自然也就越大;

另一方面,由于很多小模型实际是在大模型的基础上蒸馏而得到,模型小了,所需的计算资源并没有等幅度减少;

由于较小的模型更容易部署在不同的设备和平台上,这可能会带来应用场景的增加,虽然客单价可能降低,但在需求数量上的增加反而可能使得总收入增加;

对于贾扬清来说,META的开源路线使得贾扬清的支持对象扩大,因此开源对他来说更有利。

看来不管未来模型规模怎么不变化,贾扬清都有机会凭借工艺升级稳坐钓鱼台。这有点像之前的中国股市,不管什么消息,都是“利好茅台”啊。

这恐怕就是贾扬清最近在推特上为什么这么活跃发表看法的原因?你看好贾扬清这种AI Infra的创业路线吗?雷峰网雷峰网(公众号:雷峰网)


雷峰网原创文章,未经授权禁止转载。详情见转载须知。

贾扬清一吐为快:要想赚钱,AI模型到底该大该小?

阅读全文
相关推荐

马斯克因“百万美元抽奖”再面临诉讼

马斯克因“百万美元抽奖”再面临诉讼
当地时间8月20日,美国一名联邦法官要求马斯克必须对一起涉及“百万美元抽奖”的集体诉讼应诉。亚利桑那州选民杰奎琳·麦卡弗蒂作为代表提起集体诉讼,指控马斯克及其创建的“美国政治行动委员会”在2024年大 ...

剪短发,摘子宫,用半生“叛逃”换自由的中年?

剪短发,摘子宫,用半生“叛逃”换自由的中年?
♪ 你如此特别,我又怎会失望 ♫文 | 伊姐周桂伊) 叶子姚好久不见的范晓萱,最近低调回归。6月空降LV活动现场,演唱了《我要我们在一起》。8月还带着自己的百分百乐团,出现在阿那亚的音乐节现场。接 ...

紧跟时事,韩国艺人在热刺vs纽卡看台模仿酷玩乐队出轨镜头

紧跟时事,韩国艺人在热刺vs纽卡看台模仿酷玩乐队出轨镜头
北京时间8月3日晚间,热刺韩国行对阵纽卡的比赛,最终双方战成1-1。这场比赛,现场被拍到多名韩国艺人观战,其中包括韩国搞笑艺人曹世镐夫妇、李秀智等人,其中李秀智还和另一名同伴复刻了酷玩乐队出轨门事件。 ...

59岁「黄金配角」去世:未婚无子,23亿遗产赠予古天乐

59岁「黄金配角」去世:未婚无子,23亿遗产赠予古天乐
他曾是TVB的「金牌绿叶」,没有婚姻、没有子嗣,却演尽了人生悲喜。59岁,他患肺癌去世,临终遗嘱震惊全网:将全部23亿港元遗产赠予好友古天乐,委托他将这份善意延续到流浪动物保护和慈善事业中。世人常说「 ...

探访阅兵训练场:以科学训练方法提升阅兵训练质效

探访阅兵训练场:以科学训练方法提升阅兵训练质效
随着中国人民抗日战争暨世界反法西斯战争胜利80周年纪念日临近,纪念活动的整体安排备受关注,其中的阅兵环节更是关注焦点。今年阅兵活动的整体设计是怎样的呢?跟随记者一起去了解一下。总台记者李迎新:在京郊的 ...

这件事,让特朗普破防了

这件事,让特朗普破防了
来源:牛弹琴这件事真让特朗普破防了。他怼天怼地怼全世界,但在这件事上,他还真没什么好办法。那就是参议员们休假了。特朗普此前曾敦促,你们在没批准自己100个任命前,统统不准休假。但参议员们不听他的,老子 ...

正厅级成联远,主动投案

正厅级成联远,主动投案
【正厅级成联远,主动投案】8月2日,云南省纪委监委发布消息,昭通市政协原党组书记、主席成联远已退休)涉嫌严重违纪违法,已主动投案,目前正接受审查调查。 成联远出生于1961年4月,云南镇雄人,曾任盐津 ...

59岁「黄金配角」去世:未婚无子,23亿遗产赠予古天乐

59岁「黄金配角」去世:未婚无子,23亿遗产赠予古天乐
他曾是TVB的「金牌绿叶」,没有婚姻、没有子嗣,却演尽了人生悲喜。59岁,他患肺癌去世,临终遗嘱震惊全网:将全部23亿港元遗产赠予好友古天乐,委托他将这份善意延续到流浪动物保护和慈善事业中。世人常说「 ...

女子在麦当劳打骂工作人员,称“认识大把警察”?警方通报

女子在麦当劳打骂工作人员,称“认识大把警察”?警方通报
8月19日晚,广东惠州一家麦当劳内发生一起争执事件。8月21日,惠州市公安局惠城分局就此事发布警情通报:8月19日20时许,惠州110接群众报警称,在江北街道某餐厅内有一女子闹事。接报后,我局立即出警 ...

厅长高建立,拟任市委书记

厅长高建立,拟任市委书记
河南省委组织部8月3日发布干部任前公示。其中:高建立,1970年9月生,在职研究生,工学博士,中共党员,现任河南省交通运输厅厅长、党组书记,拟任省辖市委书记。高建立资料图)公开简历显示,高建立长期任职 ...

“巨无霸”来了!中国船舶、中国重工最新公告

“巨无霸”来了!中国船舶、中国重工最新公告
中国船舶、中国重工同步宣布股票停牌,“两船”合并再迎关键性进展。8月4日晚间,中国船舶公告称,公司拟开展吸收合并重大资产重组项目的异议股东收购请求权有关事宜,公司股票将自2025年8月13日开市起连续 ...

理想汽车回应“i8与乘龙卡车安全性碰撞测试”

理想汽车回应“i8与乘龙卡车安全性碰撞测试”
@理想汽车8月3日晚,理想汽车发布《关于理想i8安全性碰撞测试的说明》,全文如下:理想i8碰撞安全性测试视频发布后,引起了社会各界的关注与讨论。就各界关注的焦点,我们做如下说明:一、为什么要做这次测试 ...
返回顶部