李彦宏内部讲话曝光:未来大模型之间的差距可能越来越大
我爱霍启刚掖
发表于 2024-9-11 17:34:16
145
0
0
榜单不代表大模型实力
对于行业“大模型之间的能力已经没有壁垒”的说法,李彦宏坦言,“每次新模型发布,都要和GPT-4o做比较,说我的得分已经跟它差不多了,甚至某些单项上得分已经超过它了,但这并不表明和最先进的模型就没有差距。”
他解释说,很多模型为了证明自己,会在发布之后去打榜,会去猜测试题目、答题技巧。从榜单看,或许模型的能力已经很接近了,但到实际应用中,还是有明显的差距。
李彦宏认为,模型之间的差距是多维度的。行业往往更关注理解、生成、逻辑、记忆等能力差距,但却忽视了成本、推理速度等维度。有些模型虽能达到同样效果,但成本高、推理速度慢。
李彦宏在内部讲话中表示,真正要衡量大模型的能力,应该是在具体的应用场景中,看是否能满足用户需求、产生价值增益,这才是最值得被在乎的。
应客观看待开源模型的效率问题
李彦宏进一步阐释了外界对于开源大模型的认知误区。“在大模型时代之前,大家习惯了开源意味着免费、意味着成本低。”他解释说,比如开源的Linux,因为已经有了电脑,所以使用Linux是免费的。但这些在大模型时代不成立,大模型推理是很贵的,开源模型也不会送算力,还得自己买设备,无法实现算力的高效利用。
“效率上开源模型是不行的,”他表示,“ 闭源模型准确讲应该叫商业模型,是无数用户分摊研发成本、分摊推理用的机器资源和GPU。GPU的使用效率是最高的,百度文心大模型3.5、4.0的GPU使用率都达到了90%多。”
李彦宏认为,在教学科研等领域,开源模型是有价值的;但在商业领域,当用户追求的是效率、效果和最低成本时,开源模型就没有了优势。
智能体还不是行业共识
李彦宏还谈及了大模型应用的发展阶段,他认为,首先出现的是Copilot,对人进行辅助;接下来是Agent智能体,有一定的自主性,能自主使用工具、反思、自我进化;这种自动化程度再发展,就会变成AI Worker,能独立完成各方面的工作。
当前,智能体已经受到越来越多的大模型公司及客户关注,李彦宏认为,虽然有很多人看好智能体这个发展方向,但是到今天为止,智能体还不是共识。像百度这样把智能体作为大模型最重要的战略、最重要的发展方向的公司并不多。
为什么要强调智能体?李彦宏也给出了答案。智能体的门槛确实很低,很多人不知道怎么把大模型变成应用,而智能体是一个非常直接、高效、简单的方式,在模型之上构建智能体相当方便。目前,每周都有上万个新的智能体在百度文心智能体平台上被创造出来,智能体的日均分发次数已快速增长至800万次。
CandyLake.com 系信息发布平台,仅提供信息存储空间服务。
声明:该文观点仅代表作者本人,本文不代表CandyLake.com立场,且不构成建议,请谨慎对待。
声明:该文观点仅代表作者本人,本文不代表CandyLake.com立场,且不构成建议,请谨慎对待。
-
生成式人工知能(AI)が巻き起こす技術の波の中で、電力会社は意外にも資本市場の寵児になった。 今年のスタンダード500割株の上昇幅ランキングでは、Vistraなどの従来の電力会社が注目を集め、株価が2倍になってリ ...
- xifangczy
- 3 天前
- 支持
- 反对
- 回复
- 收藏
-
隔夜株式市場 世界の主要指数は金曜日に多くが下落し、最新のインフレデータが減速の兆しを示したおかげで、米株3大指数は大幅に回復し、いずれも1%超上昇した。 金曜日に発表されたデータによると、米国の11月のPC ...
- SNT
- 前天 12:48
- 支持
- 反对
- 回复
- 收藏
-
長年にわたって、昔の消金大手の捷信消金の再編がようやく地に着いた。 天津銀行の発表によると、同行は京東傘下の2社、対外貿易信託などと捷信消金再編に参加する。再編が完了すると、京東の持ち株比率は65%に達し ...
- SNT
- 前天 12:09
- 支持
- 反对
- 回复
- 收藏
-
【ビットコインが飛び込む!32万人超の爆倉】データによると、過去24時間で世界には32万7000人以上の爆倉があり、爆倉の総額は10億ドルを超えた。
- 断翅小蝶腥
- 3 天前
- 支持
- 反对
- 回复
- 收藏