21世纪经济报道记者孔海丽、实习生张奕丹 北京报道
这场世人瞩目的国际竞赛正趋于白热化。
GPT-4霸占大模型的“王座”已经近一年,距离Mistral拿下“第二名”仅隔一周,新的第一名已经产生。
当地时间3月4日,OpenAI的竞争对手Anthropic,在X上发布了Claude 3最新套系,并且放话:Claude 3在推理、数学、编码、多语言理解和视觉方面建立了新的行业基准。
据Anthropic展示,Claude 3系列在理解能力、数学问题解决能力等方面的得分,几乎全方面碾压GPT-4。
(Claude 3对于诈骗案例的回应 图源:技术报告)
此外,Claude 3的长文本能力依然沿袭了Claude系列的高水准。三个模型都能支持20万token的上下文窗口,在“大海捞针”(分辨集合了不同来源的文档)测试中,Claude 3 Opus表现突出,召回近乎完美。
有实测用户用《红楼梦》电子文档(前二十回)对其进行“插针测试”,Claude 3 Opus用了十几分钟的时间准确找出了用户插入其中的不属于原文的部分,并指出“这些文段和小说并不相关,小说中并没有认真讨论。”
(“大海捞针”的评估 图源:论文)
部分用户已经对Claude 3进行了实测,和GPT-4进行多方比较,二者各有所长。但总体来看,一部分网友还是相当看好Claude 3。尽管目前Claude 3在某些方面还不太稳定,但是基于其进步之迅速、亮点之繁多,“Claude 3值得”已经成为了潜在会员们的心声。
而在Claude 3背后的Anthropic,或许也在感慨,“出走”三年,这回终于得以在OpenAI面前扬眉吐气。
大模型的“枪林弹雨”
无论是Anthropic推出的Claude 3,还是法国AI新贵Mistral AI推出的Mistral Large,都在近期向外界证明了一个道理:OpenAI并不是难以追及的,甚至,Claude 3在多项得分上已经超过了GPT-4。
从技术到应用,大模型的竞争已经越来越垂直,“百模大战”已经不再是“抢占先机”的时期。无论是巨头还是初创公司,谁的大模型应用更强大,谁才能俘获用户的付费。
Anthropic创始团队早期参与了GPT系列的开发。由于在OpenAI的发展方向上产生分歧,担心微软对OpenAI首次10亿美元的投资后,会使其走上更加商业化的道路,偏离其最初对高级AI安全性的关注,负责OpenAI研发的研究副总裁达里奥·阿莫迪 (Dario Amodei)和安全政策副总裁丹妮拉·阿莫迪(Daniela Amodei)决定离职,创立一家与OpenAI有不一样价值观的人工智能公司。
这次的“出走”使得Anthropic在2021年成立。团队有一个很明确的目标,就是构建一套可靠、可解释、可控的“以人类(利益)为中心”的人工智能系统。
(图源:Anthropic官网)
脱胎于OpenAI的Anthropic,在技术上给OpenAI带来的威胁一直存在。2023年2月,Anthropic获得谷歌投资3亿美元,成立2年后即发布了类似ChatGPT的AI对话系统Claude。之后在融资中筹集了大量资金,并于2023年9月获得了亚马逊40亿美元投资。
近日,OpenAI深陷马斯克起诉风波,从当年“造福人类”的初衷,到如今网友对“OpenAI”和“ClosedAI”的调侃,考验着OpenAI掌舵人关于初心与商业化平衡的艺术。
Anthropic和OpenAI的竞争如此,整个大模型的赛道更是如此。有网友评论,大模型的集中爆发,已经不是“让子弹再飞一会儿”了,而是枪林弹雨满天飞,现在就看谁在特定应用场景的纵深度上走得快了。
AI大模型的研发和迭代已成定势,提供更好的应用体验和应用场景,是所有玩家2024年要俯身下去解决的问题。
在Anthropic的评论区,有网友直接喊话OpenAI:“现在你可以发布GPT-5了”。也有传闻称GTP-5已经研发完成,届时Claude 3与GPT-5的对决,亦或是更多大模型在应用实力上的长期对决,值得期待。
更多内容请下载21财经APP
相关文章
猜你喜欢
成员 网址收录40386 企业收录2981 印章生成229714 电子证书1008 电子名片58 自媒体46281