近日, 人工智能大模型领域里的初创企业Anthropic, 发布了Claude 3系列的AI模型, 依据基准测试得出的结果, Claude 3于各项指标范畴内, 全方位地超越了GPT-4, 圈子里有不少相关人士给出评价, 称Claude 3再度刷新了会话式人工智能所达到的新高度。
在大模型所处的那个风起云涌的世界里, Anthropic身为OpenAI的强劲对手, 其创始团队成员乃是从OpenAI出走的技术人员, 而这家大模型初创公司背后, 站着谷歌以及亚马逊这两大科技巨头, 受微软支持的OpenAI在商业化探究方面当前遥遥领先, 不过在守护技术先进性层面压力不小。
地表最强AI大模型易主
Claude 3 AI系列模型存在着三个, 按照能力从弱到强去排列的话, 依次是Claude 3 Haiku、Claude 3 Sonnet以及Claude 3 Opus。其中, 性能最为强大的Opus, 在基准测试的多个核心指标方面, 都全方位超越了GPT-4以及谷歌的Gemini 1.0 Ultra, 从而荣登当下的AI大模型榜单榜首。
依照Anthropic的阐释, Opus具备人类本科生层次的知识, 于复杂任务里展现出近乎人类级别的理解力以及流利性。与此同时, 所有Claude 3模型在分析预测、内容制作、代码生成以及西班牙语、日语和法语等非英语语言的对话层面皆呈现出更为强大的能力。
综合来看,Claude 3具有以下几个亮点:
首先, 存在一种情况是, “记忆力”极为出众, 它对超长文本予以支持。Claude 3系列模型在发布之际, 最初会给出200K上下文窗口, 并且具备准确回忆大量数据里信息的能力。200K上下文对话长度, 等同于15万英文单词, 然而在此之前OpenAI所发布的GPT - 4 Turbo, 其可支持的上下文窗口是128K。业内人士进行分析, 长文本所具备的优势使得Claude在诸如读论文、写小说等涉及更多字数的任务当中, 能够更加擅长去理解以及回答用户提出的问题。
首先是二的方面, 多模态的那种能力很强, 其中视觉能力极为突出。按照所介绍的情况来看, Claude 3具备那种跟其他处于领先位置的模型相比较毫不逊色的复杂视觉能力, 还能够去处理各种各样的视觉格式, 像照片, 图表, 图形, 还有技术图解之类的。依据网友所进行的测评, Claude 3是允许用户上传图像以及其他文档的, 并且能够“认”出以及描述图里面的内容, 进而回答用户提出的问题。
三是要将安全性与易用性兼顾起来。Claude 模型一直以来都被视作“最安全”的模型, 它致力于把虚假信息、隐私泄露等方面存在的风险给降低。然而, 此前的Claude 2.1以及Claude 2.0曾经因为太过“为道德坚守”和“严格守法”, 从而受到了用户的质疑与吐槽。好多人都抱怨说, Claude就如同一个特别难以实现沟通顺畅的“老顽固”, 不管是请求它来帮忙起草文件, 还是完成翻译任务, Claude总是能够寻觅到各种各样的理由去拒绝执行。
对一些用户而言, Anthropic因追求安全致使模型性能被牺牲, 由此造成诸多不便, 进而使得使用体验变差, 不少人宣称会取消Claude 2.1或者Claude 2.0的订阅, 转而选用GPT或者其他竞品。
全新的Claude 3依旧极为看重安全性, 然而在易用好用方面做了优化, 拒绝回答无害问题的频次低很多。按照Anthropic的说法, 跟前几代模型相较, Opus、Sonnet以及Haiku拒绝回答的可能性小很多, 展现出对用户请求更细致入微的理解, 能够辨别出真正的危害。
国海证券发布研报称, “我们觉得 Claude 3 针对幻觉问题的应对办法, 或许已然成为或者说可能会成为行业所共同认可的一种方式, 也就是怎样去权衡模型表现出过度保守的这种情况”, 这里所说的过度保守是指“拒绝回答某些特定的问题”, 与此同时“要做到能恰当、正确地应答相关问题, 而不是不懂却假装知晓的这种倾向表现”。
在Anthropic推出Claude 3这个事物之后, 好多处于科技圈范围之内的人士都在朝着OpenAI进行喊话, 在网络上进行“催更”这种行为, 表达出内心对于GPT - 4.5或者GPT - 5出现于世的一种期待之情。然而, 在去年6月这个时间段, OpenAI的CEO山姆·奥特曼就曾在公开的场合表明这样的话语, “我们有可能会试着依照顺序去推出GPT - 5模型, 但是不会在短时间之内达成”。当下, OpenAI更加被外界予以关注的产品是其在2月推出的文生视频这项模型Sora。
当下的时候, Claude 3成功地登上了AI大模型榜单的首位之处, 然而呢, 在那飞速向前发展进化的大模型技术浪潮当中, 地表最为厉害高级的AI大模型的荣誉头衔在将来恐怕也是会频繁地更换主人的。
硅谷大模型之争的两大阵营
Anthropic是什么来头?
实际上, 这是一家年轻的公司, 其成立时间仅有大约3年, 它的两位创始人, 分别是Dario Amodei和Daniela Amodei, 他们都是OpenAI的前员工, 在离职前, Dario Amodei担任OpenAI研究部门的副总裁, Daniela Amodei担任安全与策略部门的副总监, 据外媒报道, Dario Amodei离职去创业的时候, 还挖走了十几名OpenAI的员工, 其中包含GPT-3首席工程师Tom Brown。
值得留意的是, Dario Amodei以及Daniela Amodei选从自身出发去搞大模型, 是鉴于对OpenAI在技术尚不安全时就迅速搞商业化怀有不满, 其期望是打造出靠谱的、可阐释的、可操控的AI系统, 首要想法就是AI安全。这样也就能够明白, 为何Claude系列模型对安全性这般看重。
和OpenAI主要依靠微软给予资金支持不一样, Anthropic背后有着谷歌、亚马逊、Salesforce、高通、韩国电信等诸多投资方。亚马逊在进行投资之际, 也变成了Anthropic主要的云计算提供商。Anthropic还成了全球最能“吸金”的大模型创业公司当中的一个, 仅仅在2023年, Anthropic就完成了5轮融资, 得到了总计73亿美元的融资。
OpenAI因背靠金主微软, 和其他硅谷科技巨头以及这些巨头所支持的大模型初创公司, 形成了明显有所区分的两大阵营。Anthropic无疑是其中最具备能与OpenAI叫板、分庭抗礼实力的一家公司。有一名业内人士作出分析, Anthropic的核心成员恰恰是最初制作出GPT - 2、GPT - 3的人, 该团队的研究能力颇为强大。在OpenAI对外发布GPT此前, Anthropic其实就已然制作出Claude产品, “两个团队的技术能力处于不相上下的状态”。
然而虽说OpenAI与Anthropic在技术抗衡上极为胶着, 可在商业化能力层面, OpenAI却显著领先于Anthropic。依The Information所报道, 截止到去年年末, OpenAI的年化收入已然达到16亿美元, 管理层预估到2024年末年化收入能够达到50亿美元。然而, Anthropic预估到2024年末的年化收入仅仅只有8.5亿美元。
然而, 需要留意的是, OpenAI跟Anthropic在商业化途路上存在较为显著的差别。相较于OpenAI朝着C端用户推出产品而言, Anthropic对于B端客户好像愈发感兴趣。Anthropic联合创始人先前在接受福布斯采访之际表明, Anthropic更近似于一家企业型公司, 而非消费者型公司。
当下, 存在着多家具有较高知名度的企业, 它们依据Anthropic模型开展了产品的开发工作, 举例来说, 那家声名远扬的资产管理公司Bridgewater Associates, 凭借Anthropic模型, 打造出了一款具备自动生成图表功能、能够生成财务数据并且可以总结财务摘要的AI助手。另外, Anthropic的其他面向企业端的客户, 还涵盖了Gitlab、Notion、Salesforce等这样的公司。
标签: AI模型 Claude3 ChatGPT-4 Anthropic 技术竞争
还木有评论哦,快来抢沙发吧~