NEXA AI发布全球首个超小型多模态AI代理模型Octopus V3,函数调用准确度媲美GPT-4

2024-05-09 13:37:15     来源:

近日,斯坦福大学的NEXA AI团队宣布推出全球首个多模态AI代理模型Octopus V3,让AI代理更加智能、快速、能耗及成本降低。

今年四月份初,NEXA AI推出了备受瞩目的Octopus V2,该模型在函数调用性能上超越了GPT-4,减少了95%的推理时所需的文本量,为端侧AI应用带来了新的可能性。其专利性核心技术“functional token”通过创新的函数调用方式显著减少推理时所需的文本长度。

这种方法使得模型能够在只有20亿参数的情况下实现高效训练,并在精度和延迟方面超越了GPT-4,适应了各种端设备的部署需求。

发布以来,Octopus V2在LLM社区获得了广泛关注,受到了AI领域大量前沿技术专家及研究者的赞赏,如Hugging Face的CTO Julien Chaumond、知名AI Newsletter Rundown AI的创始人 Rowan Cheung以及Figure AI的创始人Brett Adcock、OPPO边缘人工智能团队负责人Manoj Kumar,称其“开创了端侧AI技术新纪元”。

在知名开源AI平台Hugging Face上,Octopus V2下载量已经超过12000次。

在不到一个月的时间里,NEXA AI团队发布下一代多模态AI代理模型Octopus V3,展现进一步突破:具有图像处理和多语言文本处理能力,为智能手机等端侧设备真正走向AI时代铺平了道路。

AI技术突破:首个参数量小于10亿的多模态AI代理模型

Octopus V3不仅拥有多模态能力,在函数调用性能上远超同类模型,可媲美GPT-4V+GPT4;而且模型参数量不到10亿,具有多语言能力。

也就是说,相比传统的大型语言模型,它体积更小,能耗更低,能够更加轻松地在各种小型端设备上运行,比如树莓派,并做到高速且准确的函数调用。

这意味着,未来AI代理能够广泛应用于智能手机、AR/VR、机器人、智能汽车等端侧设备,为用户交互体验更加流畅、智能。

另一方面,由于V3具有多模态处理能力,可同时处理文本和图像输入,再加上多语言能力,也将让用户体验更加丰富。

例如,在Instacart购物应用中,用户可以通过一张菠萝的图片及简单的对话指令,让AI代理自动为他们搜索商品,提高了效率和用户的体验。

再比如,在发送邮件等场景中,Octopus V3可以根据一张具有文字的图像,自动提取信息并填写邮件内容,为用户提供更加智能、便捷的服务。

Octopus系列模型的发布标志着端侧AI代理技术的重要突破,可能成为人工智能技术的新里程碑。

从软件交互到智能汽车,端侧AI潜力巨大

基于这些特性,Octopus V2及V3的应用场景丰富多样,具有广泛的应用前景。

除上文提到的手机场景,当Octopus V2应用在智能汽车上时,也能带来新的交互体验。目前的语音助手往往难以帮助车主完成较为复杂的任务,如在驾驶途中临时改变目的地、加入额外停靠点等。应用Octopus V3后,AI助手能够基于较为模糊简单的指令快速、精准地完成相应任务。

结合V2、V3的能力,从信息检索、到基于指令完成设计,用户可以在虚拟场景下获得流畅的AI体验:在一个社区用户的VR场景demo中,输入简单的语音指令后,AI代理能够帮助用户快速完成一个客厅设计,在弹指间替换沙发、改变颜色灯光等。在用户输入旅行指令后,用户快速来到了日本,而AI代理同样可以在简单的对话式交流中帮助用户搜索相应景点,提供丰富的信息。

数据显示,全球大型语言模型市场规模正在快速增长。Granview Research报告显示,全球大型语言模型市场规模估计为43.5亿美元,并预计从2024年到2030年的复合年增长率为35.9%。同样,边缘人工智能市场也呈现出蓬勃发展的势头——预计从2023年到2030年,全球边缘人工智能市场的复合年增长率为21.0%,到2030年将达到664.78亿美元。

NEXA AI团队由斯坦福大学的杰出研究人员创立。创始人兼首席科学家Alex Chen(陈伟)正在攻读斯坦福大学的博士学位,拥有丰富的人工智能研究经验,并且曾担任斯坦福华人创业协会(Stanford Chinese Entrepreneurs Organization)的主席。联合创始人兼首席技术官Zack Li(李志远)也毕业于斯坦福大学,并在Google和Amazon Lab126实验室拥有4年端侧AI的一线研发经验,同样曾经担任斯坦福华人创业协会的主席。斯坦福大学副教授、斯坦福技术创业项目副主任Charles (Chuck) Eesley担任顾问,为团队提供指导和支持。

左:李志远;右:陈伟

目前,NEXA AI的独创性技术已申请专利保护。

NEXA AI的创始团队表示,他们将继续致力于推动端侧AI技术的发展,通过开源模型提升其创新技术的影响力,为用户创造更智能、高效的未来生活。

免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。

标签:

猜你喜欢

中关村软件园发布数据合规平台 服务企业数据要素安全跨境流动
清华大学联合中交兴路发布《中国公路货运大数据碳排放报告》
萨摩耶云科技集团:人工智能将深刻改变金融业态
PGYTECH 全新发布MagFlex手机摄影支架——无感随行,灵动畅拍
中兴Axon 60 Ultra亮相中国电信香港发布会,开启手机直连卫星新篇章
共建行业标准,讯飞医疗当选联合组长
抖音电商助力全民阅读,直播间让“冷门”图书热起来
温暖的世界:华为影像XMAGE全球巡展正式开幕
展示焊接、码垛、CNC,大族协作机器人亮相美国AUTOMATE 2024
博威合金旗下贝肯霍夫(中国)携自行车焊材解决方案,亮相上海国际自行车展
“绿色低碳 美丽中国”,Cleer ARC 3音弧零碳耳机邀您关注2024“全国低碳日”
湖南省交通规划勘察设计院与智航飞购达成战略合作,无人机快递引领低空经济新发展
线上展厅!创新珠海科技奖获奖项目系列介绍(一)
线上展厅!创新珠海科技奖获奖项目系列介绍(一)
联发科天玑9300+登场,端侧生成式AI刷新业界最高速
五档功耗水位实时反应负载信息,联发科星速引擎助力开发者随心发挥平台算力
中国小微特机器人创新发展大会成功举办,水陆空机器人现场炫技
“万知”AI特助小程序随手问,读文档,PPT全都有!
品职与湖北碳排放权交易中心达成战略合作,推出碳管理师职业能力评价项目
英特尔《2023-2024年度企业社会责任报告》:积极履行责任,创造美好未来
荷兰皇家斐帝星Project 821下水,开启超级游艇氢动能时代
CIBF:同行者众,无远弗届
科技创新第一步!星光股份收购天芯量子51%股权 进入量子信息安全产业
坚持5G领域自主创新,中国电信为新质生产力持续“上新”
华凌小冰棒空调挂机以质价比引领线上家电消费新潮流
WiFi万能钥匙千万热点资源助力亿万用户“五一”畅游 无忧连网
复旦大学附属妇产科医院以青云QingCloud实现云上有“医”靠
第七届“中国汽车诊断师大赛”首场赛区选拔赛收官
华为云助力山东打造电子政务新标杆:“鲲鹏云平台”引领新质生产力
优海猫(uhaveshop)一站式智慧商业系统