商汤日日新SenseNova 5.0发布,全面对标GPT-4 Turbo

2024-04-24 23:23:3807:43 20
所属专辑:星船知造
声音简介

4月,上海。商汤科技技术交流日活动上发布了行业首个“云、端、边”全栈大模型产品矩阵,同时全新升级“日日新SenseNova 5.0”大模型体系,其综合能力全面对标GPT-4 Turbo,加速生成式AI向产业落地的全面跃迁。

商汤科技董事长兼CEO徐立表示:“商汤在尺度定律的指导下,会持续探索大模型能力的KRE三层架构,不断突破大模型能力边界。”

01,文理双修能力大幅提升

自去年4月首次发布,商汤“日日新SenseNova”大模型体系已正式推出五个大版本迭代。新的“日日新SenseNova 5.0”采用混合专家架构,推理时上下文窗口可以有效到 200K 左右。

本次更新主要聚集增强了知识、数学、推理及代码能力,全面对标 GPT-4 Turbo,主流客观评测上达到或超越 GPT-4 Turbo。

在文科能力方面,“日日新5.0”的创意写作能力、推理能力以及总结能力均大幅提升,相同的中文知识注入后,可以获得更好的理解总结及问答,为教育、内容产业等垂直应用场景提供有力辅助。

理科能力方面,“日日新5.0”数理能力、代码能力及推理能力达到业内领先水平,为金融、数据分析等场景落地提供坚实基础。

本次“日日新5.0”另一大核心指标就是多模态能力,商汤多模态大模型的图文感知能力达到全球领先水平,在多模态大模型权威综合基准测试MMBench中综合得分排名首位,在多个知名多模态榜单MathVista,AI2D,ChartQA,TextVQA,DocVQA,MMMU 取得领先成绩。

02,率先完成“云端边”全栈布局

今年是端侧大模型应用的元年,为了满足移动终端用户对大模型技术的应用需求,商汤推出日日新·端侧大模型,性能实现同等尺度性能最优,跨级尺度全面领先。

商汤还推出端云协同解决方案,可以通过智能化判断协同发挥端云各自优势,需要联网搜索或处理复杂场景时分流至云端处理,部分场景端侧处理占比超过80%,从而显著降低推理成本。

商汤日日新·端侧大语言模型的推理速度达到了业内最快,可在中端平台实现18.3字/s的平均生成速度,旗舰平台更是达到了78.3字/s。

扩散模型同样可在端侧实现业内最快的推理速度,端侧LDM-AI扩图技术在某主流平台上,推理速度小于1.5秒,比友商云端app快10倍,支持输出1200万像素及以上的高清图片,支持在端上快速进行等比扩图、自由扩图、旋转扩图等图像编辑功能。

从今日起,商汤端侧业务SDK正式发布,也欢迎集成体验。

对于金融、代码、医疗、政务等重点行业边缘侧日益增长的AI应用需求,商汤正式推出企业级大模型一体机,可同时支持企业级千亿模型加速和知识检索硬件加速,实现本地化部署,即买即用,降低企业应用大模型的门槛。相比行业同类产品,推理成本节约80%,检索大大加速,CPU工作负载50%。

03,联合生态伙伴创新AI 2.0时代产品应用,打造新质生产力

本次活动现场,商汤还邀请到金山办公、海通证券、小米、阅文集团、华为等多位生态伙伴嘉宾,共同探讨和交流大模型技术在办公、金融、出行等不同领域的应用及前景。

自2023年起,商汤与金山办公达成深度合作,基于“日日新”大模型的卓越代码生成及工具调用能力,助力WPS 365打造更高效释放场景能力的办公新质生产力平台,为企业构建专属的“企业大脑”。金山办公CEO章庆元表示:“在办公应用场景内,商汤大模型的表现十分出色,能够帮助我们的用户解决办公中的复杂问题,提升效率。”

在金融领域,海通证券与商汤科技联合发布金融行业多模态全栈式大模型,双方在智能客服、合规风控、代码辅助、展业办公助手等领域助推业务落地,并共研智能投顾、舆情监控等行业前沿场景,打通证券行业大模型落地的全栈式能力。海通证券副总经理兼首席信息官 毛宇星谈到:“通过与商汤合作,我们利用大模型技术实现了海通证券数智化转型,未来,我们将结合全栈式AI能力进行业务流程、交互变革与数智化业务系统重构。”

在个人出行场景,近期火爆市场的小米汽车SU7,小米小爱同学为车主提供智能化交互体验,当中也有集合应用了商汤的大模型技术能力,有基于商汤端云大模型解决方案;小米集团小爱总经理王刚在与商汤科技联合创始人、首席科学家王晓刚对话时表示:“商汤的云边端全栈组合,可以很好的赋能和适配小米物联网生态。我们希望与商汤共同为我们的用户打造更具智能化的产品体验。”

此外,今天商汤还发布了基于昇腾原生的行业大模型,共同打造面向金融、医疗、政务、代码等大模型产业生态。

在自身应用方面,商汤“日日新SenseNova 5.0”在秒画、如影、格物、琼宇、大医、小浣熊家族等产品均有重要更新。

04,“文生视频”已在路上

在本次技术交流日最后环节,商汤科技董事长兼CEO徐立还带来了三段完全由大模型生成的视频,并强调文生视频平台对于人物、动作和场景的可控性。

商汤科技在文生视频平台方面也取得了技术突破,未来,通过输入一段文字或一个完整的描述,就可以生成一段视频,而且人物的服饰、发型、场景都可以根据预先设定,保持视频内容的连贯性和一致性。

通过商汤打造的智能算力中心,可以不断赋能于大模型的训练,目前,日日新大模型体系在自然语言处理、视频生成和深度学习优化等多个方面取得创新。

一方面,现阶段大模型发展已进入落地阶段,如何与产业、应用场景结合是关键一环;另一方面,“尺度定律”路径逐渐清晰,“涌现”时刻不定出现,前瞻探索最先进的大模型技术也是重中之重。

秉承创立之初“坚持原创,让AI引领人类进步”的目标和愿景,商汤科技的大模型技术和产品已在医疗、教育、法律、工业等各行各业进行实践应用。如大模型以“日日新”为名,商汤一直坚定朝向通用人工智能的目标前行,突破数据与算力的限制,引领大模型的创新与落地。

用户评论

表情0/300
喵,没有找到相关结果~
暂时没有评论,下载喜马拉雅与主播互动
猜你喜欢
日日新

每天分享一篇短文,遇见更好的自己!

by:Hello小乐儿

天天吐槽日日更新

天天更新,天天开心,尽量不断更

by:安东西北

日日练

没啥卖点,每天练一练,认真练一练。

by:一只阿登

日日好物

日谈公园出品的短节目“日日好物”,由主持人乐乐邀请日谈主播和嘉宾,以“好物推荐官”的身份,聊聊那些让everyday成为goodday的好东西,不在乎省钱,不...

by:日谈公园

日日朗读|365天每日更新

每日朗读,文体不限,只为提高自己的朗读技巧,希望大家给予宝贵意见。

by:芝麻会开门

日日精进

一个不能日日精进的人就是在背叛自己的梦想,一个不断自我超越的人就是在呵护自己的梦想

by:伊悠集团刘思源

日日精进

孩子的心理营养加油站

by:爱娃先要懂娃