> 自媒体 > AI人工智能 > 商汤版ChatGPT「商量」来了!开放API,基于千亿参数大模型
商汤版ChatGPT「商量」来了!开放API,基于千亿参数大模型
来源:量子位
2023-04-12
192
管理

金磊 发自 凹非寺

量子位 | 公众号 QbitAI

国产ChatGPT之战,已然是大步迈进白热化阶段。

就在刚刚,商汤正式发布自研类ChatGPT产品,名曰商量(SenseChat)。

单单是这个名字,便值得说道一番。

商量的“商”,不仅体现了它是商汤自家“商字辈儿”的产品;从整体来看,更是具有商讨、交换意见的味道。

毕竟我们在使用类ChatGPT产品过程中,恰巧就是一种人机协同的过程:不应是一味的问与答,而是通过引导等方式让输出结果趋于理想。

在商量的背后,所依托的是商汤自研的千亿参数自然语言处理模型。

而在此模型的背后,则是商汤最新推出的日日新(SenseNova)大模型体系。

也正是因为这种的能力,商汤的发布还不同于此前国产类ChatGPT玩家,它一口气还发布了:

秒画:AI内容创作社区平台。如影:AI数字人视频生成平台。琼宇、格物:3D内容生成平台。

更重要的一点是,根据商汤CEO徐立在现场的描述,上述这些AIGC产品所要发力之处,将是诸如医疗、短视频、教育、营销以及开发等产业领域。

在我们下达指示之后,“商量”表示了理解,然后就开始了“你一句我一句”人机共创故事的之旅:

人类:小花是一只小猫咪,他很喜欢钓鱼。商量:小花在河边钓鱼,他钓到了一条大鱼。

人类:大鱼对小花说,请你放我回去吧,我家里还有小鱼在等着我呢。商量:小花心地善良,他同意了大鱼的请求,把大鱼放回了河里。大鱼感激地游走了,小花也继续享受着的钓鱼的乐趣。

从这个过程中不难看出,“商量”是可以理解用户的语义,了解故事中的角色和关系,并且能够get用户的思路,基于此以多轮对话形式来完成故事的创作。

(要是让小朋友们跟“商量”一起创作故事,怕是能玩上一整天吧。)

不仅如此,在体验过程中,我们还发现“商量”是具备一定共情能力的。

例如当我们处于迷茫之际,可以向它提问:

如何提高自我认识,更好地了解自己?

此时的“商量”仿佛可以抓住问题背后人类内心真正的需求,回答中的“学会爱自己”、“学会自我肯定和鼓励”,显得格外暖心。

“商量”面对这么一句胡诌,直接指出了iPhone与二战的时代背景不符,可见其不仅能理解句子的意思,还能通过尝试判断句子的合理性。

那么对于非常绕的逻辑问题,“商量”是否也能轻松应对?

请听题目:

假设False与True是False,则True与not False是?

不得不说,如此恢宏壮丽的景象,是把想象拉进现实的那种了。

若是想生成与太空探索主题相关的高清大海报,这个也可以有,只需把这句话投喂进去:

一艘闪闪发光的飞船绕着一颗巨大的气态巨行星的月球旋转,在天空中盘旋着云,飞船在月球前气态巨行星前,美丽的科幻艺术,超现实的白日梦。

不难看出,“秒画”是经得住考验的那种AI了。

除了以文生图之外,我们再来看下AI数字人生成平台。

据了解,商汤的“如影”仅需要5分钟真人视频素材,就可以生成出声音及动作自然、口型准确、多语种精通的数字人分身。

再如“琼宇”和“格物”,基于神经辐射场技术(NeRF),可以高效低成本生成大规模三维场景和精细化的物件,为元宇宙、虚实融合应用打开新的想象空间。

由此可见,商汤的AIGC能力已然是做到了全面覆盖,并且水平也是肉眼可见的达到了可以“上岗”的水平。

那么接下来的一个问题是:

怎么炼成的?

背后的日日新大模型,便是炼成“商量”、“秒画”等一众AIGC产品的杀手锏。

日日新,顾名思义,是指模型的迭代速度及处理问题的能力上可以日日更新,不断解锁AGI更多可能。

(取自《礼记·大学》中汤之盘铭曰“苟日新、日日新、又日新”)

从现场展现的能力来看,日日新大模型能够提供的能力,主要集中在了自然语言处理、图片生成、自动化数据标注、自定义模型训练等。

但日日新大模型并非是趁着这一波AIGC大热潮,一蹴而就出现的那种。

其实早在五年前,商汤便已经在大模型领域着手研发。

并且在2019年,商汤便使用上千张GPU进行单任务训练,推出了10亿参数规模的视觉模型,并实现了当时业界最好的算法效果。

后来在2021年到2022年期间,商汤训练并开源了30亿参数的多模态大模型——书生。

就目前来看,商汤已经成功研发了320亿参数量的全球最大的通用视觉模型;并且已经打造了CV、NLP和AIGC相关大模型。

因此,不难看出商汤此次发布的超大模型体系,其实是早有所准备,通过五年来的各项“小作业”,融会贯通并提交了一项“大作业”。

值得一提的是,在此次发布会中,商汤表示“日日新”将提供多种灵活的API接口和服务,包括图片生成,自然语言生成,视觉感知通用任务与标注服务!

……

但有一说一,多模态和决策智能大模型,并非是商汤通往通用人工智能(AGI)的唯一杀手锏。

大模型时代,大算力更为重要

没错,商汤自己的超强算力,正是另一项更为关键的因素。

它便是于2022年1月交付使用,首付56亿元,一举成为亚洲最大的AI超算中心之一的人工智能计算中心(AIDC)。

一年之前,商汤AIDC的总算力便已经是3740 Petaflops,如此算力之下,已经可以完整训练万亿参数规模的大模型。

时隔一年,现如今,这个算力数字已然是翻了个小翻,达到了5000 Petaflops!

它可以以最大4000卡规模集群进行单任务训练,并可做到七天以上不间断的稳定训练。

△商汤科技AIDC展厅中的裸眼3D展示

但了解商汤的朋友都知道,这个AIDC还仅是商汤AI大装置SenseCore的一部分。

除了AIDC这个算力层之外,加之数据层和模型层两大维度,便构成了“三位一体”的AI大装置。

因此,综合来看,商汤在通往AGI道路上的范式,便是“大模型 大算力”。

而如此布局的背后,在今天的发布会中,商汤对此的逻辑思考也逐步浮出水面,AGI时代之下,数据、算法和算力三要素有了新的需求:

计算量(GPU数量 x 运行时间 x 并行效率 )= 模型参数量 x 处理数据量。

怎么理解?

模型参数量要足够多,才能实现AI智慧的涌现,而这也带来了对算力的剧增,需要更高的并行效率,才能有效支持大参数模型训练。

数据方面,高质量自然语言数据逐渐稀缺,而视觉数据相较自然语言在数量、质量、容纳信息等方面有多种优势,能够使得AI更好地理解世界。

由此,就不难理解商汤如此布局的原因了。

……

总而言之,有大数据、有大模型、有大算力,商汤在国产AIGC的亮相,一点也不意外。

是值得期待一波了。

— 完 —

量子位 QbitAI · 头条号签约

关注我们,第一时间获知前沿科技动态

0
点赞
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与华威派无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
凡本网注明 “来源:XXX(非华威派)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。
如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。
QQ:2443165046 邮箱:info@goodmaoning.com
关于作者
清水大树(普通会员)
点击领取今天的签到奖励!
签到排行
0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索