效果达OpenAI同规模模型96%,发布即开源!国内团队新发大模型,CEO上阵写代码...

明敏 发自 凹非寺
量子位 | 公众号 QbitAI

国内自研大模型迎来新面孔,而且发布即开源!

最新消息,多模态大语言模型TigerBot正式亮相,包含70亿参数和1800亿参数两个版本,均对外开源

由该模型支持的对话AI同步上线。

写广告语、做表格、纠正语法错误,效果都不错;也支持多模态,能生成图片。

4b1dddb0d4f266fd9abddc1f8a647267.gif

评测结果显示,TigerBot-7B已达到OpenAI同样大小模型综合表现的 96%

f2f243293d1ab33e720d197c3d123eb2.png
公开 NLP 数据集上的自动评测,以OpenAI-instruct GPT-6B-SFT为基准,归一化并平均各模型的得分情况

而更大规模的TigerBot-180B或是目前业内开源的最大规模大语言模型。

此外,团队还一并开源100G预训练数据、监督微调1G或100万条数据

基于TigerBot,开发者在半天内就能打造出自己的专属大模型。

目前TigerBot对话AI已邀请内测,开源代码数据等已上传至GitHub(详细链接见文末)。

1cc83325a60d340e6d4639840dafbc36.png

如上这些重磅工作,来自一支最初只有5人的小团队,首席程序员&科学家就是CEO本人

但这个团队,绝非师出无名。

从2017年起,他们就在NLP领域开始创业,专长垂直领域搜索。最擅长对数据重度以来的金融领域,和方正证券、国信证券等有过深入合作。

创始人兼CEO,有着20多年从业经验,曾任UC伯克利客座教授,手握3篇最佳顶会论文和10项技术专利。

如今,他们决心从专长领域走向通用大模型。

而且一开始便从最底层的基础模型做起,3个月内完成3000次实验迭代,还有底气将阶段性成果对外开源。

不禁让人好奇,他们是谁?想要做哪些事?如今已经带来了哪些阶段性成果?

TigerBot是什么?

具体来看,TigerBot是一款国产自研的多语言任务大模型。

覆盖生成、开放问答、编程、画图、翻译、头脑风暴等15大类能力,支持子任务超过60种。

75a83a3d08441b194479d6bf21708117.gif

而且支持插件功能,能让模型联网,获取到更加新鲜的数据和信息。

80f05986b4f54e1a18198ee12070ea3e.png

它的定位更偏向办公场景,提出改善人们工作流、提高效率的目标。

比如让它来帮我写一条Apple Vision Pro的新闻快讯,效果有模有样:

5c309530d0e14a76b98a3306e919b652.png

或者写一个论文大纲,条理清晰、结构合理:

f52b03b2ca58f052747a26b4d42b1f09.png

编程也没问题,并且支持英文对话。

4f97256aa7bdff0c70da4565e5f2be1e.jpeg
efbe17f1fab386f41fbc4b57ff2e2d07.jpeg

如果让它画图的话,每次都会生成3张不一样的,可以自己挑选。

520857093db54b8c499af4d2e4958a45.gif

这次发布,TigerBot一共推出了两种size:70亿参数(TigerBot-7B)和1800亿参数(TigerBot-180B)。

团队将目前取得的阶段性成果——模型、代码、数据,通通开源。

开源模型包括三个版本:

  • TigerBot-7B-sft

  • TigerBot-7B-base

  • TigerBot-180B-research

其中TigerBot-7B-base的表现优于OpenAI同等可比模型、BLOOM。TigerBot-180B-research或是目前业内开源的最大规模模型(Meta开源OPT的参数量为1750亿、BLOOM则为1760亿规模)。

开源代码包括基本训练和推理代码,双卡推理180B模型的量化和推理代码。

数据包括100G预训练数据,监督微调1G或100万条数据。

根据OpenAI InstructGPT论文在公开NLP数据集上的自动评测,TigerBot-7B已达到 OpenAI 同样大小模型的综合表现的96%。

而这一版本还只是MVP(最小可行性模型)。

这些成果主要得益于团队在GPT和BLOOM基础上,在模型架构和算法上都做了更进一步的优化,也是TigerBot团队过去几个月来的主要创新工作,让模型的学习能力、创造力和生成可控上都有明显提升。

具体如何实现?往下看。

性能提升同时降低成本

TigerBot带来的创新主要有以下几个方面:

  • 提出指令完成监督微调的创新算法提升模型可学习性

  • 运用ensemble和probabilistic modeling的方法实现可控事实性和创造性

  • 在并行训练上突破deep-speed等主流框架中的内存和通信问题,实现千卡环境下数月无间断

  • 针对中文语言更不规则的分布,从tokenizer到训练算法上做了更适合的优化

首先来看指令完成监督微调方法。

它能让模型在只使用少量参数的情况下,就能快速理解人类提出了哪类问题,提升回答的准确性。

原理上使用了更强的监督学习进行控制。

通过Mark-up Language(标记语言)的方式,用概率的方法让大模型能够更准确区分指令的类别。比如指令的问题是偏事实类还是发散类?是代码吗?是表格吗?

因此TigerBot涵盖了10大类、120类小任务。然后让模型基于判断,朝着对应方向优化。

带来的直接好处是调用参数量更少,同时模型对新数据或任务的适应能力更好,即学习性(learnability)提高。

在同样50万条数据训练的情况下,TigerBot的收敛速度比斯坦福推出的Alpaca快5倍,在公开数据集上评测显示性能提升17%。

其次,模型如何更好平衡生成内容的创造性事实可控性,也非常关键。

TigerBot一方面采用ensemble的方法,将多个模型组合起来兼顾创造性和事实可控性。

甚至可以根据用户的需求,调整模型在二者之间的权衡。

另一方面还采用了AI领域经典的概率建模(Probabilistic Modeling)方法。

它能让模型在生成内容的过程中,根据最新生成的token,给出两个概率。一个概率判断内容是否应该继续发散下去,一个概率表示生成内容离事实内容的偏离程度。

综合两个概率的数值,模型会在创造性和可控性上做一个权衡。TigerBot中这两个概率的得出由专门数据进行训练。

考虑到模型生成下一个token时,往往无法看到全文的情况,TigerBot还会在回答写完后再进行一次判断,如果最终发现回答不准确,便会要求模型重写。

我们在体验过程中也发现,TigerBot生成回答并不是ChatGPT那样逐字输出的模式,而是在“思考”后给出完整答案。

ff331397d782787f0b88b313db5356b1.gif

b8c9f552e620b0b1ddd6636d95a5649f.gif
ChatGPT和TigerBot回答方式对比

而且由于TigerBot的推理速度很快,能够支撑模型快速重写。

这里就要说到TigerBot在训练和推理上的创新了。

除了思考到模型底层架构的优化,TigerBot团队认为工程化水平在当下大模型时代也很重要。

一方面是因为要考虑运营效率——随着大模型趋势持续,谁能更快迭代模型非常关键;另一方面当然还要考虑算力的经济性。

因此,他们在并行训练方面,突破了deep-speed等主流框架中的若干内存和通信问题,实现了千卡环境下训练数月无间断。

这使得他们每月在训练上的开销,能够节省数十万。

最后,针对中文连续性强、多义歧义情况多等问题,TigerBot从tokenizer到训练算法上,都做了相应优化。

总结来看,TigerBot实现的技术创新,全都发生在当下大模型领域中最受关注的领域内。

不仅是底层架构的优化,还考虑到了落地层面的用户需求、开销成本等问题。并且整个创新过程的速度非常快,是10人左右小团队在几个月时间内实现。

这对团队本身的开发能力、技术见解、落地经验都有非常高的要求。

所以,到底是谁带着TigerBot突然杀入大众视野?

虎博科技是谁?

TigerBot的幕后开发团队,其实就藏在它本身的名字里——虎博科技

它成立于2017年,也就是人们常说的AI上一轮爆发期内。

虎博科技给自己的定位是“一家人工智能技术驱动的公司”,专注于NLP技术的应用落地,愿景是打造下一代智能且简单的搜索体验。

具体实现路径上,他们选择了对数据信息最为敏感的领域之一——金融。自研了垂直领域内智能搜索、智能推荐、机器阅读理解、总结、翻译等技术,推出了智能金融搜索和问答系统“虎博搜索”等。

公司创始人兼CEO为陈烨,是一位世界级AI科学家。

8e9d41489d1854e8f3a6f8d7979b6538.jpeg

他博士毕业于威斯康辛大学麦迪逊分校,曾任加州大学伯克利分校客座教授,到现在为止从业已有20余年。

他先后在微软、eBay、雅虎担任主任科学家和研发总监等要职,主导研发了雅虎的行为定向系统、eBay的推荐系统以及微软搜索广告竞拍市场机制等。

2014年,陈烨加入大众点评。之后美团点评合并,他任美团点评高级副总裁,分管集团广告平台,助力集团年广告收入从1000万提升至40多亿。

学术方面,陈烨曾三次获得顶会最佳论文奖(KDD和SIGIR),在SIGKKD、SIGIR、IEEE等人工智能学术会议上发表20篇论文,拥有10项专利。

2017年7月,陈烨正式创立虎博科技。成立1年后,虎博便快速拿下超亿元融资,目前公司披露融资总额达4亿元

1683fb7421b729ddecb94207817eedf8.png

7个月以前,ChatGPT横空出世,AI在时隔6年以后,再次颠覆大众认知。

即便是陈烨这样在AI领域内创业多年的技术专家,也用“从业以来前所未有的震撼”来形容。

而在震撼之外,更多还是激动。

陈烨说,看到ChatGPT后,几乎不用思考或决定,内心的呼唤让他一定会跟进趋势。

所以,从1月份开始,虎博正式成立了TigerBot的初始开发团队。

不过和想象中不太一样,这是一支极客风格非常鲜明的团队。

用他们自己的话来说,致敬硅谷90年代经典的“车库创业”模式。

团队最初只有5个人,陈烨是首席程序员&科学家,负责最核心的代码工作。后面成员规模虽有扩充,但也只控制在了10人,基本上一人一岗。

为什么这样做?

陈烨的回答是:

我认为从0到1的创造,是一件很极客的事,而没有一个极客团队是超过10个人的。

以及纯技术科学的事,小团队更犀利。

的确,TigerBot的开发过程里,方方面面都透露着果断、敏锐。

陈烨将这个周期分为三个阶段。

第一阶段,也就是ChatGPT爆火不久后,团队迅速扫遍了OpenAI等机构过去5年内所有相关文献,大致了解ChatGPT的方法机制。

由于ChatGPT代码本身不开源,当时相关的开源工作也比较少,陈烨自己上阵写出TigerBot的代码,然后马上开始跑实验。

他们的逻辑很简单,让模型先在小规模数据上验证成功,然后经过系统科学评审,也就是形成一套稳定的代码。

在一个月时间内,团队就验证了模型在70亿规模下能达到OpenAI同规模模型80%的效果。

第二阶段,通过不断吸取开源模型和代码中的优点,加上对中文数据的专门优化处理,团队快速拿出了一版真实可用的模型,最早的内测版在2月便已上线。

同时,他们还发现在参数量达到百亿级别后,模型表现出了涌现的现象。

第三阶段,也就是到了最近的一两个月内,团队在基础研究上实现了一些成果和突破。

如上介绍的诸多创新点,就是在这一时期内完成的。

同时在这一阶段内整合更大规模算力,达到更快的迭代速度,1-2个星期内,TigerBot-7B的能力便快速从InstructGPT的80%提升到了96%。

陈烨表示,在这个开发周期内,团队始终保持着超高效运转。TigerBot-7B在几个月内经历了3000次迭代。

小团队的优势是反应速度快,早上确定工作,下午就能写完代码。数据团队几个小时就能完成高质量清洗工作。

但高速开发迭代,还只是TigerBot极客风格的体现点之一。

因为他们仅凭10个人在几个月内肝出来的成果,将以全套API的形式向行业开源

如此程度的拥抱开源,在当下趋势尤其是商业化领域内,比较少见。

毕竟在激烈竞争中,构建技术壁垒是商业公司不得不面对的问题。

那么,虎博科技为什么敢于开源?

陈烨给出了两点理由:

第一,作为一名AI领域内的技术人员,出于对技术最本能的信仰,他有一点热血、有一点煽情。

我们想要以世界级的大模型,贡献于中国创新。给行业一个可用的、底层基础扎实的通用模型,能让更多人快速训练出专业大模型,实现产业集群的生态打造。

第二,TigerBot接下来还会继续保持高速迭代,陈烨认为在这种赛跑的局面下,他们能保持身位优势。即便是看到有人以TigerBot为底层开发出了性能更好的产品,这对于行业内来说又何尝不是一件好事?

陈烨透露,接下来虎博科技还会持续快速推进TigerBot的工作,进一步扩充数据来提升模型性能。

“大模型趋势就像淘金热”

在ChatGPT发布6个月以后,随着一个个大模型横空出世、一家家巨头火速跟进,AI行业格局正在被快速重塑。

尽管当下还相对混沌,但大致来看,基本上会分为模型层、中间层、应用层三层。

其中模型层决定底层能力,至关重要。

它的创新程度、稳定程度、开放程度,直接决定了应用层的丰富程度。

而应用层的发展是大模型趋势演进的外化体现;更是AIGC愿景里,人类社会生活走向下一阶段的重要影响因素。

那么,在大模型趋势的起点,如何夯实底层模型基础,是行业内必须思考的事。

在陈烨看来,目前人类才只开发了大模型10-20%的潜力,在fundamental层面还有非常大的创新和提升空间。

就好像曾经的西部淘金热,最初要找到金矿在哪里一样。

所以在这样的趋势和行业发展要求下,虎博科技作为国产领域创新代表,高举开源大旗,迅速起跑、追赶世界最前沿技术,确实也为行业内带来了一股与众不同的气息。

国产AI创新正在高速狂奔,未来一段时间内,相信我们还会看到更多有想法、有能力的团队亮相,为大模型领域注入新的见解、带来新的改变。

而这,或许就是趋势轰轰烈烈演进过程中,最迷人之处了。

8fbf05da40a74edcd76ba3dc59de0171.jpeg

福利时刻:

想体验TigerBot的童鞋,可以通过下方链接或点击“阅读原文”进入网站,点击“申请内测”,组织代码中写“量子位”即可通过内测~

官网地址:https://www.tigerbot.com/chat

e4ffd6fff6671e3324b875f3c2a8525d.png
50f7b5e29f0f2e3730d30f30fbb1c904.png

GitHub开源地址:
https://github.com/TigerResearch/TigerBot

—  —

点这里👇关注我,记得标星哦~

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.rhkb.cn/news/17286.html

如若内容造成侵权/违法违规/事实不符,请联系长河编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

深聊丨第四范式陈雨强:如何用AI大模型打开万亿规模传统软件市场?

“GPT大模型到底能不能用?用在哪里?” 这是目前中国大型企业一把手最关心的问题之一。AI大模型也被媒体称为“一把手”工程。 大型企业会非常认真地考虑大模型的应用。最近个把月,大型企业客户对大模型的热烈反应让第四范式首席科学家陈雨强…

ChatGPT解释器详细教程|Bard上手指南|【2023-0716】【第六期】

点击加入->【智子纪元-AIGC】技术交流群 一、大咖观点: 《人民日报》:大模型的竞争,是国家科技战略的竞争WAIC 2023 | 张俊林:大语言模型带来的交互方式变革 三、大模型实用教程: 获星1.9k,LLM微调神…

百度AI模型“文心一言”新鲜体验

今天收到通知可以体验百度的AI模型“文心一言”,等了一个多月迫不及待的去体验了一把,以下是体验的相关记录。 1、简单介绍 通过文心一言官网链接https://yiyan.baidu.com/进入,看到如下界面: 在文心一言的自我介绍中&#xff0c…

【工具】1640- 这 5 款 AI 绘图工具,让你的绘图更高效!

关注 “AI 工具派” 探索最新 AI 工具,发现 AI 带来的无限可能性! 大家好,我是 Chris。 最近我又发现了一些非常优秀的 AI 绘图工具,这些工具可以帮助我们更轻松地完成设计任务,提高设计效率。今天我向大家分享 5 款我…

性能提升571%,32K超长上下文,推理速度提升42%,允许商用,国产开源大模型推出了二代 ChatGLM2-6B...

6月份是火热的夏天,各种火热的 AI 产品也在密集的更新,天越热,大家是干得热火朝天,卷出了新高度。 前有现在大火的 ChatGPT,ChatGPT 更新:大杀器!函数调用示范,ChatGPT 3.5/4 双双升…

超级AI大脑 / springboot-openai

温馨提醒 本项目仅适用学习交流,并且不提供无偿的 维护修改服务(但可提issue)本项目不在任何平台出售,如有发现请积极举报为了更好的体验,友情提示此项目是一个全栈项目,认真刻苦的掌握它,熟练掌握后你就比…

却话文心一言(Chatgpt们),存算一体真能突破AI算力“存储墙”|“能耗墙”|“编译墙”?

文心一言折戟沉沙 作为国内搜索引擎巨头玩家,百度在中文语料领域拥有大量的积累,在算力基础设施等层面也拥有优势。 但是国产化AI芯片的处境其实很难。 这不是危言耸听,也不是崇洋媚外。这不,百度文心一言初战吃瘪。 图1. 文心一言…

GPT-4 大升级!太太太太强了!

金磊 梦晨 发自 凹非寺量子位 | 公众号 QbitAI 万众期待的GPT-4,它来了! OpenAI老板Sam Altman直接开门见山地介绍说: 这是我们迄今为止功能最强大的模型! 有多强? 根据OpenAI官方的介绍,GPT-4是一个超大的…

GPT-4发布!ChatGPT大升级!

来源:量子位(id:QbitAI)作者:金磊 梦晨一觉醒来,万众期待的GPT-4,它来了! OpenAI老板Sam Altman直接开门见山地介绍说: 这是我们迄今为止功能最强大的模型! 有…

GPT-4:不open的OpenAI,终于不再编造事实

去年, ChatGPT 横空出世,带着独特的大型预训练模型,掀起了 GPT 和 AIGC 的浪潮,一时之间关于 OpenAI 的话题不断,各互联网大厂都纷纷入局,想要加入这场“变革”的狂欢。但在 GPT 引发无数人追捧的同时&…

美团王兴将参与王慧文光年之外A轮投资;海康机器人拟募资60亿元创业板上市;赛富时启动2.5亿美元生成式AI基金丨每日大事件...

‍ ‍数据智能产业创新服务媒体 ——聚焦数智 改变商业 企业动态 苹果新专利获批,自动驾驶汽车有效路况监控范围扩大到200米 3月7日,据美国商标和专利局(USPTO)公示的清单,苹果获得了41项技术专利,其中多项…

小狐狸ChatGPT付费创作系统V2.0.8独立版 +WEB端+ H5端 + 小程序端+新增PC端绘画 安装说明

ChatGPT付费创作系统V2.0.8提供单独的升级包,升级前先更新至2.0.7版本,再上传升级包替换,同是导入升级包数据库。ChatGPT2.0.8独立版核心功能增加了PC端绘画功能,绘画功能采用其他绘画接口-意间AI,后台一些小细节的优化…

sms 短信服务说明

sms 短信服务说明 官网:https://help.aliyun.com/document_detail/57535.html 短信服务 api 短信发送流程 # 短信发送准备:短信签名、短信模板 AddSmsSign:添加短信签名,通过QuerySmsSign查看短信签名状态的审核状态 AddSmsTempla…

基于MVC+三层架构实现—SMS_登陆注册

做了一个简单的登录注册系统,基于MVC三层架构的模式,关于MVC三层架构模式的理解可以看这篇博客 https://blog.csdn.net/w_linux/article/details/79919523 下面是开发全过程 项目目录 一、创建数据库(MySQL) create database sms;use sms;create table …

harmonyos鸿蒙,鸿蒙HarmonyOS应用权限列表大全

HarmonyOS的应用权限严格按照权限分类分级模型进行定义,如图1所示,具体过程可分为三步: 1、根据不同应用所需实现的功能,明确接口是否需要对外开放。 2、根据接口所涉数据的敏感程度或所涉能力的安全威胁影响,对所有的开放接口进行分级(包括中、低、高、严重)。不对外开放…

小米网关接入Homekit完整教程

Hi 米娜桑,通过我艰苦不懈的追踪发现,绿米智能家庭产品现在也是可以部分支持Homekit啦~ 起因是我发现了这个: https://github.com/snOOrz/homebridge-aqara 然后我又跳转到了这 https://github.com/nfarina/homebridge 那么,我就…

Shot边界检测----2001-2007TRECVID比赛算法总结

概述 Shot边界检测(Shot boundary detection ,SBD)指在视频中自动检测镜头的边界,是视频分析,视频索引,视频摘要,视频搜索和其他基于内容的视频操作的基本的预处理步骤。自动SBD是2001至2007年…

IJCAI探营第一天 6个Tutorial 和13个Workshop为什么都“挤在” RMIT 80号楼?

雷锋网消息:今天是IJCAI大会(国际人工智能联合会议)的第一天,在寒冷的墨尔本,雷锋网(公众号:雷锋网)的记者来到这里为大家带来大会的最新报道。 大会的前两天在墨尔本皇家理工大学(RMIT&#xf…

每日区块链:区块链需求增加,Nvidia有望获得巨额利润;澳洲大学建立世界首家区块链社会科学研究中心

1、区块链需求增加,Nvidia有望获得巨额利润 如今,许多公司已经开始采用区块链技术。市场报告称,区块链市场规模很可能从去年的2.102亿美元增长至2021年的23.125亿美元。 尽管区块链的主要目标是银行、支付系统和金融机构,但其他公…

博士申请 | 皇家墨尔本理工大学鲍芝峰教授招收数据挖掘方向全奖博士生

合适的工作难找?最新的招聘信息也不知道? AI 求职为大家精选人工智能领域最新鲜的招聘信息,助你先人一步投递,快人一步入职! 皇家墨尔本理工大学 皇家墨尔本理工大学(Royal Melbourne Institute of Technol…