呼吁!少用ChatGPT,多支持开源!

11890733a2ffd2adfda9288f16b537de.png

b0868ce3b6cfd87b4f93104f46b5e7a0.jpeg

【深度学习革命 - 从历史到未来 Genius Makers: The Mavericks Who Brought AI to Google, Facebook, and the World】这本书里详述了为何西方人工智能界(AI)对于 AI 如此戒慎恐惧,深忧它被少数白人(绝大多数为男性)统治,从而造成种族与性别的歧视(非白种人与女性更不容易被识别)、被锲而不舍试图染指 AI 的美国军方用于杀戮、被深伪技术 (Deep Fake) 利用来扭曲造假,影响民主及选举甚或用于犯罪...

著名的林纳斯定律 (Linus' Law):“足够多的眼睛,就可让所有问题浮现 (given enough eyeballs, all bugs are shallow)”。

但是当人脑的胶质细胞与神经元只有 850 亿个,而深度学习时代 的 ChatGPT 大模型的参数量达到了 1,750 亿,谷歌最近发布的 PaLM2 的参数更高达 5,620 亿。人脑与电脑越来越大的算法与算力差距,真的是更多的人眼就能看得出问题所在吗?

更核心的问题是,我们人类真的知道或是有能力分辨 “问题” 到底是什么吗?我们问出了对的问题吗?例如说自由与责任、群体和个人、正义与邪恶、政府与企业等的边界在哪里?谁来划分界定呢?

开源肯定是解决大公司垄断的选项之一,但是开源只是人类面向人工智能征程的开始。我们开源人任重道远!

--- 刘天栋 Ted,开源社正式成员

【导读】为了科学界的未来,加入开源LLM阵营吧!

免费的ChatGPT用的是很爽,但这种闭源的语言模型最大的缺点就是不开源,外界根本无法了解背后的训练数据以及是否会泄露用户隐私等问题,也引发了后续工业界、学术界联合开源了LLaMA等一系列羊驼模型。

最近Nature世界观栏目刊登了一篇文章,纽约大学政治与数据科学教授Arthur Spirling呼吁大家更多地使用开源模型,实验结果可复现,也符合学术伦理

重点是,万一哪天OpenAI不爽了,关闭了语言模型接口,或是靠封闭垄断涨价的话,那用户只能无奈地说一句,「终究是学术败给了资本」。

ff995720450ca135926469e966d89885.png

文章作者Arthur Spirling将于今年7月加入普林斯顿大学教授政治学,主要研究方向是政治方法论和立法行为,具体为文本数据(text-as-data)、自然语言处理、贝叶斯统计、机器学习、项目反应理论和广义线性模型在政治科学中的应用。

研究人员应该避免商用模型的诱惑,共同开发透明的大型语言模型,以确保可重复性。


拥抱开源,拒绝垄断

似乎每天都有一个全新的大型语言模型(LLM)推出,其创建者和学术界相关人士每次都会对新模型如何与人类进行流畅交流的能力慷慨陈词,比如可以帮用户改代码,写推荐信,给文章写摘要等等。

作为一名正在使用并教授如何使用这些模型的政治和数据科学家,我认为学者们应该保持警惕,因为目前最受大众追捧的语言模型仍然是私有且封闭的,即由公司运营,他们不会披露基本模型的具体信息,只会独立地检查或验证模型的能力,所以研究人员和公众并不知道模型的训练使用了哪些文件。

1cc92e1def67f07f7de6eecd03eb08d2.png

急于将语言模型纳入自己的研究流程可能会出问题,可能会威胁到来之不易的「研究伦理」和「结果复现性」方面的相关进展。

不光不能依赖商用模型,研究人员还要通力合作开发透明且不依赖于某个具体公司利益的开源大型语言模型。

虽然商用模型非常方便,可以开箱即用,但投资开源语言模型是历史的趋势,既要想办法推进开发,也要让模型应用于未来的研究中。

我乐观地估计,语言模型工具的未来一定是开源的,类似于开源统计软件的发展历史,刚开始商用的统计软件很流行,但目前基本所有社区都在使用R或Python等开源平台。

77e42ad3cefdae02c5b5e52a13a9e66d.png

举个例子,去年7月发布的开源语言模型BLOOM,其开发团队Hugging Face是一家总部位于纽约的人工智能公司,携手一千多名志愿者和研究人员共同打造,部分研发资金由法国政府提供;其他团队也在努力开源大型语言模型。

我认为类似这样的开源项目都是伟大的,但我们还需要更多的合作,需要汇集国际资源和专业知识。

开源大型语言模型的团队通常不像大公司那样资金充足,并且开发团队还需要持续运营以跟踪领域内的最新进展:AI领域的发展实在是太快了,甚至大部分语言模型在推出几周或几个月以后就会过时。

所以参与到开源中的学者越多,最终开源模型的效果也会更好。

留言🤔️:你怎么看?

参考资料:

https://www.nature.com/articles/d41586-023-01295-4

转载自丨Datawhale

编辑丨王梦玉

相关阅读 | Related Reading

712e3c8f8015d59ba308a1429c981673.jpeg

开源项目Apache StreamPark遭遇侵权,相似度80%

89fa68a8870c6d801b43268c3d86b0fc.jpeg

OpenHarmony开发者大会正式召开 百业齐鸣开源共兴

开源社简介

开源社成立于 2014 年,是由志愿贡献于开源事业的个人成员,依 “贡献、共识、共治” 原则所组成,始终维持厂商中立、公益、非营利的特点,是最早以 “开源治理、国际接轨、社区发展、项目孵化” 为使命的开源社区联合体。开源社积极与支持开源的社区、企业以及政府相关单位紧密合作,以 “立足中国、贡献全球” 为愿景,旨在共创健康可持续发展的开源生态,推动中国开源社区成为全球开源体系的积极参与及贡献者。

2017 年,开源社转型为完全由个人成员组成,参照 ASF 等国际顶级开源基金会的治理模式运作。近九年来,链接了数万名开源人,集聚了上千名社区成员及志愿者、海内外数百位讲师,合作了数百家赞助、媒体、社区伙伴。

3140b2e3fec588e2f00000bb4bc74e30.png

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.rhkb.cn/news/12349.html

如若内容造成侵权/违法违规/事实不符,请联系长河编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

ChatGPT对未来教育的影响:或将成为奇点

ChatGPT横空出世,不难想象,不久的将来,公司经理只要按一下按钮或者对语音机器人发个指令,就可以将一个粗略的文档转换成优雅的演示文稿,而无需劳烦公司文秘。这无疑颠覆了我们早已熟稔于心的工作场景。 不论是这一次人…

“慎用ChatGPT”!

中国财经报 2023-04-11 4月10日,中国支付清算协会网站发布“关于支付行业从业人员谨慎使用ChatGPT等工具的倡议”,全文如下: 近期,ChatGPT等工具引起各方广泛关注,已有部分企业员工使用ChatGPT等工具开展工作。但是&am…

带你系统的认识CHATGPT

近期CHATGPT火遍全球,各行各业的顶尖人才都在讨论着CHATGPT的发展趋势,中产们都研究着怎么使用CHATGPT产生更大的价值 今天我带大家系统的认识一下CHATGPT. 要说到CHATGPT,我们不得不先介绍一下OPENAI,它是一家人工智能研发公司,CHATGPT是它旗下的产品. OPENAI目前开放的产品有…

与chatGPT神聊,引领你深入浅出系统调用

在操作系统的教学中,系统调用的作用不言而喻,但是,对系统调用常常是雾里看花,似乎明白,又难以真正的触及,即使在代码中调用了系统调用,比如调用fork()创建进程&#xff0…

从零开始开发自己的chatgpt平台 之 SSE(Server-Sent Events)客户端和服务端

提示:如果你认为本文对你有帮助,请点一下关注,后面会有更多人工智能方面的文章。 文章目录 前言一、SSE是什么?二、SSE服务端三、客户端四、SSE双向通信总结 如果有问题可以联系我**:https://gitee.com/xiaoyuren/gpt3…

中国院士称“我国已具备 ChatGPT 发展基础”

中国工程院院士王坚称「我国已具备支撑 ChatGPT 发展的算力基础」,“解好电力行业的关键问题,有可能会引领下一波AI浪潮。”中国工程院院士、阿里云icon创始人王坚2月17日在南方电网总部参加第四届电力调度AI应用大赛时表示。 我认为要开发出chatGPT这样…

Prompt 用法大全!让 ChatGPT 更智能的六种策略(中)

如果遵循以下六种策略来构建 Prompt 提示词,在和 ChatGPT 对话中我们将获得更好、更符合我们要求的回答。 这些策略,后几种更适合在编程调用 ChatGPT API 时使用,不过也适用直接和 ChatGPT 对话,让它更好的理解我们的意图。 1、写…

ChatGPT迎来华人产品负责人Peter Deng

6月1日,ChatGPT新任产品负责人Peter Deng在领英发布动态,宣布正式以“消费者产品副总裁”的身份加入了OpenAI,他写道,“我很高兴能够领导ChatGPT背后杰出的产品、设计和工程团队,目标是让AI对每个人都有用、易获得且有…

第十四届大学生服务外包创新创业大赛总结和心得

前言 比赛已经过去一个多月了,但是当时在为数不多的时间里学东西和完成项目的场景还历历在目,最后我们也获得了省三等的成绩,这对我们五个大一的学生来说已经非常满足了。 比赛介绍 相关连接:服务外包网址 比赛内容&#xff1a…

年薪高达 267 万元,ChatGPT 催生高薪职业,无需编程背景

整理 | 朱珂欣 出品 | CSDN程序人生(ID:coder_life) ChatGPT 的兴起,催生了一个“与众不同”的新职业 —— prompt engineer (提示工程师)。 主要职责是负责为 AI 聊天机器人生成的文本、图片、音频等内…

【关于ChatGPT的30个问题】25、ChatGPT的性能和效果如何?/ By 禅与计算机程序设计艺术

25、ChatGPT的性能和效果如何? 目录 25、ChatGPT的性能和效果如何? ChatGPT的性能涉及的方面 语言模型

ChatGPT专业应用:生成奖项方案

正文共 925 字,阅读大约需要 4 分钟 人力资源等必备技巧,您将在4分钟后获得以下超能力: 生成奖项方案 Beezy评级 :A级 *经过寻找和一段时间的学习,一部分人能掌握。主要提升效率并增强自身技能。 推荐人 | Kim 编辑者…

部署AI平台 宝马集团正在掀起新一轮数字化改革浪潮

数字化转型作为当代企业创新求变的重要突破口,成为各行各业推进持续发展的大热趋势。但在企业的在数字化征程中,却暗藏多重陷阱,数据孤岛、标准不一、质量太差、治理滞后、安全隐患等挑战,如影随形。 近日,宝马集团宣…

读书思考:步步惊心的《技术陷阱》

《技术陷阱》这本书450页,43万字之巨,信息量密密麻麻,采集的资料极其丰富,复习了一遍大停滞、大分流、大平衡、大逆转时代,并展望未来。 看完了有很多想法,随手写了下来,希望不是蹭热点。 &…

网易严选首页重构

目录 一、运行效果:很莫名其妙有的gif违规 二.项目设计技术以及所用库 三、源码 一、运行效果: 二.项目设计技术以及所用库 1.技术:HTMLCSSJavaScript 2.库:Swiper中文网-轮播图幻灯片js插件,H5页面前端开发 iconfont-阿里巴巴矢…

内啡肽和多巴胺真的是对立关系吗?如何正确戒瘾?

一、多巴胺 多巴胺是一种重要的神经递质,通常被称为“快乐分子”,它主要有 2 个作用: 它是一种“动机分子”。大脑中的多巴胺水平增加将使我们更有动力,大脑更加亢奋,更愿意采取行动以达成目标或满足需求,动…

ChatGPT 造富“神话”:大四学生放弃大厂去创业,半年后月收入45万

来源:InfoQ、整理:核子可乐、褚杏娟 面对铺天盖地的 OpenAI ChatGPT,有人走马观花,有人却利用它赚了不少。 有这样一个大学生,前脚还在 Meta 和 Tesla 等大厂实习,半年后,其创办的聊天机器人公司…

实战 ChatGPT 6 个月后月入 45 W,挂了两科!

以下内容来自公众号逆锋起笔,关注每日干货及时送达 整理 | 屠敏 出品 | CSDN(ID:CSDNnews) ChatGPT 浪潮来袭,大厂们正在紧锣密鼓地研发大模型,创业公司在垂直生态之下发力内容制作、工具等应用,不少一线开发者、爱好者则利用 AI …

OpenAI官方提示词课(一)书写提示词的基本原则

下面是调用openai的completion接口的函数。但在本文中并不是重点。了解一下就好。 import openai import osfrom dotenv import load_dotenv, find_dotenv _ load_dotenv(find_dotenv())openai.api_key os.getenv(OPENAI_API_KEY)def get_completion(prompt, model"gp…

美容行业的翻身仗:ChatGPT带你玩转营销活动

(今天给大家带来一个 用ChatGPT给美容院、美容店、美容行业的商家 出一个营销策划活动方案的实例) 在这个竞争激烈的美容行业,想要脱颖而出,你得有点与众不同的手段。别再拿那些陈词滥调的营销策略来忽悠我了,今天我要…