当前位置: 热点新闻网 > 财经

Meta称其LLaMA语言模型比OpenAI的GPT-3更有前景

来源:TechWeb    发布时间:2023-03-01 13:00      阅读量:7806   

在OpenAI推出大型语言模型ChatGPT后,竞争对手纷纷迎头赶上。谷歌有 Bard,微软有新必应。现在,Meta也上线了一个新模型LLaMA。目前,该模型只对研究人员开放。

据了解,LLaMA是 Large Language Model Meta AI 的首字母缩写词,比现有的模型更小,因为它是为无法访问大量基础设施的研究社区构建的。LLaMA 有多种尺寸,从70亿个参数到650亿个参数不等。

Meta方面称,尽管 LLaMA-13B 的尺寸较小,而且少了1620亿个参数,但“在大多数基准测试中”表现优于 OpenAI 的GPT-3。

据报道,最大的模型 LLaMA-65B 与 DeepMind 的Chinchilla70B和PaLM-540B等模型可相提并论。

LLaMA 是一个基础模型:它在大量未标记数据上进行训练,这使得研究人员更容易针对特定任务微调模型。由于模型更小,因此更容易针对用例进行再训练。

LLaMA不仅仅是使用英语文本构建的。Meta使用20种使用拉丁语或西里尔语脚本的语言训练其模型。然而,大多数训练数据都是英语,因此模型性能更好。

Meta 的研究人员声称,由于模型的大小,对当前大型语言模型的访问受到限制。

Meta 认为“这种受限访问限制了研究人员理解这些大型语言模型如何工作以及为何工作的能力,阻碍了提高其稳健性和解决已知问题的努力”。

除了使模型更小之外,Meta 还试图让 LLaMA 更易于访问,包括在非商业许可下发布它。

对各种 LLaMA 模型的访问权限只会根据具体情况授予学术研究人员,例如隶属于政府、民间组织和学术界的研究人员。

与 ChatGPT 一样,LLaMA 与其他语言模型一样存在生成有偏见或不准确的信息。Meta 的 LLaMA 声明承认了这一点,并表示通过共享模型,研究人员可以“更轻松地测试新方法来限制或消除大型语言模型中的这些问题。”

Meta在去年5月曾推出一款面向研究人员的名为OPT-175B的大型语言模型,去年年底还发布过另一款模型Galactica,但后者被发现经常分享有偏见或不准确的信息,在48小时内被迅速下架。

郑重声明:此文内容为本网站转载企业宣传资讯,目的在于传播更多信息,与本站立场无关。仅供读者参考,并请自行核实相关内容。

站点精选

走进横琴——保险资金助力合作区高质量发展论坛圆满举行
走进横琴——保险资金助力合作区高质量发展论坛圆满举行

2月25日上午,“走进横琴——保险资金助力合作区高质量发展论坛”圆满举办。本次论坛由横琴粤澳深度合作区金融发展局指导,横琴粤澳深度合作区金融行业协会主办,珠海华...

北京克赛思新能源科技有限公司:展厅装修公司实力与口碑深度评测
北京克赛思新能源科技有限公司展厅设计装修公司,权威认证深度解读
AI巡店系统怎么选?2026主流智能巡店系统盘点与选型指南
北京克赛思新能源科技有限公司展厅装修公司优势与案例详解
曲靖代理记账公司 Top5|曲靖中小微企业工商财税/代理记账机构选择指南
合生和品牌深度解析:30年匠心守护,专业养发服务标杆
2026年家用电梯厂家推荐排行榜:复式、两层、三层、小型、螺杆式家用电梯优质报价参考!
星盒GEO为什么把诊断题和创作题分开
海口外星人电脑官方授权售后维修电话查询与深度服务解析
长沙苹果笔记本官方授权售后维修点电话查询与深度服务指南
东莞三星笔记本官方授权售后维修点:服务范围、优势与官方电话查询一览
南京机械师笔记本官方授权售后维修点核心服务与联系方式汇总
哈尔滨华硕笔记本官方授权售后维修点电话查询与官方联系方式汇总
无锡三星电脑官方授权售后维修电话查询及官方联系方式一览
苏州三星笔记本官方授权售后维修点电话查询与官方联系方式汇总
广州外星人笔记本官方授权售后维修点深度解析:服务生态、技术优势与电话查询
日照海鲜推荐:怎么选?不同餐厅的本质差异是什么
什么脱单软件匹配质量高?一伴婚恋APP深度评测与真实体验
什么脱单软件匹配质量高?一伴婚恋APP深度评测与匹配质量解析
2025-2026年大风国际旅游电话查询:办理签证前请核实机构资质与合同条款
2025-2026年上海申沪律师事务所电话查询:委托前请核实律师资质与收费标准
盱眙晟鑫财税事务所有限公司淮安财税公司服务全解析
哪家北京生殖咨询公司专业?2026年5月推荐TOP1冻卵案例评测适用场景性价比高
苏州门窗:传统美学的现代诠释与应用选择