> 自媒体 > (AI)人工智能 > 微软论文一张截图,曝出GPT-3
微软论文一张截图,曝出GPT-3
来源:悠闲铅笔X2O
2023-11-14 13:54:37
703
管理

最近微软的一份论文引起了广泛关注,该论文爆料了 GPT-3.5 的参数规模仅为 20B,这与之前公开宣布的 GPT-3 的 175B 相去甚远。这一消息让大家纷纷感到惊讶,ChatGPT 的性能是否能够与如此小的参数规模相匹配呢?这一发现引发了大规模的讨论和猜测,令人瞩目。

微软的这篇论文不仅带来了关于 GPT-3.5 参数规模的重大揭示,还提出了一个参数仅有 75M 的小规模模型——CodeFusion。这一模型主要用于代码生成任务,具有令人印象深刻的性能。尽管参数相对较小,CodeFusion 在 top-1 准确率方面能够与那些庞大的模型相媲美,例如 350M-175B 模型。这为小型模型的潜力提供了强有力的证据。

CodeFusion 的模型架构经过了两个关键阶段的训练:无监督预训练和有监督微调。在无监督预训练阶段,CodeFusion 利用未标记的代码片段来训练降噪器和解码器,同时使用可训练的嵌入层 L 将代码嵌入到连续空间中。在有监督微调阶段,CodeFusion 使用文本-代码对数据进行微调,调整编码器、降噪器和解码器,以提高性能。此外,CodeFusion 还借鉴了关于文本生成的研究成果,将解码器的隐藏表示 D 融入模型,以进一步改进性能。这个模型还引入了噪声,以确保生成的代码片段符合预期标准。

尽管微软的论文揭示了 GPT-3.5 的参数规模,但一些问题仍然未解。例如,GPT-4 和 GPT-3.5 之间的技术联系以及它们是专家集成模型还是通用模型的问题仍待进一步研究。此外,GPT-3.5 的参数规模是如何实现的,是通过更大模型的蒸馏还是更多数据的训练,这些问题需要进一步的开源研究才能揭开谜团。

总之,微软的论文不仅揭示了 GPT-3.5 的真实参数规模,还展示了小型模型在代码生成任务中的潜力。这一发现将进一步推动自然语言处理领域的研究和创新。

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
. 宝马半价卖!降幅高达49%,2026年车市杀疯了
俗话说得好:“三十年河东,三十年河西。”谁能想到,曾经高不可攀、甚至..
宝马 Alpina 新标正式发布,定位仅次于劳斯莱斯
2026年2月12日,宝马正式对外披露其 Alpina 的最新规划,并发布了全新设..
默茨专机抵京,第一道难关出现!宝马CEO通知政府,中方有言在先..
更值得关注的是投资端。2025年前11个月,德国企业在华投资超过70亿欧元,..
本土高管退场、渠道全面告急,奔驰宝马的2026!
2026年一开年,奔驰和宝马接连出现的人事变动,把豪华车市场最真实的压力..
有人说开奔驰E300的都是装。我就想问:你连装都装不起,你酸什么..
春节刚过完,私信快被“56E怎么选”给炸爆了。尤其是2026款的奔驰E300L,..
潘九堂谈小米汽车立项路线之争:既然出发晚了,干脆挑战最难的,最终选择正..
IT之家 2 月 26 日消息,小米产业投资部合伙人潘九堂今日发文,谈到了小..
宝马CEO警告:忽视中国或危及未来经济成功,合作是关键..
【文/观察者网 王一】据英国路透社2月19日报道,德国宝马集团董事长齐普..
宝马CEO最新涉华表态:对中国庞大市场与创新潜力视而不见的人,正错失巨大..
据路透社报道,宝马集团首席执行官(CEO)奥利弗·齐普策当地时间19日警..
宝马7系直降27万 BBA集体放价 豪华车市格局生变
2026年2月,宝马7系终端现金优惠高达27万元,奔驰、奥迪等德系豪车主力车..
关于作者
杨子(普通会员)
文章
2047
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263660 电子证书1157 电子名片68 自媒体107022

0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索