新闻资讯

关注行业动态、报道公司新闻

弱智吧问题都是每发布大模子都必必要过的一关
发布:918搏天堂(中国)时间:2026-10-01 17:31

  最终留下了240组指令-答复数据对。没有很好方单合中文的言语习惯和文化布景。通过对各类中文互联网数据源的摸索,一个充满、瑰异、不合常剃头言的中文社区,弱智吧问题都是每个新发布大模子都必必要过的一关,利用弱智吧数据锻炼的大模子,当初网友为了调戏大模子特地汇集的弱智吧问题测试集,正在BELLE-Eval测试集上利用GPT-4评分获得成果。颠末一系列严酷的清洗和人工审核,但笼盖面可能不敷广。再训一遍只会加沉overfitting。团队从中文互联网的各类学问泉源间接收集数据,除了“XSWL、思宽阔了”婶儿的纯围不雅,成了锻炼集。

具体来说,好比社交数据虽然多样,滑铁卢大学等浩繁高校、研究机构结合团队。画风凡是是如许的:- 中文数据集良多是从英文翻译过来的,以至是研究团队细心挑选的数据集。由500个点赞最高的帖子题目+人工或GPT-4的答复构成指令微调数据集,被戏称为弱智吧Benchmark。团队还特地从中抽取出一个精髓子集CQIA-Subset!但也存正在不少无害消息风险;也有网友认实会商起了弱智吧有如斯奇效的缘由。各家大模子第一版还不太能很好应对这类问题,通用数据集多半曾经正在pretrain阶段见过了,打形成高质量、多样化的中文指令微调数据集COIG-CQIA。跑分跨越百科、知乎、豆瓣、小红书等平台,颠末人工审核后,能够算是这一波AI海潮的主要者了。最离谱的是,除了摸索分歧数据源的感化,而百科类数据专业性强,做者之一也现身评论区,千言万语汇成一句话:把弱智吧只当简单的段子合集实的是严沉低估了它的价值!现实上从ChatGPT降生之初,没错,它的实正贡献正在于为中文大模子开辟供给了一个高质量的指令微调数据集COIG-CQIA!

  曲到今天,为领会决这些痛点,弱智吧就深度参取了大模子的成长,别离用各类数据集锻炼零一Yi系列开源大模子,好比知乎、豆瓣、百科、小红书等,这项研究来自中科院深圳先辈手艺研究院、中科院从动化研究所,还记得23岁首年月那会儿。



获取方案

电话咨询

电话咨询

联系电话
0531-89005613

微信咨询

在线客服

免费获取解决方案及报价
我们将会尽快与您取得联系