4月1日消息,澜舟科技正式宣布Mengzi3-13B开源!对学术研究完全开放,同时支持免费商用。
相较于今年1月发布的孟子大模型GPT V2系列(包括孟子大模型-标准、孟子大模型-轻量、孟子大模型-金融、孟子大模型-编码),Mengzi3-13B在数据集质量上有了显著的提升。其采用的Mengzi-3数据集规模高达3T tokens,涵盖了网页、代码、书籍、论文等多元化、高质量的数据来源。
在MMLU、Chinese-MMLU、GSM8K、HUMAN-EVAL等多项公开数据集进行的模型效果评估中,Mengzi3-13B均展现出了卓越的性能表现。在参数量20B以内的轻量化大模型领域,Mengzi3-13B在中英文语言能力方面的成绩尤为突出,具备了出色的实用性和高性价比,能更好的满足企业的商业化需求。
- 蜜度索骥:以跨模态检索技术助力“企宣”向上生长
- 网红偷税漏税事件上热搜,“收入超千万报税竟未达5000元”引发热议
- 美国最高法院计划于1月10日对TikTok禁令进行辩论
- 美国以国家安全为由调查路由器品牌TP-Link,后者回应:其安全实践符合行业标准
- 字节跳动自主研发AI GPU,旨在减少对英伟达依赖
- 消息称特斯拉上海工厂下月量产改款Model Y
- 苹果警告Meta互操作性请求过多,或威胁用户隐私安全
- 首个智能体安全生态协作组织成立:华为、荣耀、字节、蚂蚁等二十余家头部企业单位加入
- 刚果(金)指控苹果公司涉罪:供应链涉嫌使用“血矿”,法国比利时受理调查
- 我国两大科技企业连续遭受网络攻击,国家互联网应急中心成功侦破
- Netflix因未明确告知客户数据使用情况在荷兰被罚款475万欧元
免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,应及时向本网站提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明。本网站在收到上述法律文件后,将会依法尽快联系相关文章源头核实,沟通删除相关内容或断开相关链接。