面壁智能发布 Eurux-8x22B 开源大模型:代码性能超越 Llama3-70B

5月3日讯 面壁智能发布开源大模型 Eurux-8x22B,包括 Eurux-8x22B-NCA 与 Eurux-8x22B-KTO,主打推理能力。

官方测试中,Eurux-8x22B 在 LeetCode(180 道 LeetCode 编程真题)与 TheoremQA (IT之家注:美国大学水准的 STEM 题目)测试超越了 Llama3-70B,在 LeetCode 测试上超越闭源的 GPT-3.5-Turbo。

面壁智能发布 Eurux-8x22B 开源大模型:代码性能超越 Llama3-70B

据介绍,Eurux-8x22B 模型激活参数 39B,支持 64k 上下文,是由 Mixtral-8x22B 模型对齐而来,在 UltraInteract 对齐数据集上训练而成。

面壁智能发布 Eurux-8x22B 开源大模型:代码性能超越 Llama3-70B

UltraInteract 是专门设计用于提升大模型推理能力的大规模、高质量的对齐数据集,包含了覆盖数学、代码和逻辑推理问题的 12 个开源数据集的 86K 条指令和 220K 偏好对,共有五十万条左右数据。

面壁智能发布 Eurux-8x22B 开源大模型:代码性能超越 Llama3-70B
面壁智能发布 Eurux-8x22B 开源大模型:代码性能超越 Llama3-70B
声明:魔果智讯倡导尊重与保护知识产权。如发现本站文章存在版权等问题,烦请30天内提供版权疑问、身份证明、版权证明、联系方式等发邮件至moguoai@yeah.net!我们将及时沟通与处理。
0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索