李开复旗下AI公司零一万物宣布开源Yi-9B模型_机能_模子
该模型是在 Yi-6B (利用了 3.1T tokens 演习)的根本上,利用了 0.8T tokens 进行连续演习,数据截至 2023 年 6 月。
据先容,在综合能力方面(Mean-All),Yi-9B 的性能“在尺寸附近的开源模型中最好”,超越了 DeepSeek-Coder、DeepSeek-Math、Mistral-7B、SOLAR-10.7B 和 Gemma-7B。
代码能力方面(Mean-Code),Yi-9B 的性能仅次于 DeepSeek-Coder-7B,超越了 Yi-34B、SOLAR-10.7B、Mistral-7B 和 Gemma-7B。
在数学能力方面(Mean-Math),Yi-9B 的性能仅次于 DeepSeek-Math-7B,超越了 SOLAR-10.7B、Mistral-7B 和 Gemma-7B。
在知识和推理能力方面(Mean-Text),Yi-9B 的性能与 Mistral-7B、SOLAR-10.7B 和 Gemma-7B 不相上下。
官方更称,Yi-9B(BF 16) 和其量化版 Yi-9B(Int8)都能在消费级显卡上轻松支配,利用本钱较低,开拓者友好。
据IT之家此前宣布,该公司由李开复创新工场董事长兼 CEO 带队创办,此前已已推出 Yi-34B 和 Yi-6B 两个开源大模型,号称对学术研究完备开放,同步开放免费商用申请。
本文系作者个人观点,不代表本站立场,转载请注明出处!