“零一万物”宣布开源Yi-9B模型,号称同系列内代码、数学能力最强,能在消费级显卡上轻松部署

2025-02-11 来源|AI图库吧

AI奇点网3月7日报道丨3月6日晚间,李开复旗下的人工智能大模型创业公司“零一万物 01AI”发布消息称,对外开源 Yi-9B 模型,这款大模型的特点是综合数学能力突出,官方称其为 Yi 系列模型中的“理科状元”。

Yi-9B 是目前 Yi 系列模型中代码和数学能力最强的模型,实际参数为 8.8B,默认上下文长度为 4K tokens。

该模型是在 Yi-6B (使用了 3.1T tokens 训练)的基础上,使用了 0.8T tokens 进行继续训练,数据截至 2023 年 6 月。

据介绍,在综合能力方面(Mean-All),Yi-9B 的性能“在尺寸相近的开源模型中最好”,超越了 DeepSeek-Coder、DeepSeek-Math、Mistral-7B、SOLAR-10.7B 和 Gemma-7B。

代码能力方面(Mean-Code),Yi-9B 的性能仅次于 DeepSeek-Coder-7B,超越了 Yi-34B、SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在数学能力方面(Mean-Math),Yi-9B 的性能仅次于 DeepSeek-Math-7B,超越了 SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在常识和推理能力方面(Mean-Text),Yi-9B 的性能与 Mistral-7B、SOLAR-10.7B 和 Gemma-7B 不相上下。

官方更声称,Yi-9B(BF 16) 和其量化版 Yi-9B(Int8) 都能在消费级显卡上轻松部署,使用成本较低,开发者友好。

“零一万物”由李开复亲自带队创办,此前已推出 Yi-34B 和 Yi-6B 两个开源大模型,号称对学术研究完全开放,同步开放免费商用申请。

最新
更多

“零一万物”宣布开源Yi-9B模型,号称同系列内代码、数学能力最强,能在消费级显卡上轻松部署

“零一万物 01AI”发布消息称,对外开源 Yi-9B 模型,这款大模型的特点是综合数学能力突出,官方称其为 Yi 系列模型中的“理科状元”。

Stable Diffusion 3技术报告公开:基于Sora生成构架,开源图像模型有望超越Midjourney、DALL·E等闭源模型

Stability AI在发布了Stable Diffusion 3之后,公布了详细的技术报告。核心技术——改进版的Diffusion模型和一个基于DiT的文生图全新架构!

马斯克与奥特曼「八年的爱恨情仇」:从兄弟联手创办OpenAI,到理念不合、分道扬镳、相爱相杀、对薄公堂

马斯克与OpenAI、Altman之间,还有一些从未公开的秘密。他们之间究竟经历了什么?华尔街日报一篇长文,讲述了马斯克与Altman的「兄弟情谊」如何走向终结。

OpenAI完成奥特曼被罢免内部调查丨Midjourney将Stability AI拉黑丨马斯克:OpenAI更名CloseAI就撤诉

【AI奇点网2024年3月8日早报】本站每日播报AI业界最新资讯,触摸时代脉搏,掌握未来科技动向。事不宜迟,点击查看今日AI资讯早餐。

二月AI爆炸!除了SORA你还知道哪个AI工具?

二月份以来出了很多AI工具,除了sora,stability AI,stable video,还有很多大模型的新技术!

AI视频又炸了!照片+声音变视频,阿里emo让Sora女主唱歌小李子说rap

Sora之后,居然还有新的AI视频模型,能惊艳得大家狂转狂赞!这就是阿里最新推出的基于音频驱动的肖像视频生成框架,EMO(Emote Portrait Alive)。

网站地图