马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理128k上下文

2025-02-05 来源|AI图库吧

3 月 29 日消息,马斯克旗下人工智能公司 xAI 今天在官方博客中宣布,正式推出 Grok-1.5 大语言模型。

Grok-1.5 具有改进的推理能力和 128k 的上下文长度,其中最显著的改进之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 ? 平台上向早期测试人员和现有的 Grok 用户推出。

在官方测试中,Grok-1.5 在 MATH 基准上取得了 50.6% 的成绩,在 GSM8K 基准上取得了 90% 的成绩,这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外,它在评估代码生成和解决问题能力的 HumanEval 基准测试中得分为 74.1%。IT之家附测试对比表如下:

长上下文理解方面,Grok-1.5 能够在其上下文窗口内处理多达 128k tokens 的长上下文。这使得 Grok 的内存容量增加到之前上下文长度的 16 倍,从而能够理解更长文档中的信息。

据介绍,Grok-1.5 构建在基于 JAX、Rust 和 Kubernetes 的自定义分布式训练框架之上。自定义训练协调器可确保自动检测到有问题的节点并将其从训练作业中剔除。xAI 还优化了检查点、数据加载和训练作业重新启动,以最大限度地减少发生故障时的停机时间。

最新
更多

马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理128k上下文

3 月 29 日消息,马斯克旗下人工智能公司 xAI 今天在官方博客中宣布,正式推出 Grok-1 5 大语言模型。

马斯克旗下xAI发布Grok-1.5大模型丨OpenAI推出人声音频生成模型丨360开源360智脑70亿参数模型

【AI奇点网2024年4月1日早报】本站每日播报AI业界最新资讯,触摸时代脉搏,掌握未来科技动向。事不宜迟,点击查看今日AI资讯早餐。

ChatGPT今起无需注册就可直接使用丨DALL·E加入图像可编辑功能丨马斯克:人工智能有20%几率毁灭人类

【AI奇点网2024年4月2日早报】本站每日播报AI业界最新资讯,触摸时代脉搏,掌握未来科技动向。事不宜迟,点击查看今日AI资讯早餐。

谷歌:8GB内存的Pixel 8手机将无缘运行端侧的AI大模型Gemini Nano

日前,谷歌公司针对旗下的手机端侧大模型Gemini Nano发布了一个特殊的声明:声称旗下Pixel系列手机里边,只有?Pixel 8 Pro能够运行Gemini。

算力不足GPT-5新模型上线恐延期:微软 & OpenAI秘密投资1000亿美元打造AI超级计算机

外媒The Information的披露,微软和OpenAI的一项秘密AI投资计划被外媒曝光:双方计划斥资1000亿美元打造一款海量算力集群构建的AI超级计算机。

国产AI创业公司Kimi Chat凭200万字上下文窗口「长文本」大火,但前景可能跟淄博相似

Kimi太火了…2024年第一个真正走红的国产大模型。互联网上,随处可见Kimi打出的广告贴。这是AI浪潮中,国内创业公司第一次真正“破圈”。

网站地图