马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

2 months ago

source link: https://cn.technode.com/post/2024-03-29/musk-xai-grok-1-5/
Go to the source link to view the article. You can view the picture content, updated content and better typesetting reading experience. If the link is broken, please click the button below to view the snapshot at that time.

马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

2024/03/29 15:17

|In 消费科技

|By Steven Lee

马斯克旗下人工智能公司 xAI 今天在官方博客中宣布，正式推出 Grok-1.5 大语言模型。

Grok-1.5 具有改进的推理能力和 128k 的上下文长度，其中最显著的改进之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 𝕏 平台上向早期测试人员和现有的 Grok 用户推出。

在官方测试中，Grok-1.5 在 MATH 基准上取得了 50.6% 的成绩，在 GSM8K 基准上取得了 90% 的成绩，这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外，它在评估代码生成和解决问题能力的 HumanEval 基准测试中得分为 74.1%。IT之家附测试对比表如下：

长上下文理解方面，Grok-1.5 能够在其上下文窗口内处理多达 128k tokens 的长上下文。这使得 Grok 的内存容量增加到之前上下文长度的 16 倍，从而能够理解更长文档中的信息。

据介绍，Grok-1.5 构建在基于 JAX、Rust 和 Kubernetes 的自定义分布式训练框架之上。自定义训练协调器可确保自动检测到有问题的节点并将其从训练作业中剔除。xAI 还优化了检查点、数据加载和训练作业重新启动，以最大限度地减少发生故障时的停机时间。

Recommend

马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

Recommend

kb4520010安装失败如何解决

2024 年手游市场报告：全球手游内购收入下降 2% 至 540 亿美元，休闲手游收入逆势增长...

美股AI没赶上？大摩提供新思路：买电力股啊

Synopsys 同意出售应用安全部门，价值 5.25 亿美元

An Overview of Survey Sampling Strategies

SE Radio 609: Hyrum Wright on Software Engineering at Google

Apple notifies winners of 2024 Swift Student Challenge; gives them AirPods Max

荣耀Magic6 至臻版体验：冲击高端，不止有「传奇皮肤」

Cloud data privacy solutions provider Skyflow raises $30M to enhance data privac...

瑞士医疗科技公司Terapet开发用于核医学成像的新型伽马射线检测系统，实时监测并精准...

About Joyk