行业动态 | 马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理 128k 上下文_社会热点_资讯

行业动态 | 马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理 128k 上下文

2024-03-31 14:54 浏览:9

马斯克旗下人工智能公司 xAI 今天在官方博客中宣布，正式推出 Grok-1.5 大语言模型。

Grok-1.5 具有改进的推理能力和 128k 的上下文长度，其中最显著的改进之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 ? 平台上向早期测试人员和现有的 Grok 用户推出。

在官方测试中，Grok-1.5 在 MATH 基准上取得了 50.6% 的成绩，在 GSM8K 基准上取得了 90% 的成绩，这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外，它在评估代码生成和解决问题能力的 HumanEval 基准测试中得分为 74.1%。IT之家附测试对比表如下：

长上下文理解方面，Grok-1.5 能够在其上下文窗口内处理多达 128k tokens 的长上下文。这使得 Grok 的内存容量增加到之前上下文长度的 16 倍，从而能够理解更长文档中的信息。

据介绍，Grok-1.5 构建在基于 JAX、Rust 和 Kubernetes 的自定义分布式训练框架之上。自定义训练协调器可确保自动检测到有问题的节点并将其从训练作业中剔除。xAI 还优化了检查点、数据加载和训练作业重新启动，以最大限度地减少发生故障时的停机时间。

声明：本公众号转载此文章是出于传播行业资讯、洞见之目的，如有侵犯到您的合法权益，请致信：532541801@qq.com，我们将及时调整处理。谢谢支持！

【语言服务行业】分享群

群内会定期推送语言服务行业最新动态、活动预告、竞赛通知?等内容~

欢迎你的加入?！

-END-

本文转载自：北京中科大数据研究院

转载编辑：Pickey

关注我们，获取更多资讯！

往期回顾

行业动态

1. 年度回顾 | 中国翻译协会2023年大事记

行业洞见

行业技术

精品课程

资源干货

招聘就业

1. 译者招募丨英译中，经济学（有署名）