社会热点
行业动态 | 马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理 128k 上下文
2024-03-31 14:54  浏览:9

马斯克旗下人工智能公司 xAI 今天在官方博客中宣布,正式推出 Grok-1.5 大语言模型。

Grok-1.5 具有改进的推理能力和 128k 的上下文长度,其中最显著的改进之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 ? 平台上向早期测试人员和现有的 Grok 用户推出。

在官方测试中,Grok-1.5 在 MATH 基准上取得了 50.6% 的成绩,在 GSM8K 基准上取得了 90% 的成绩,这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外,它在评估代码生成和解决问题能力的 HumanEval 基准测试中得分为 74.1%。IT之家附测试对比表如下:

长上下文理解方面,Grok-1.5 能够在其上下文窗口内处理多达 128k tokens 的长上下文。这使得 Grok 的内存容量增加到之前上下文长度的 16 倍,从而能够理解更长文档中的信息。

据介绍,Grok-1.5 构建在基于 JAX、Rust 和 Kubernetes 的自定义分布式训练框架之上。自定义训练协调器可确保自动检测到有问题的节点并将其从训练作业中剔除。xAI 还优化了检查点、数据加载和训练作业重新启动,以最大限度地减少发生故障时的停机时间。

声明:本公众号转载此文章是出于传播行业资讯、洞见之目的,如有侵犯到您的合法权益,请致信:532541801@qq.com,我们将及时调整处理。谢谢支持!
【语言服务行业】分享群

群内会定期推送语言服务行业最新动态、活动预告、竞赛通知?等内容~

欢迎你的加入?!

-END-
本文转载自:北京中科大数据研究院
转载编辑:Pickey
关注我们,获取更多资讯!

往期回顾

行业动态
1. 年度回顾 | 中国翻译协会2023年大事记
2. 行业资讯 | 新增山东省高校!已有19所高校申请翻译博士专业学位
3. 行业动态 | 中国翻译协会医学翻译委员会2024年第一次主任会议在京召开
4. 行业资讯 | “新汉学计划”欢迎加入!2024年外语翻译硕士培养项目开始招生
5. 行业动态 | “人工智能+”首次写入《政府工作报告》,大模型如何助力产业创新?
行业洞见
  1. 行业洞见 | 《翻译技术研究》作者王华树教授
  2. 行业洞见 | 为腾飞助力:AI 如何为翻译引擎增加动力
  3. 行业观察 | 人工智能教父谈人工智能的影响和潜力
  4. 行业观察 | 奥特曼专访:关于 GPT-5、Sora、Ilya、Q*、AGI、外星人等等一切
行业技术
  1. 行业技术 | 带你了解大语言模型的前世今生
  2. 技术应用|Mac和Win如何协作制作双语平行语料库?
  3. 技术应用 | 翻译实践中术语库的应用
  4. 技术应用 | 术语库创建与应用
  5. 技术应用 | 7个技巧让你成为谷歌Gemini专家
精品课程
  1. 宝藏课程 | 大语言模型辅助外语教学研修班
  2. 崔启亮老师:GenAI时代的语言服务行业实践与研究专题课
  3. 明晚7点 | 生成式AI时代的语言服务【公益沙龙】
资源干货
  1. 技术科普 | 揭开手写文本识别“最先进”的秘密
  2. 资源干货 | 英语外刊获取途径、网站推荐
  3. ChatGPT | AI外语写作助手,助力高效写作
  4. 双语干货 | 谢锋大使向中美媒体发表讲话
  5. 资源宝库|译者用“典”,多多益善——精选31款在线词典
招聘就业
1. 译者招募丨英译中,经济学(有署名)
2招聘快报 | CNBC财经电视台上海分公司招聘发行部助理实习生
发表评论
0评