据 The Decoder 报道,艾伦人工智能研究所(Allen Institute for AI,简称 AI2)发布包含各种网络内容、科学出版物、代码和书籍的三万亿个 token 的开源数据集 Dolma,是迄今为止最大的公开数据集。Dolma 是开放语言模型 (OLMo) 的基础。OLMo 是 AI2 目前正在开发的语言模型,计划于 2024 年初发布,目标是成为“最佳开放语言模型”。Dolma 的第一个版本主要限于英文文本,开发人员和研究人员现可以通过 Hugging Face 访问该数据集。
Gate.io - 芝麻交易所,又称芝麻开门交易所,是原比特儿交易所国际版本,是全球第二大交易所 支持人民币OTC交易 让财富更自由一点
文章采集自互联网,本站不对其真实性负责,如需删除,请发送链接至oem1012@qq.com
发表评论
电子邮件地址不会被公开。 必填项已用*标注
文章评论已关闭!