上海数交所7日正式上线语料库 近30个语料数据产品挂牌
(资料图)
2023世界人工智能大会期间,由上海数据交易所、大数据流通与交易技术国家工程实验室承办的“大模型时代下的数据要素流通”主题论坛7月8日在上海世博中心举行。记者从论坛上获悉,上海数交所官网已经于7月7日正式上线语料库,累计挂牌近30个语料数据产品,包含文本、音频、图像等多模态,覆盖金融、交通运输和医疗等领域。
据悉,语料库建设是一件长期性、专业性的工作,需要遵循相应的质量标准和规范,并保持持续更新和扩充,以适应大模型发展的新需求和新挑战。上海数交所作为全国数据要素市场核心枢纽,在助力大模型语料库建设上具有天然的优势。
为更好打造高质量语料库、围绕语料数据共建数商生态,上海数交所牵头发起语料数据生态创新合作伙伴计划,携手首批合作伙伴上海人工智能实验室、商汤科技、中国知网、澜舟科技、OpenKG、拓尔思、新致和蜜度正式启动该计划,积极引导不同行业、不同领域、具有一定规模的高质量语料数据产品挂牌交易,推动人工智能大模型技术创新与应用落地,进一步丰富语料库多样性,助力数据要素市场建设。
上海数交所总经理汤奇峰表示,大模型建设中,语料库是一个非常重要的方向,语料库采购已经在不少大模型企业成本中占据重要比重,上海数交所希望以市场配置的方式组织数据要素推动语料库建设。上海数交所建设语料库主要考虑两个维度,一是语料库的质量,另一个是语料库的开放程度。“比如有的企业具有海量高质量数据资源,开放意愿度也很高,但需要组织大量社会第三方企业帮助组织相关的大模型训练,我们针对四类数据产品开发情况不同、实际需求不同的供方企业制定了差异化工作策略,着力打造语料数据生态。”
(文章来源:上海证券报·中国证券网)
关键词:
上一篇:吉林省东辽县发布暴雨黄色预警
下一篇:最后一页
- 上海数交所7日正式上线语料库 近30个语料数据产品挂牌
- 吉林省东辽县发布暴雨黄色预警
- 9.51.2 米!珠峰积雪厚度最新数据远超以往报道
- 18次出手全队最高,却只命中5球,小杜兰特注定要成为悲剧人物?
- 李梦WNBA回归首秀:替补出战24分钟 三分5投2中拿到9分 正负值+12
- 马斯克回应垄断火箭发射市场:SpaceX的使命是让生命多行星化
- 这个“临时课堂”直抵人心 “双百大篷车”开进工地现场
- 最新!录取分数线公布!
-
液态Na-K解决钠电池阻抗
钠离子电池是一种新型的二次电池,其具备较高的理论能量密度、以及低成
-
南通市海门区供电公司:把“窗口”延伸到“村口”
“以前交电费要到镇上去,像这么热的天我都怕得很,现在好了,到村里来
-
机构:上半年30城租赁价格环比上涨,成都、长沙等租金回升
7月7日,58安居客研究院发布《2023年上半年全国租赁市场报告》(简称“
-
啤酒知道我太多心事。
温馨提示小酌怡情,适度饮酒策划Kitty编辑Acher音乐kidult -AdviceFromACater
X 关闭
X 关闭