中国移动、电子标准院及 16 家重点央企发布《通用大模型评测标准》
2024-10-13 07:29:24人工智能 IT之家 清源
在今天召开的2024中国移动全球合作伙伴大会期间,中国移动联合电子标准院及16家重点央企共同开展大模型评测体系建设工作,并发布《通用大模型评测标准》。
感谢最新网友 软媒新友1943660 的线索投递!
最新 10 月 12 日消息,最新从中国移动官方获悉,在今天召开的 2024 中国移动全球合作伙伴大会期间,中国移动联合电子标准院及 16 家重点央企共同开展大模型评测体系建设工作,并发布《通用大模型评测标准》。
据介绍,该标准是大模型评测体系建设的重要成果,为产业界遴选优质大模型提供重要参考依据。第一阶段将围绕通用领域和 4 个重点行业领域,从评测标准制定、评测基地建设、评测试点应用等方面开展工作。
通用大模型评测标准基于“2-4-6”框架如下:
“2”:两类评测视角,以重点行业实际使用需求为导向,与国标对模型能力要求拉齐,将评测任务划分为理解和生成两类视角。
“4”:四类评测要素,从评测全生命周期中提取出评测工具、评测数据、评测方式和评测指标四类关键要素,确保评测工作可实施性。
“6”:六大评测维度,综合考虑大模型应用过程中的核心能力,设定功能性、准确性、可靠性、安全性、交互性和应用性六大维度。
赞一个! ()
相关文章
- OpenAI 推出 meta-prompt 工具,AI 时代让你掌握提示词
- 首个 AI Kaggle 特级大师诞生,OpenAI 的 o1-preview 夺
- 中国移动发布九天善智多模态基座大模型及 30+ 款自研
- 中国移动、电子标准院及 16 家重点央企发布《通用大模
- 李开复:零一万物没有放弃预训练模型,新模型也即将推出
- Swarm 框架登场:OpenAI 第 3 阶段“敲门砖”,让专业的事
- 上海国投牵头,米哈游、商汤科技、哔哩哔哩等公司共同设
- 开发者成功让 AI 学会打游戏,但用 RTX 3090 神经网络运
- DrunkSense 突破性 AI 车载酒后驾驶监测技术登场:准确
- 亚马逊 AI 版图新变数,15 年老将 Matt Wood 官宣离职