Meta 发布新 AI 模型:利用 AI 来评估 AI 的能力,无需人类参与
最新 10 月 19 日消息,据路透社报道,Meta 当地时间周五宣布,其研究团队推出了一系列新的 AI 模型,其中包括一个名为“自我训练评估器”的工具。该工具有望推动 AI 开发过程中减少对人类干预的依赖。这个工具早前在 8 月的论文中首次亮相,其使用与 OpenAI 新发布的 o1 模型类似的“思维链”技术,让 AI 对模型的输出做出可靠判断。
这种技术将复杂问题分解为多个逻辑步骤,从而提高了在科学、编程和数学等高难度领域中的答案准确性。Meta 的研究人员使用完全由 AI 生成的数据来训练这个评估器,从而在这一过程中完全摒弃了人类的参与。
使用 AI 来评估 AI 的能力展示了实现自主 AI 智能体的可能性,这类代理能够从自身错误中学习。两位负责该项目的 Meta 研究人员表示,许多 AI 专家设想未来可以开发出“智能化程度极高”的数字助手,可以自主处理大量任务,而无需人类介入。
自我改进的模型有望减少目前使用的“基于人类反馈的强化学习”(RLHF)过程的需求。这一过程往往昂贵且低效,因为它依赖于拥有专业知识的人类来标注数据和验证复杂问题的答案是否正确。
“我们希望,随着 AI 的发展,它能超越人类,逐渐具备自行检查工作的能力,并在准确性上超过普通人类水平,”项目研究员之一 Jason Weston 说。“自我训练和评估的能力是实现超人级 AI 的关键因素之一。”他补充道。
最新从报道中获悉,包括谷歌和 Anthropic 在内的其他科技公司也在研究 RLAIF(基于 AI 反馈的强化学习)这一概念,但与 Meta 不同,这些公司通常不会公开发布其研究模型。
Meta 此次发布的其他 AI 工具还包括对其图像识别模型“Segment Anything”的更新,一个加速大语言模型响应时间的工具,以及一些有助于发现新型无机材料的数据集。
相关文章
- AI 改变招聘方式:英国大学毕业生面临严峻就业竞争,用 AI
- 杭州中院公开审理 AI 数字人侵权案,百名国际专家旁听
- Meta 发布新 AI 模型:利用 AI 来评估 AI 的能力,无需人
- 谷歌 Gemini Code Assist Enterprise 正式上线,可根据
- 相关人士回应字节大模型遭实习生攻击:破坏训练属实,损失
- 微软开源 bitnet.cpp 1-bit LLM 推理框架:不靠 GPU 可
- 山姆・阿尔特曼眼球扫描加密项目推出 Orb 新品:在 AI
- 中国电信和移动发起、高通联发科等支持,GSMA 启动制定
- 人形机器人公司星动纪元完成近 3 亿元 Pre-A 轮融资:阿
- RTX 4090 笔记本 0.37 秒直出大片:英伟达联手 MIT 清华