日夜间 随系统 浅色 深色
主题色 黑色
IT之家 7 月 11 日消息,科技媒体 The Decoder 昨日(7 月 10 日)发布博文,报道称 GPT-5.6 Sol 可自主后训练较小的 Luna 模型, 并在聚合 RSI 指数上比 GPT-5.5 高 16.2 个百分点。
IT之家注:后训练是指模型完成初始预训练后,围绕特定任务、行为或能力继续调整参数与配置的过程。
OpenAI 研究员 Kathy Shi 在演讲中指出,后训练通常情况下由高级研究团队负责,而 GPT-5.6 Sol 可充当“自动化研究员”的角色,以基于自身后训练路径和配置为基础,为 Luna 模型适配完整的后训练方案。
OpenAI 称,为直接衡量此类能力,公司建立了基于真实 AI 研究任务的内部评估套件“聚合 RSI”,任务包括调试研究系统、优化 kernel 和训练方案、运行机器学习实验,以及改进另一模型。官方表示相关 GPT-5.5 模型,GPT-5.6 Sol 模型高出 16.2 个百分点。
OpenAI 还称,研究人员在整个开发周期都会使用 GPT-5.6 Sol,包括调试、优化训练系统、运行实验和阅读结果(OpenAI)。在内部测试中,活跃研究员人均日 token 产出较 GPT-5.5 上一轮峰值翻倍以上,单个研究员的 pull request 和实验数量也上升。
广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。
相关文章
软媒旗下网站: IT之家 最会买 - 返利返现优惠券 iPhone之家 Win7之家 Win10之家 Win11之家
软媒旗下软件: 软媒手机APP应用 魔方 最会买 要知