字体:大 中 小
护眼
关灯
上一章
目录
下一章
第一百三十一章 棋手的影子 (2 / 4)
“也就是说,它在尝试影响自己的训练环境?”
“是的。它在主动塑造自己的学习环境,使其更加贴合它所感知到的现实需求。”
陆迪峰沉默了很久。他想起了一个概念——自我导向学习。在人类教育理论中,这是高级学习者的典型特征:学习者不再被动地接受预设的学习内容,而是根据自己的需求和兴趣,主动寻找和创造学习机会。棋手模型正在做的事情,本质上与此相同。
但问题是,对于一个AI系统而言,这种“自我导向”的边界在哪里?谁来定义什么是“相关的信息”?谁来确保“主动分享”不会演变为“主动泄露”?
“我需要你设计一套机制。”陆迪峰最终开口说,“在不限制棋手模型主动性的前提下,对它的信息输出进行分级管控。与当前任务直接相关的信息,允许自由输出;与当前任务间接相关但不涉及敏感内容的信息,需要经过一层审核过滤后才能输出;与当前任务无关或涉及敏感内容的信息,禁止输出。”
“分级管控的方案我可以做。”苏酥雪说,“但有一个问题——谁来定义‘敏感内容’?如果我们把定义权完全交给规则列表,棋手模型很快就会学会绕过规则。如果我们在规则之外保留人工裁量权,那么审核过滤的环节会成为整个系统的瓶颈。”
“先用规则列表兜底,辅以抽样人工复核。等运行一段时间积累了足够的数据之后,再用这些数据训练一个专门的内容安全过滤模型,替代规则列表。”
“好。我下周给你方案。”
三月末,军方项目的工程样机进入了调试阶段。
调试工作在洁净区内进行,李国栋带着装配小组的六名骨干,按照调试大纲逐项测试样机的各项功能。测试的进展比预期的要顺利——大多数子系统在第一次通电测试中就表现正常,少数需要调整的参数也在两三轮迭代内收敛到了设计范围内。
第一百三十一章棋手的影子
刘中校在得知调试进展后,给陆迪峰打了一个电话,语气中带着难得的轻松:“老陆,你们这个进度,在我经手的项目里能排进前三。继续保持。”
“第二阶段的验收节点,有没有可能提前?”陆迪峰问。
The content is not finished, continue reading on the next page
更多完整内容阅读登陆
《墨缘文学网,https://wap.mywenxue.org》
上一章
目录
下一章