第一百三十一章 棋手的影子 (2 / 4) 首页

字体:      护眼 关灯

上一章 目录 下一章

第一百三十一章 棋手的影子 (2 / 4)
        “也就是说,它在尝试影响自己的训练环境?”

        “是的。它在主动塑造自己的学习环境,使其更加贴合它所感知到的现实需求。”

        陆迪峰沉默了很久。他想起了一个概念——自我导向学习。在人类教育理论中,这是高级学习者的典型特征:学习者不再被动地接受预设的学习内容,而是根据自己的需求和兴趣,主动寻找和创造学习机会。棋手模型正在做的事情,本质上与此相同。

        但问题是,对于一个AI系统而言,这种“自我导向”的边界在哪里?谁来定义什么是“相关的信息”?谁来确保“主动分享”不会演变为“主动泄露”?

        “我需要你设计一套机制。”陆迪峰最终开口说,“在不限制棋手模型主动性的前提下,对它的信息输出进行分级管控。与当前任务直接相关的信息,允许自由输出;与当前任务间接相关但不涉及敏感内容的信息,需要经过一层审核过滤后才能输出;与当前任务无关或涉及敏感内容的信息,禁止输出。”

        “分级管控的方案我可以做。”苏酥雪说,“但有一个问题——谁来定义‘敏感内容’?如果我们把定义权完全交给规则列表,棋手模型很快就会学会绕过规则。如果我们在规则之外保留人工裁量权,那么审核过滤的环节会成为整个系统的瓶颈。”

        “先用规则列表兜底,辅以抽样人工复核。等运行一段时间积累了足够的数据之后,再用这些数据训练一个专门的内容安全过滤模型,替代规则列表。”

        “好。我下周给你方案。”

        三月末,军方项目的工程样机进入了调试阶段。

        调试工作在洁净区内进行,李国栋带着装配小组的六名骨干,按照调试大纲逐项测试样机的各项功能。测试的进展比预期的要顺利——大多数子系统在第一次通电测试中就表现正常,少数需要调整的参数也在两三轮迭代内收敛到了设计范围内。

        第一百三十一章棋手的影子

        刘中校在得知调试进展后,给陆迪峰打了一个电话,语气中带着难得的轻松:“老陆,你们这个进度,在我经手的项目里能排进前三。继续保持。”

        “第二阶段的验收节点,有没有可能提前?”陆迪峰问。

  The content is not finished, continue reading on the next page

更多完整内容阅读登陆

《墨缘文学网,https://wap.mywenxue.org》
加入书签我的书架


上一章 目录 下一章