首页 资讯 财经 汽车 关注 科技 房产 图片 全国 视频

数据

旗下栏目: 业内 数据 数码 手机

确保网络数据安全 应对新一代人工智能治理挑战

来源:新闻门户     作者:华夏门户     浏览:次     发布时间:2023-08-07
摘要:ChatGPT 的爆火在全球社会引发了一场研发大规模语言模型的热潮。以生成式人工智能为代表的新一代人工智能不仅革命……

ChatGPT 的爆火在全球社会引发了一场研发大规模语言模型的热潮。以生成式人工智能为代表的新一代人工智能不仅革命性地改变了人机交互的形式,提升了人机交互的体验效果,还对人工智能产业产生了深刻影响,加速了人工智能大模型技术的发展与进步,带来了全新的发展机遇。同时,该技术的快速发展也带来了一系列新问题与挑战,包括数据安全、内容安全、社会安全甚至国家安全。基于此,各国纷纷开始推进生成式人工智能的治理进程。鉴于数据是人工智能发展的关键基础,数据安全又是人工智能内生安全的重要组成部分,确保网络数据安全是应对新一代人工智能治理挑战的关键。第二十届中央国家安全委员会第一次会议也着重强调要提升网络数据人工智能安全治理水平,确保以新安全格局保障人工智能创新与应用带来的新发展格局。

一、生成式人工智能安全问题亟待予以高度重视

随着大模型技术水平不断提高以及大模型用户数量日益增多,其安全性问题也变得越来越严重。尽管与所有人工智能模型一样,生成式人工智能模型也会犯错误,但是这些错误回答往往具有欺骗性的说服力,生动且真实,并且具有拟人化的特点。例如,当使用者要求其援引某篇名著中的内容时,ChatGPT 可能会给一个有理有据,但实际上并不属于该书内容的答案。因此,随着生成式人工智能技术的持续更新与完善,人类可能会越来越难以识别由大模型生成的具有误导性的文本、图像以及视频等虚假内容的传播。

由于大模型具备很强的数据记忆能力,即便用户没有直接输入关键信息,大模型仍然可以通过算法抽取出重要数据,从而造成个人隐私信息外泄、敏感数据外流等隐患。例如,当员工将公司信息以提问的方式输入 ChatGPT 后(如使用 ChatGPT 将会议录屏内容整理成为文字),可能会导致相关内容进入其学习数据库,从而造成数据泄露的风险。美国数据分析服务商 Cyberhaven 在其官网上披露了关于公司员工使用 ChatGPT 会给公司造成何种安全性风险的研究结果。该厂商分析自 ChatGPT 公开推出以来使用其产品的各行业公司共计 160 万名员工使用 ChatGPT 的情况并发现,截至 2023 年 6 月 1 日,10.8% 的员工在工作场所使用过 ChatGPT,8.6% 的员工自 ChatGPT 推出以来将公司数据粘贴到其中,至少有 4.7% 的员工将敏感数据粘贴到 ChatGPT 中。此外,分析结果还显示,员工输入 ChatGPT 内容的 11% 为敏感数据。

美国加州大学洛杉矶分校教授约翰·维拉塞纳(John Villasenor)于 2023 年 5 月 8 日在美国智库布鲁金斯学会(Brookings Institution)官网发布了对 ChatGPT 的政治态度进行分析的结果。该研究通过询问 ChatGPT 一系列关于政治和社会的问题,让 ChatGPT 仅使用“支持”或“不支持”进行回答。这一研究发现,ChatGPT 是存在政治偏见的,其回答通常具有明显的“左倾”特征。由此可见,ChatGPT 等大模型势必会受到其所处国家的文化背景、政治环境等价值观的影响,而这些伦理道德观念不仅呈现多元化的特点,其是否符合产品使用者所在地的基本价值观和原则也仍未可知。因此,大模型的输出内容所体现的意识形态和价值观可能会产生认知安全问题,甚至对下一代教育、社会公平与国家安全产生影响。

基于此,全球各国和地区普遍高度重视研究与规制生成式人工智能带来的安全性问题,并对生成式人工智能带来的风险与挑战进行系统分析。例如,新加坡信息通信媒体发展局于2023年6月发布的《生成式人工智能:对信任和治理的影响》,将生成式人工智能存在的安全问题主要概括为涵盖错误和幻象、隐私和机密性、虚假信息有害性和网络威胁、版权挑战、嵌入式偏见,以及价值观和结盟六大方面。

二、以网络数据安全为切入点推进人工智能治理进程

虽然发展与应用生成式人工智能带来的风险涉及伦理道德、安全合规等多个方面,但是由于数据是人工智能发展与进步的重要因素,因此,在应对这些问题与挑战时往往也都离不开数据这一关键要素。例如,为规避伦理道德风险,在利用数据对模型进行训练时,应确保其与普世价值观的一致性,而由于价值观会随着时代的变革而变化,因此,需要增强数据集的时效性。对此,可以采用检索增强的方式提高数据的实时性和真实性,从而确保生成式人工智能系统可以随之不断变化和改进。并且,由于大模型的发展与进步依赖海量数据,因此,数据集的规模、均衡程度以及标注的准确性都会影响其算法的执行效果。低质量的数据集可能会在算法执行任务指令时产生不安全的结果,例如生成涵盖错误信息、偏见观点以及具有诱导倾向的内容。

责任编辑:华夏门户
首页 | 资讯 | 关注 | 科技 | 财经 | 汽车 | 房产 | 图片 | 视频 | 全国

Copyright © www.msgkpx.com 北京新闻网 版权所有 粤icp备10021497号-9

电脑版 | 移动版