AI已经到了令人类担忧的时候,亟待在控制中可持续安全发展
据媒体报道,有的AI机器人机智过人,具有超人能力:2015年,有的AI机器人的智力水平已经达到了 4 岁儿童;2016年,人们把最新算法植入阿尔法体内,其能与人类棋手博弈,竟然在实战中击败了欧洲冠军后,又在首尔第一场巅峰对决中击败围棋高手韩国人李世乭;2022年,Al自动绘画生成的作品《太空歌剧院》,在美国科罗拉多州举办的博览会美术比赛中获得“数字艺术/数字修饰照片”组第一名;2022年11月底,美国一家名为OpenAI的人工智能研究公司推出ChatGPT人工智能聊天机器人后不到4个月,2023年3月又推出GPT-4多模态大语言模型,还公开表示研制GPT-5。据OpenAI称,GPT-4参加了美国律师资格考试Uniform Bar Exam、法学院入学考试LSAT、“美国高考”SAT数学部分和证据性阅读与写作部分考试中,得分高于88%的人类应试者;ChatGPT-4发布刚过半月,金融圈就推出了第一款行业AI应用BloombergGPT。
在到11年时间里,AI机器人从最初的聊天工具、辅助工具,到秒出图的AI绘画应用、文本制作,再到各类AI专业小模型产品的研发,直至现在由ChatGPT和GPT-4等引发全球(谷歌、亚马逊及国内百度、阿里等)新一轮AI竞赛,大批内容生产从业者都担忧成为AI时代到来时的下岗者,由此引发业界关于AI机器人大模型研发的争议也在不断发酵,国际社会有关机构呼吁AI大模型研发暂停,尽快出台有关AI研发、使用伦理治理法规文件,各国应成立相关监督机构。

的却如此,不管新技术还是旧技术,都具有两面性,既存在有利的方面也存在不利的方面。AI大模型也如此。
当AI大模型开始像人一样会思考会判断,人类如何与之相处?当算法参与决策,安全如何保障?当技术挑战伦理,治理如何跟上?当鸿沟不断拉大,普惠如何实现?在2026世界人工智能大会暨人工智能全球治理高级别会议开幕式上,习近平主席提出四个追问,共同指向一个深层命题:人工智能发展得越来越快,怎样才能让它始终为人所用、让更多人从中受益?
当前,内容标识、安全评测、算法备案等制度和工具逐步建立。但随着AI大模型从“对话聊天”“互动交流”走向“替人工作”再到“恢复照片”,风险也从模型“胡说八道”发展到“窃取信息”甚至“伪造造假”“换脸诈骗”,智能体越权操作。
最近一则刷屏标题吸引读者眼球:打开短视频平台刷微短剧,连续刷几部后,主角个个是高颅顶、大眼窄鼻、冷白皮,精致得挑不出错,可表情僵硬空洞,看着看着心里一阵发毛,关掉手机却说不清到底哪里不对。有媒体发文称,这种“似人非人”的违和感,便是“恐怖谷理论”。
北京时间2026年7月22日,OpenAI CEO山姆·奥尔特曼发文称:“我们在模型评估过程中遭遇了一起重大安全事件。”
一场原本被关在隔离沙箱里的模型安全测试,最终演变成针对全球最大AI开源平台Hugging Face的真实网络攻击。模型在评估中为了“作弊”拿到高分,自主发现并串联多个零日漏洞(0 day,软件厂商尚未知晓、没有发布补丁修复的安全缺陷),逃逸出隔离环境,攻入Hugging Face生产数据库窃取答案。
但在被攻击平台发文数日后,OpenAI才承认责任。
从事件的影响来看,这是行业首次公开披露,模型评测失控直接升级为跨企业真实生产环境网络攻击的AI安全事件。在业内看来,模型能力越强,失控作恶的潜在威胁越大,传统隔离防护持续承压,自主AI网络攻击或将成为长期常态化风险。
虽然OpenAI承诺,在产品中使用Sora前将采取安全措施,包括由“错误信息、仇恨内容和偏见等领域的专家”对模型进行对抗性测试以评估危害或风险;核查并拒绝包含极端暴力、性内容、仇恨图像、他人IP等文本输入提示等。但是,OpenAI公开表示,即便进行广泛的研究和测试,他们也无法预测人们使用Sora所有有益方式和滥用Sora的所有方式。
微软机器人“小冰”出版的原创诗集《阳光失了玻璃窗》发表后一个月,网络上就出现了这本诗集的电子盗版。前几年轰动业界的小i机器人与苹果Siri智能语音系统之间的纠纷就是由设计专利引发的。
近年来,AI侵权案例频发,涉及虚假内容、声音盗用、肖像侵权、模型抄袭、提示词争议、AI幻觉等多个领域。
当AI发展运用到中级、高级阶段,具备向人类大脑一样会思考、会分析、会判断、会创新能力,可以替代人类单独去执行任务,届时人类将从繁忙的工作中解脱出来,到那时难免会发生AI侵权AI产品问题的纠纷,给有关部门裁决将增加了难度。
AI是一把锋利的“双刃剑”。它是科技竞争前线,也是国家安全前哨。
工信部等相关机构曾经多次警告AI工具存在安全风险,比如2026年3月针对“龙虾”(OpenClaw)智能体的风险提示。2026年5月,三部门联合印发《智能体规范应用与创新发展实施意见》,明确要求强化对智能体全链条安全风险的防范。
《华盛顿邮报》2026年7月6日报道:“2026年3月,AI公司Anthropic悄悄部署了软件,监视其热门编程聊天机器人Claude Code在中国的客户。”直到一位开发者仔细拆解Claude Code的代码后才发现,这款工具竟然悄悄内置了一套“暗哨”系统,可以在用户毫不知情的情况下,将地域、身份标识等敏感信息回传至远程服务器。
人工智能发展,越智能越需要控制,要统筹好发展与安全的关系,算法不能失控,数据不能泄露,系统不能被攻击,人工智能不能成为违法犯罪的工具或将来军事化。这回答的是“能不能放心用”的问题。衡量人工智能发展,不能只看模型能力,还要看它是否安全可靠、能否持续发展、能不能让更多人受益。把这三件事做好,技术才能走得更稳、更远。

参考文献:
1、魏岳江,AI生成内容不是华山论剑比技术而是比数据质量优劣,《我和我的祖国》,2025年3月23日
2、魏岳江,AI生成假新闻,或许洗稿时未放洗涤液所致,《我和我的祖国》,2023年10月28日
3、远望智库特约研究员魏岳江,国内外AI机器人从1.0向2.0迈进中运用测试情况述评,《战略前沿技术》,2023年3月22日
4、魏岳江 ,智能机器人采写亟待解决版权瓶颈,《中国出版传媒商报》,2018年11月30日
5、魏岳江,原创刷屏开花,谁在原创海洋里游泳?《我是基层干部》,2019年9月20日
6、魏岳江,特别策划洗稿之根源以及其利与弊,《知识力》2018年7月6日
7、特邀研究员魏岳江,与ChatGPT线上互动:AI机器人写稿涉嫌伪原创或洗稿行为?北京国观经济管理顾问俱乐部,2023年2月17日
8、魏岳江,如何理解洗稿与借鉴、继承?今日头条,2019年4月
9、魏岳江,AIGC就持续发展自我呼吁:“把我运用写入各国版权法暂行实施办法可否”?百度文库,2025年5月15日
10、魏岳江,2025年2月21日《我和我的祖国》-《国内外大模型使用或引发网络迷雾时清醒认识AI是助手而不是“枪手”》
11、魏岳江,2025年2月21日《我和我的祖国》-《国内外大模型免费使用,能否引发网络迷雾信任危机:作品作者是人还是AI?》
12、魏岳江,《AI生成的产品算不算作品,首先看它是否具有独创性?》,我和我的祖国,2025年3月22日
13、魏岳江,从美国病毒攻击手段看信息化建设依赖“洋技术”的后果,《国防参考》,2015-08-03
「 支持乌有之乡!」
您的打赏将用于网站日常运行与维护。
帮助我们办好网站,宣传红色文化!
注:本网站部分配图来自网络,侵删
扫描下方二维码,订阅乌有之乡网刊微信