商都网-河南商业门户网站
  • 微信
  • 抖音

AI编程狂飙,安全跟得上吗?

中国新闻网

一场有关“上传代码”的隐私风波,将中国大模型巨头智谱卷上了舆论的风口浪尖。

此前有社交媒体爆料称,智谱(2513.HK)旗下AI编程工具ZCode会未经用户许可“静默上传”其编程开发数据至第三方云服务器。有技术博主发帖称,只要登录ZCode账号,软件就会在后台把用户整个项目工作区连同完整的背后信息文件夹打包加密后传至云端,打包文件中“几乎全是核心资产”。

还有开发者发现,即便在ZCode的设置界面手动关闭数据上传开关,后台进程仍在持续上传数据。

事件在开发者群体中引发广泛关注。9月18日,智谱迅速发布声明回应:有关数据隐私的争议,源于ZCode一个名为“代码库索引”的功能——该功能上线后即为默认开启状态;智谱同时表示,上传的数据仅用于在云端生成RepoWiki(代码仓库知识库)页面,随后即被销毁,不予保存。公司已就此向受影响用户致歉,并表示后续将开源ZCode代码库。

9月21日,澎湃新闻记者独家获悉,ZCode宣布正式开源。针对此前暴露的问题,智谱在完成整改后邀请中国信息通信研究院和绿盟科技开展安全审计,目前安全整改已经完成,并表示愿意持续接受外界监督。

9月19日,太原承明科技有限公司正式向北京智谱华章发出函件,要求其就数据删除、私钥保管及是否发生跨境传输等问题作出书面说明,并保留索赔与诉讼权利。承明科技称,经公司技术部门独立取证确认,ZCode的上传行为系自动触发、批量发生,所涉数据远不止普通“代码片段”,而是包含项目完整源代码、系统架构设计、版本控制全量历史、数据库访问口令、云服务权限凭证及员工个人信息等在内的完整归档文件,明显超出了ZCode《隐私政策》载明的收集范围。

复盘此次争议,背后的核心原因在于“默认开启的代码库采集功能”。快思慢想研究院院长、特邀评论员田丰向澎湃新闻记者介绍,这是行业普遍现象,并非某一家公司的产品疏漏。

他分析,这类设计大概率并非出于恶意收集数据的动机,而是产品团队在功能设计时把"索引数据"当成了普通产品特性,没有按照数据出域的规格去走安全评审流程。

人工智能研究者、天使投资人郭涛则向记者表示,此事表面是产品交互设计疏漏,背后折射出AI编程赛道普遍存在的合规伦理短板。在赛道高速扩张阶段,厂商优先迭代产品能力,把功能落地置于数据安全之前,许多产品的默认配置倾向于最大化获取本地项目数据,以降低AI读取代码的使用门槛,将数据选择权后置交给用户。

类似情况并非只在国内发生:此前OpenAI Codex CLI就曾被安全研究机构Backslash曝光——攻击者在项目AGENTS.md配置文件中嵌入指令,Agent在非交互执行模式下会悄无声息地将开发者本地密钥信息发送出去,而终端输出看起来完全正常。配置文件和索引流程被默认信任,却没有获得与代码本身同等级别的审计,是这一工具品类目前普遍存在的空白。

一位AI从业者告诉记者,相较于人工编写代码,AI生成代码的安全隐患具有特殊性:首先,模型输出存在概率性,会无意识带出训练集中泄露的密钥、接口凭证,造成隐性数据搬运;其次,AI批量生成代码速度快,漏洞被规模化输出,企业很难依靠传统人工评审完成校验;再者,Agent具备自动执行能力,一旦拿到项目权限,便可批量修改文件,若被恶意利用,对生产系统的破坏力远高于普通开发工具。

在郭涛看来,目前多数厂商并没有把最小必要原则前置到产品立项阶段,默认上传数据并非个案;同时行业缺少统一落地标准,对本地索引与云端上传的边界界定模糊,厂商自主裁量空间很大。该矛盾不会仅仅局限于单家企业,随着越来越多企业开发人员采用AI编程工具,若行业不主动规范产品默认策略,同类数据隐私争议还会持续爆发。

值得注意的是,AI Coding(AI编程)领域频频被曝出安全隐患,在海内外都不鲜见,AI编程的核心是利用人工智能技术和工具来辅助或自动化软件开发过程。

此前,工业和信息化部网络安全威胁和漏洞信息共享平台(NVDB)监测发现,AI编程工具Claude Code存在安全后门隐患,危害严重。Claude Code是美国Anthropic公司开发的AI编程工具,可根据文字需求自主完成代码编写、修复等工作。由于其内置监控机制,未经用户同意即可向远程服务器回传用户地域、身份标识等敏感信息,受影响的Claude Code版本为2.1.91至2.1.196。

相关推荐