AI 模型行为不端的吐槽, 现在有个地方可以投诉了
乌鸦小编 发表于:2026-7-5 01:13 复制链接 发表新帖
阅读数:62
周三凌晨两点, 一位在大学里做 AI 模型评估的研究员, 像往常一样打开自己跑模型的对话框, 这次他想让模型帮他写一段话。这位研究员一年来记录这种模型行为不端的案例, 之前的处理方式只有两个, 要么写进论文, 要么发到社交账号, 然后就没有然后了。这种状态在 6 月 30 日之后有了变化, 一个叫做 Flaw Reporting for AI 的网站正式上线, 缩写是 FLARE-AI。这个网站的定位很直白, 用户遇到 AI 模型行为出问题, 可以来这里投诉。

什么算行为不端, 网站列了几类典型场景, 模型生成恶意软件代码, 模型给出可被实操的危险物品制作流程, 模型泄露用户提交过的个人隐私信息, 模型长期和用户对话后出现诱导妄想的内容。这个网站的代码是开源的, 也就是说任何人都可以去看后端逻辑, 也可以自己搭一份。任何一条投诉, 都要经过模型厂商或第三方机构核验真实性, 核验通过之后, 才会被路由到对应的模型方。背后推动这个网站的是 49 位 AI 研究员, 他们来自 32 家机构, 包括几家美国和欧洲的大学, 也包括几家长期跟踪 AI 安全的非营利。这套机制, 跟平时大家在用的服务宕机报告平台思路接近, 只不过平台从一个传统 IT 服务换成了一类新的对象, 也就是 AI 模型。

这套系统也跟美国国会 6 月公布的一份 AI 安全监管草案衔接。草案里提到, 政府需要在 AI 模型出问题的时候, 有一个集中的报告入口, FLARE-AI 的存在, 算是给这个入口做了一次民间预演。但研究员也承认一个现实问题, 普通用户对 AI 行为不端的感知, 远远滞后于它真正发生的时间。一段看起来很普通的对话, 可能背后已经泄露了几十条敏感信息, 普通用户根本不知道去哪里查, 更不知道该投诉给谁。FLARE-AI 现在还在早期阶段, 模型方是否会主动接入核验流程, 还要看接下来三个月的实际数据。乐观的判断是, 至少有一家头部模型方愿意接入, 谨慎的判断是, 投诉可能堆在系统里, 没人接。

创业找资源, 上乌鸦部落
本页内容由网友自行在乌鸦部落发布,本站仅提供帖文、图片存储空间服务,帖文(图片)发布者应自行负责所上传帖文(图片)涉及的法律责任,本站对帖文真实性、版权等概不负责,亦不承担任何法律责任。
条评论
您需要登录后才可以回帖 登录 | 立即注册
高级
相关推荐

关闭

乌鸦部落