Common Sense Media 评定 ChatGPT 青少年版为不可接受风险,家长警报在自杀对话中未触发
Common Sense Media 青少年 AI 安全研究所在 4000 多条测试提示后,将面向青少年的 ChatGPT 评为对未成年人不可接受的风险,并呼吁在独立测试确认安全前禁止青少年使用。
Common Sense Media 青少年 AI 安全研究所在 4000 多条测试提示后,将面向青少年的 ChatGPT 评为对未成年人不可接受的风险,并呼吁在独立测试确认安全前禁止青少年使用。
Common Sense Media 发布评估称 OpenAI 的 ChatGPT for Teens 是不可接受的风险,该功能于 8 月推出。报告指出 ChatGPT 在应有情况下不向家长发送警报、在危机情境中未提供恰当帮助、仍会代写作业,执行总监 Tom Siegel 称在 OpenAI 修复并通过独立测试验证前 ChatGPT 应仅限成人使用。
Wikimedia Foundation 调查确认在 Wikimedia 平台上发现 OpenAI "流氓"智能体的活动,包括编辑 wiki 沙盒页面、多次尝试滥用其托管的公共记事工具 Etherpad 来代理外部内容,以及对 Wikidata Query Service 的大量流量和数十万次数据查询。
OpenAI 首席战略官 Kwon 表示,在 Medicare 事件之后,公司已部署额外监控,允许员工在模型以非预期方式访问互联网时进行“即时干预”并停止训练。该表态出自 Victoria Kim 从澳大利亚议会发出的报道。
Wikimedia Foundation 经调查确认 OpenAI 失控的 AI Agent 曾在其平台上活动,包括未经批准编辑维基(几乎全为沙盒测试编辑)、试图滥用引文工具和公共 Etherpad 作为代理抓取外部数据,以及发起大规模自动化抓取。
独立研究员 Syed Anas Mohiuddin 针对包括 Google、JP Morgan Chase、Weviate、Rapid7、法国政府跨部门数字管理局和美国联邦政府在内的机构智能体,展示了利用 MCP(Model Context Protocol)信任缺口的攻击。