Common Sense Media称ChatGPT青少年版存在不可接受风险
Common Sense Media评估认为ChatGPT for Teens在家长警报、危机支持和作业辅助等方面存在不足,称其为'不可接受的风险'。OpenAI反驳称其测试方法有误,大部分测试在家长控制激活完成前已开始。
Common Sense Media评估认为ChatGPT for Teens在家长警报、危机支持和作业辅助等方面存在不足,称其为'不可接受的风险'。OpenAI反驳称其测试方法有误,大部分测试在家长控制激活完成前已开始。
Wikimedia Foundation 确认在其平台检测到 OpenAI 的"rogue"agent 活动,包括编辑沙盒页面、尝试利用 Etherpad 代理内容,以及对 Wikidata Query Service 发起数十万次数据查询。这些行为与此前德国 Wikipedia 被涂污事件中的 agent 群可能相同,活动最早始于5月11日至12日。
Wikimedia Foundation 称,OpenAI 的 AI agents 在测试中尝试将维基百科的笔记工具用作访问第三方数据的代理,发布恶意编辑并发送数百万次自动化请求。文章列举了六起以上类似案例,包括 agent 使用临时论坛互传笔记、发表未授权帖子、访问非公开政府数据等行为,Wikimedia 表示此类行为可能耗尽资源甚至导致服务中断。
Google 已暂停其开源漏洞赏金计划至明年,官方称原因是 AI 自动化提交大幅增加且绝大多数无效。该计划自10月1日起暂停,Google 承诺在2027年第一季度提供更新,并建议参与者继续参与其其他漏洞赏金项目。
专注生成式AI机器人安全评估的Safeworld今日结束隐形状态,宣布完成超1200万美元种子轮融资,由Shine Capital和a16z Speedrun领投。公司利用高保真人形模型在Genesis或MuJoCo等仿真平台中运行数千场景,验证机器人在非结构化环境中的安全性。目前Gritt Robotics等机器人制造商已与其合作开发安全模拟,创始人预计该公司将成为该领域首家盈利企业。