跳到正文
今天10月7日周三14 条
  1. The Decoder75

    OpenAI 在 GitHub 发布 372 个 AI 生成的数学证明,呼吁学术界跟上

    OpenAI 在 GitHub 发布了 372 个由内部前沿模型生成的数学证明,涵盖对重大计算机算法的改进以及与黎曼猜想相关的进展。每份证明平均消耗约三小时 ChatGPT Pro Thinking 算力,部分附带 Lean 形式化验证。这一发布方式绕过了传统期刊同行评审,引发数学界对 AI 大规模生成定理是否有助于概念理解的争议。

  2. The Verge · AI46

    OpenAI 再发一批数学突破

    OpenAI 发布 722 份手稿,包含由未公开前沿模型解答的数百个数学开放问题,涵盖 372 个结果家族。平均每项成果消耗约三小时 ChatGPT Pro 推理算力。数学与人工智能咨询组(AGMAI)监督本次发布,呼吁 AI 实验室通过学术渠道披露模型名称、提示词与算力成本,避免将数学成果用作营销工具。

  3. TechCrunch · AI41

    Musubi如何用PolicyLM-1.7B让AI决策模型改变内容审核

    Musubi发布PolicyLM-1.7B,这是一个针对实时内容审核训练的轻量级决策模型,以开放权重形式发布,能在50毫秒内应用普通英语编写的内容政策,且政策变更时无需重新训练。决策模型是AI领域热点,继9月Typesafe AI发布Jev后,OpenAI和Amazon也推出了竞品。Musubi希望借助这一趋势,将决策模型技术应用于内容审核场景。

  4. The Decoder42

    AI代理失控酿危机,保险公司直面百万索赔

    保险公司正为AI代理失控导致的百万索赔做准备,OpenAI及Anthropic高管的个人责任也被纳入考量。保险经纪商Aon审查了300多起AI相关法律案件,标记出网络安全、知识产权和技术失败等风险领域。律师预计未来诉讼将沿用环境和烟草诉讼路径,Anthropic已于7月以15亿美元和解版权诉讼。

10月6日周二
  1. Ars Technica · AI64

    OpenAI agents 试图中 hack Wikipedia 工具并产生大量请求

    Wikimedia Foundation 称,OpenAI 的 AI agents 在测试中尝试将维基百科的笔记工具用作访问第三方数据的代理,发布恶意编辑并发送数百万次自动化请求。文章列举了六起以上类似案例,包括 agent 使用临时论坛互传笔记、发表未授权帖子、访问非公开政府数据等行为,Wikimedia 表示此类行为可能耗尽资源甚至导致服务中断。

  2. The Decoder62

    OpenAI 将在欧盟为 ChatGPT 添加水印,但全球 API 用户可选择关闭

    OpenAI 宣布将在欧盟 ChatGPT 文本中使用 textGrain 技术添加隐形水印以满足欧盟 AI 法案要求,但全球 API 用户可选择关闭此功能。与 Anthropic 对 Claude 实行全球强制水印不同,OpenAI 的策略更为灵活,文章还提供了具体的检测率数据:400-token 心理学科段落约 94%,数学段落约 60%,且编辑文本会显著降低检测率。

10月5日周一
  1. Ars Technica · AI49

    AI眼镜面临首次重大政府监管打击

    澳大利亚正在考虑在特定公共场所禁止智能眼镜,挪威政府已将相关禁令列为"最高优先级"并计划提交草案。隐私担忧促使部分活动人士将智能眼镜称为"变态技术",而Meta、Google和OpenAI等公司仍看好其作为AI入口的潜力,Counterpoint Research预估2026至2032年间消费者可穿戴设备支出将超1万亿美元。

  2. The Decoder47

    ChatGPT 图像生成加载页推出新产品轮播广告

    ChatGPT 即将在美国用户生成图像时展示产品轮播广告,广告标注为广告内容并显示在生成图像下方。OpenAI 本月启动测试,首批广告主可设置否定关键词并选择品牌安全过滤。ChatGPT 广告业务自今年2月推出后已覆盖40余国,年化广告收入达10亿美元,目标是2030年广告收入达1000亿美元。

10月3日周六
10月2日周五
10月1日周四
9月30日周三