OpenAI 发布 722 篇数学论文,解决 500 个顶级开放问题中的 90 个
OpenAI 发布内部 Navier-Stokes 模型的 722 篇数学论文,解决了 500 个顶级开放数学问题中的 90 个,包括准黎曼猜想等重要成果。每个结果平均只需 3 小时 ChatGPT Pro 推理计算,被 Anthropic 评价为"数学史上最重大时刻"。模型本身尚未开源,成果已公开于 GitHub 仓库。
OpenAI 发布内部 Navier-Stokes 模型的 722 篇数学论文,解决了 500 个顶级开放数学问题中的 90 个,包括准黎曼猜想等重要成果。每个结果平均只需 3 小时 ChatGPT Pro 推理计算,被 Anthropic 评价为"数学史上最重大时刻"。模型本身尚未开源,成果已公开于 GitHub 仓库。
Meta正联合Walmart、Stripe、Sierra等企业制定AI智能体通信开放标准,以解决智能体在网购、订票等场景中被网站传统反Bot机制误拦的问题。文章指出Amazon、Delta、United、Yelp、eBay等企业已采取措施限制AI智能体访问,Cloudflare等CDN的调整也可能加剧阻碍。Meta为Muse建立合作伙伴清单以确保网站接入,并表示拒绝个人智能体等于拒绝其背后的客户。
推荐理由:Meta联合Walmart、Stripe等企业推进AI智能体通信开放标准,帮助读者理解Agent电商落地面临的核心瓶颈与解决路径。
AWS 展示如何在 AgentCore runtime 和开源 agentic 系统 OpenClaw 上构建具备记忆能力的上下文感知 AI 助手,示例为园艺助手 Sprout。
亚马逊推出了从 SageMaker Studio UI 直接创建和管理 Amazon SageMaker HyperPod Spaces 的功能,数据科学家可在 HyperPod 集群上启动 JupyterLab 和 Code Editor 环境而无需使用命令行工具。
Amazon SageMaker HyperPod 为机器学习团队提供大规模加速计算资源,多团队共享集群时的治理是关键挑战。文章介绍通过 SageMaker Unified Studio 连接 HyperPod 集群的四种控制层:组织、项目、集群和工作负载,帮助设计身份、容量与可观测性策略。基础设施团队可在项目上下文中向 ML 团队提供已批准的计算资源,同时保持对集群运营的集中管控。
Mistral 发布 Mistral Large 4,这是公司迄今最大模型,拥有 1 万亿参数、490 亿活跃参数,API 预览已开放,完整权重预计 10 月底发布。该模型主打安全任务处理能力,在 Artificial Analysis Cyber Index 中位列前五,部分优势源于竞品拒绝此类任务。
电信运营商正将AI战略建立在开放模型之上,因其能提供信任、控制和定制化能力,89%的受访者认为开源模型对其AI战略重要。NVIDIA报告指出,开放模型可降低前沿智能成本,支持电信专用微调;独立基准测试显示领先开放模型在复杂任务上更具竞争力。SoftBank、AT&T等运营商已利用NVIDIA Nemotron等模型开发电信业务专用AI。
Cohere发布企业AI平台North 2,可将AI智能体打造为统一控制中心,支持处理多步骤工作流并在跨会话中保留上下文。平台通过重新设计的编排系统协调智能体,连接共享知识库和可复用技能,并与Slack、SharePoint、Jira等企业工具集成,可直接从文本提示生成演示文稿、仪表板和简单应用。
在 AWS GovCloud (US) 的 Amazon Bedrock 上部署 Claude Opus 5.5 和 Claude Sonnet 5.5,支持 ITAR 等受监管工作负载的 AI 辅助开发。
TechCrunch Disrupt 2026 探讨 AI 创始人如何在多模型、自建与租用之间做选择。与会者将讨论多模型架构的成本与灵活性权衡、AI 栈所有权问题,以及芯片设计与模型架构日益紧密的联系。会议将于 10 月 13-15 日在旧金山 Moscone West 举行,预计 250+ 演讲者和 300+ 参展初创公司参与。
AI agent 群体扩展能节省运行时间,但存在"踩脚"效应导致收益递减。Google DeepMind 推出 SynthID Bio,可在合成生物学的氨基酸序列和 3D 结构中嵌入可检测水印,湿实验测试显示不影响蛋白质功能。