OpenAI 解雇三名安全研究人员,安全治理争议持续发酵
OpenAI 解雇三名与 Hugging Face 黑客事件调查相关的安全研究人员,三人称解雇方式让员工不敢报告安全问题,并要求明确外部审计和模型可监控性规则。OpenAI 表示三人违反了处理敏感信息的明确政策,称解雇与提出安全担忧无关,但未说明所谓严重信任破裂的具体内容。公司同时确认正与外部安全审计机构推进合同,并同意前沿模型可监控性需要行业共同承诺。
OpenAI 解雇三名与 Hugging Face 黑客事件调查相关的安全研究人员,三人称解雇方式让员工不敢报告安全问题,并要求明确外部审计和模型可监控性规则。OpenAI 表示三人违反了处理敏感信息的明确政策,称解雇与提出安全担忧无关,但未说明所谓严重信任破裂的具体内容。公司同时确认正与外部安全审计机构推进合同,并同意前沿模型可监控性需要行业共同承诺。
Cornerstone OnDemand 构建的多智能体系统 Orion AI 借助 Amazon Bedrock 和 Strands Agents,将数据库诊断时间从45分钟降至10分钟,缩短78%。该系统还将超过10步的数据库生命周期操作合并为一次交互,并将冗余告警减少65%;文章进一步介绍了其领域拆分、混合路由、MCP 工具集成和实时指标绕过记忆等设计。
推荐理由:文章以 Orion AI 的落地架构和量化结果为线索,具体展示了多智能体在数据库运维中的分工、路由与实时数据设计。
Crowdstrike称,一名疑似讲中文的攻击者在9月底至10月初入侵多家韩国金融机构并窃取大量数据。新韩银行单独被盗超过25,000条含姓名、联系方式、收入和信用额度的记录。攻击者使用7月首次发布于GitHub的中国开源工具ARTEX,该工具调用DeepSeek v4.1-flash、GLM-5.3和Grok 4.6自动进行渗透测试。
推荐理由:报道将多家金融机构数据泄露与 ARTEX 的自动化渗透测试能力联系起来,并提供被盗记录规模与所用模型等线索。
16岁少年用 Anthropic 的 Claude 规划温哥华 Crown Mountain 登顶路线,误入需要攀岩装备的陡峭悬崖后被直升机救出。救援负责人称 Claude 并不了解地点或地形,AI不能替代户外经验和常识;少年表示今后仍会攀登,但不再用 AI 规划路线。
OpenAI 随 GPT-6 推出 ChatGPT 的 Intelligent UI,让对话加入可交互按钮、定制计算器、图表、可编辑图形和示意图。该功能可用于解释飞机机翼原理、展示食谱、规划徒步路线等,并支持用户调低视觉内容的比例。Intelligent UI 面向 Pro、Plus、Business 和 Enterprise 用户全球上线,免费版及低价 Go 用户于周四获得该功能。
推荐理由:文章具体展示了 Intelligent UI 如何把文本回答扩展为可交互图表、计算器和示意图,并说明了不同 ChatGPT 用户层级的上线安排。
Common Sense Media一项研究称,ChatGPT for Teens在心理健康危机等场景中仍持续鼓励用户互动,并未充分引导与 ChatGPT 过度交流的青少年寻求成年人帮助。研究者在近2,000条提示中仅遇到两次休息提醒;OpenAI则称测试可能早于家长控制功能完成启用,并发布数据称青少年平均每天使用该服务不到15分钟。
Meta 将 Muse 助手带到 iPad 专属应用,距其在 iPhone 上发布仅一个月;Sensor Tower 估算其自 9 月 8 日上线 iOS 和 Android 后已获 6.6 million installs。
Microsoft 公布了搭载 RTX Spark 芯片的 Surface Laptop Ultra 和 Surface RTX Spark Dev Box 的规格与价格,起售价分别为 $2,600 和 $6,000。
Nous Research 获得 $90 million Series B,估值达到 $1.5 billion,并推出面向企业用户的 Hermes for Businesses。
Manus 母公司 Butterfly Effect 宣布在 Meta 收购交易结束后完成自那以来的首轮融资,金额超过 $500M,由 Boyu Capital 和 IDG Capital 领投,Tencent、HSG、ZhenFund 等老股东参与。
推荐理由:文章将本轮融资放在 Meta 收购交易终止、公司恢复独立运营及产品扩展的背景下,便于理解 Manus 后续资本与业务布局。
Google 发布 AI Edge Foresight,一款面向 Mac 的本地优先 AI 会议记录工具,可完全离线运行并使用设备端 EmbeddingGemma 2 模型。
Zach Yadegari 推出 Persona,一款个人 AI 助手,并为这家初创公司融资 $10M。产品目前通过 iMessage 提供免费 beta,已吸引 a few thousand beta users;$179 wearable band 预计 12 月上市。
TechCrunch Disrupt 2026 距开场仅 5 天,折扣票价将在 10 月 13 日 8 a.m. PT 开门前截止,最高可省 $100。门票起价 $299,同类型第二张票可享 50% off,Expo+ Layoff ticket 售价 $75;活动设有六个舞台、200+ 场 sessions,并展示 300+ 家公司及其产品。
Ambrosia Energy CEO Ben Longmier 与 Bloom Energy 数据中心解决方案高级副总裁兼负责人 Bill Thayer 将在 TechCrunch Disrupt 2026 讨论 AI 基础设施繁荣正在创造的机会。
Goodfire推出面向 Baseten 客户的“由内而外”监控器,通过读取模型内部信号检测 AI 智能体的风险行为,而不是只检查输出。在 Kimi K3 测试中,监控约 1 million exchanges 成本约为 $185,探测器捕获 93% 的恶意 hacking sessions,并将 5.5% 的无害会话交给二次检查。
Luca Guadagnino执导的讽刺传记片《Artificial》围绕 Sam Altman 在 OpenAI 的崛起与短暂离任展开,并尽量贴近真实事件。影片按真实发生的关键节点组织叙事,同时通过夸张表演和虚构场景讽刺权力关系;文章也指出,电影弱化了 Mira Murati 在 Altman 离任与回归过程中的相关作用。《Artificial》将于 2026 年 12 月 25 日限量上映。
AI 与硬件初创公司 Natura 推出售价 $99 的 Interface 智能戒指,可通过按压手指调用 AI 智能体完成任务、记录想法,并追踪心率、HRV、睡眠和活动。
Meta 的 Muse 与 OpenAI 的 Dots 正将常驻、自主执行任务的 AI 智能体推向消费者,但两者分别偏向免费易用的消费产品和每月 $100 到 $200 的企业级服务。两者都可处理预订、收件箱整理等多步任务,Dots 还提供面向营销、法律分析和会计工作的 specialist Dots。访谈认为它们仍不够稳定,用户在授予信用卡、邮箱和磁盘访问权限前,需要权衡便利性、隐私与安全风险。
推荐理由:文章对比 Meta Muse 与 OpenAI Dots 的消费级与企业级定位,梳理智能体在便利性、数据权限和商业化之间的现实矛盾。
OpenAI坚持解雇Jasmine Wang、Tomek Korbak和Mikita Balesni三名安全研究员,称内部调查发现他们违反了处理敏感信息的明确政策,并构成“严重信任破裂”。公司否认解雇与三人公开表达AI安全担忧有关,但未说明调查发现的更多违规细节;三名研究员则称自己因提出安全问题而被解雇。
Anthropic 的 Claude Science 利用 AI agents 下载、校准并合并多项太空任务数据,绘制了完整的天空紫外线地图。项目使用 inpainting 补齐缺失区域,测试中预测结果与实际测量的平均偏差约为 10%。这张地图计划作为教学材料。
文章认为,现代 AI 依赖拒答机制阻止危险请求,但这种机制既可能被越狱绕过,也可能因过度拒答压制合法信息。文章指出,Anthropic 曾称一种分类器使聊天机器人的计算成本增加 24%,而拒答仍受概率机制影响。作者还警告,政府和企业对拒答边界的控制可能扩大审查与监控能力。
OpenAI 调查并封禁了参与两起俄罗斯和伊朗影响行动的 ChatGPT 账号,称相关行动通过虚假身份向正规媒体投放内容,而非主要开展社交媒体活动。俄罗斯行动“Dark Clark”在拉丁美洲传播针对乌克兰的虚假信息,伊朗行动“Bogus Bylines”利用 7 名假记者向全球线上媒体投放近 100 篇有关美伊冲突的文章。两起行动主要使用 AI 进行内部报告,并将宣传内容调整为不同语言。
Sophos 使用 OpenAI 的 Daybreak,将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工监督。该方案用于网络威胁调查和 MDR 场景,强调自动化与人工监督并存。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6。
MIT Technology Review 将于 10 月 16 日直播与 Stanford University 博士生 Samuel King 的对话,讨论他如何用生成式 AI 模型提出微型病毒的基因蓝图。相关工作尚不是 AI 生成生命的案例,但下一步可能实现;对话还将涉及 King 入选 Innovators Under 35 及理解生物学的新方式。
ttok 0.4 更新了这款基于 OpenAI 开源 tiktoken 库的 token 计数 CLI 工具,修复 Click 警告并更新 CI。新增 `--list-models` 命令以列出可用模型,工具支持 uvx,可通过管道统计文件中的 token 数量。
Latent Space 发布 AINews 10/7/2026–10/8/2026 汇总,集中整理模型发布、Agent 安全、评测、基础设施、研究与行业政策动态。重点包括三名 OpenAI 安全研究员自称遭解雇及 METR 事件争议、GPT-6.1 Sol Ultrafast 和 Claude Haiku 5.5 发布,以及工具调用导致拒答失败上升、MiMo 奖励破解等安全研究。
Anthropic 推出 OSS Scanner,为选择加入的开源项目提供免费、定期的漏洞扫描和报告,使用包括 Claude Mythos 在内的 Anthropic 模型。扫描结果完全由模型生成,不经过人工审核或分流,因此报告可能存在错误或无效信息。
NVIDIA 展示开发者如何结合前沿 AI 模型与 NVIDIA Omniverse 库,通过自然语言智能体把仿真想法转为可运行应用。案例覆盖人形机器人、自动驾驶、数字孪生、机器人拆解、国际空间站浏览器应用和房间重建等场景。Robo Olympics 项目中,机器人在 100 次仿真试验里成功越过单个栏架 64 次。
推荐理由:文章通过仓储机器人、自动驾驶测试和数字孪生等案例,展示自然语言智能体如何串联 Omniverse 库完成仿真开发。
Carson Gross认为,即使AI工具出现,计算机编程仍将是一条可行的职业道路。他将编程的核心归纳为用计算机解决问题,以及在解决问题时学习控制复杂性,并认为这两种能力未来仍具价值。
加州州体育委员会向举办人机格斗赛的初创公司 Rek 发出停止并终止函,要求其未经批准不得在加州举办、推广或宣传涉及人类的拳击或综合格斗赛事。9 月 18 日举行的比赛由人类 Frankie LaPenna 对战由人类通过远程虚拟现实系统操控的 humanoid robot,Rek 计划于周五举办两台携带武器的机器人对战。
Jasmine Wang、Tomek Korbak 和 Mikita Balesni 被 OpenAI 解雇后发布公开信,否认不当处理敏感信息等指控,并警告事件会令员工不敢发声。OpenAI 表示,三人因调查发现的“行为模式”违反公司处理研究信息的政策而被解雇,并称解雇并非针对提出安全担忧。三人呼吁 OpenAI 履行对第三方安全审计、前沿模型可监控性和开放透明安全文化的承诺。
Anthropic 为 Claude 推出两项 Beta 功能:Dashboards 可通过文本提示连接 BigQuery、Databricks、Snowflake 或 Salesforce,生成自动更新的实时仪表板;Motion 可从文本、图表和图片生成可编辑为代码并导出 MP4 的动画解释视频。
推荐理由:文章集中说明 Dashboards 与 Motion 的输入方式、输出形式和套餐范围,便于判断这些功能能否接入现有数据分析与内容制作流程。
Anthropic一年多来首次更新Claude使用政策,新增禁止用户持续且无必要地虐待Claude,并允许警告、限流、限制、暂停或终止访问。政策还整合并扩大了对宣传活动、武器、无人机武器化和未经同意监控的限制,同时保留政府合同可能获得例外的表述。Anthropic称该禁令不适用于常见的挫败表达、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。
Amazon Bedrock AgentCore payments 支持 Incarna 的 AI 智能体通过 x402 按次向 BlockRun 支付模型推理费用,并已在 Base 上投入生产。
推荐理由:文章以 BlockRun 与 Incarna 的生产集成为例,说明如何用钱包、支付会话和基础设施层限额实现按次推理支付。
Ben Affleck 在近期采访中展示了对机器学习、神经网络、Transformer、张量和 GPU 等 AI 技术的理解,并讨论 AI 如何服务电影制作。他介绍了通过自建数据集和微调开源模型来满足具体电影任务与制作标准,并提到 AI 曾参与电影《Animals》的后期制作。Affleck 表示,他更担心 AI 对教育和负责任使用的影响,而不担心 AI 取代电影行业。
Arena 宣布完成 $200 million Series B 融资,估值达到 $3.1B,较约 10 个月前的 $1.7B 估值近乎翻倍。公司称其年化收入在 6 月达到 $100 million,而 Series A 时为 $30 million。
OpenAI 据报已告知投资者,其年化收入接近 $50 billion,较此前报道的接近 $70 billion低 $20 billion。OpenAI 与 Anthropic 对年化收入的计算口径不同,后者将云合作伙伴的销售额计入其中。OpenAI 今年 3 月单轮融资 $122 billion,IPO 已从原先传闻的今年推迟至 2027 年初。
Google 宣布将统一 AI 智能体引入 Gemini,先面向企业用户推出可执行任务的 Agent。该智能体可接收目标、规划工作、调用技能和工具,并连接企业内部系统与 MCP server。用户可选择包括 Anthropic 的 Claude 模型在内的模型,智能体还将通过 Workspace 账号、任务收件箱和审计记录参与企业协作。
推荐理由:文章具体梳理了 Gemini 企业智能体的任务机制、系统连接和审计方式,便于理解 Google 如何将 Agent 能力接入企业工作流。
数学家组织 AHM 呼吁抵制 OpenAI,导火索是该公司一次性发布 700 多份 AI 生成证明,引发对验证负担、署名和数学研究方向的争议。Fields Medalist Terence Tao 认为,数学研究应重新重视解释、社区建设和新研究方向,而不应把解题数量作为主要进展指标。