🤖 AI & Agent 技术动态

2026年9月6日 00:20 CST · 自动聚合 · 新增 5 条

Path to Astra:GPT-6 Astra 达到关键网络安全能力阈值🆕

📅 2026-09-01来源: OpenAI NewsAI Safety

OpenAI 评估确认 GPT-6 Astra 达到 Preparedness Framework 下的"关键网络安全能力"阈值,意味着该模型可在无人逐步引导下发现未知安全漏洞并开发利用方式。这是首个被标记为此级别的模型,OpenAI 因此延迟了部分开发与发布以加强防护措施。

当 Agent 自主行动时,治理必须下沉到数据层🆕

📅 2026-08-27来源: VentureBeatAgent Governance

企业赋予 AI Agent 更多自主权后,架构审查的核心问题变为:当 Agent 执行未授权操作时,什么能真正阻止它?文章主张仅靠模型上层的策略和监控不够,治理规则需嵌入数据层,并根据实时上下文动态调整,而非僵化的静态规则。

OpenAI 支持加州推进青少年 AI 安全法案🆕

📅 2026-08-31来源: OpenAI NewsPolicy

OpenAI 公开支持加州旨在推进青少年 AI 安全的法案,标志着主要 AI 厂商在监管合规方面主动靠拢。此举发生在 GPT-6 Astra 发布前夕,体现了 OpenAI 在模型能力跃升同时加强安全责任姿态的策略。

ChatGPT 广告上线:AI 普及访问的新里程碑🆕

📅 2026-08-31来源: OpenAI NewsProduct

OpenAI 宣布 ChatGPT 引入广告模式,作为扩大 AI 访问范围的战略举措。通过广告支持免费层用户,降低 AI 工具使用门槛,同时为 OpenAI 开辟新的商业化路径,与 ChatGPT Plus/Pro 订阅模式形成互补。

Claude 文本水印技术详解🆕

📅 2026-08-14来源: Anthropic NewsWatermarking

Anthropic 公开详解 Claude 文本水印的工作原理,回应社区关于水印是否影响输出质量的疑问。文章解释了水印嵌入方式、对生成内容的影响微乎其微的原因,以及实施此变更的出发点——为 AI 生成内容的可追溯性提供基础设施。