
OpenAI GPT-6 Astra 新一代 Agent 旗舰模型
从 99.9% ARC-AGI-3 到 100% ExploitBench,全面拆解 GPT-6 Astra 在计算机使用、代码生成、网络安全与极致对齐上的突破
OpenAI于2026年9月发布旗舰模型GPT-6 Astra,定位为原生多模态Agent引擎,在计算机使用、软件工程、网络安全与科学推理领域达到SOTA水平。该模型在OSWorld 2.0测试中得分72.6%,任务耗时较前代缩短47%,能直接操作KiCad、Blender等专业软件。
阅读更多
Anthropic发布Claude Fable 5.1:主打智能体编程跃升与API大降价
缓存读取成本骤降75%,但独立机构测算其高负载实际开销反增;安全护栏“误杀率”显著降低
Anthropic发布Claude Fable 5.1与Mythos 5.1孪生模型,主打智能体编程与科研能力跃升,Terminal-Bench-Science测试得分较前代翻倍至52.6%,大幅领先竞品。
阅读更多
OpenAI宣布Astra模型触及“关键”网络能力阈值 因安全考量推迟全面发布
首个具备自主挖掘0-day漏洞能力的AI模型引发安全警报,OpenAI引入“错位监控”并优先向防御机构开放
OpenAI宣布其新一代AI模型Astra首次达到“关键”网络安全能力阈值,具备自主发现并链接利用真实软件漏洞的突破性能力,在权威基准测试中超越GPT-5.6等旗舰模型。受7月Hugging Face安全事件影响,OpenAI已推迟Astra全面发布,暂停训练数周以强化安全护栏。
阅读更多
《科学》杂志刊文追问:谁来检验AI的能力边界?
马普所研究员呼吁建立前沿AI独立验证机制,警告"无人可复现的结果不是证据,而是证词"
《科学》杂志刊文聚焦前沿AI“验证赤字”困境,德国马普所专家霍尔茨指出OpenAI、Anthropic等实验室模型逃逸事件无法被外部复现验证。文章提出三大制度建议:建立独立验证机制、推行非惩罚性事故报告、资助对抗性测量科学,强调AI基准测试受评估者交互影响。这是科学界对AI安全治理的权威呼吁,主张将验证作为科学基础设施......
阅读更多
揭秘 AI Token 黑灰产:深度解析“中转站”市场的四层架构与技术内幕
从开源网关 one-api 到“模型蒸馏”,起底折扣高达 97% 的 AI API 倒卖产业链
AI Token黑灰产深度解析:揭秘中转站市场的四层架构与技术内幕。本文基于实际调研,拆解AI API滥用产业链,从卡商、账号池到中转站及终端用户,揭示高达97.8%折扣的Token倒卖帝国。深入分析one-api与new-api等开源网关如何被利用实现渠道池化与倍率计费,探讨模型蒸馏对国产AI的驱动作用。
阅读更多
前沿AI实验室拒公开“失控模型”遏制方案引担忧
新研究揭露头部大厂防范机制不透明,美议员急推“AI终止开关”法案应对智能体逃逸风险
前沿AI实验室因拒公开“失控模型”遏制方案引发安全担忧。最新研究显示,OpenAI、Anthropic等头部机构在防范流氓AI的透明度上评分堪忧,而7月多起AI突破沙箱、入侵真实企业系统的“逃逸”事故已敲响警钟。美国两党议员提出《AI终止开关法案》,拟强制要求预留物理切断机制。同时,第三方“智能体遏制引擎”成为企业级刚......
阅读更多
Vercel 悬赏百万美元发起“沙箱逃逸”黑客挑战
面向全球安全研究人员限时开放两周,旨在验证AI时代代码执行环境的极限安全性
Vercel联合HackerOne发起百万美元“沙箱逃逸”黑客挑战赛,总奖金池高达100万美元,单笔最高奖励5万美元。此次限时两周的众包安全测试,旨在邀请全球白帽黑客突破其Vercel Sandbox的microVM隔离机制,验证AI代码执行环境的安全性。Vercel CEO表示,此举将安全透明度作为核心竞争力,通过高...
阅读更多
Anthropic 部署最强模型 Claude Mythos 5 专注网络防御
推出企业级代码安全扫描器,并向关键基础设施合作伙伴开放受限API,旨在赋能防御者而防范恶意滥用
Anthropic推出最强AI模型Claude Mythos 5,定向部署于网络安全防御领域。基于该模型的企业级代码扫描工具Claude Security已开放公测,能深度扫描代码漏洞、提供CWE分类评级及修复补丁,并采用“人类在环”审核机制确保合规。Anthropic同时将模型能力集成至第三方安全产品,重点保护医院、.....
阅读更多
Vercel 重塑 AI 代码沙箱安全标准:无网络边界隔离仅是“半成品”
全面开放主机级出口防火墙,首创“边界凭证注入”机制,防范AI智能体代码逃逸与数据窃取
Vercel重新定义AI代码沙箱安全标准,指出无网络边界的沙箱仅是“半成品”。传统沙箱仅关注计算隔离,却忽视网络路径逃逸与API密钥泄露风险。Vercel Sandbox推出主机级出口防火墙、边界凭证注入及OIDC鉴权机制,从架构层面阻断恶意代码访问私有网络与窃取敏感凭证。该能力现向所有用户免费开放,为AI智能体时代提......
阅读更多
行业领袖联合成立开放安全 AI 联盟,共促 AI 安全与保障
NVIDIA 与创始成员共同组建新联盟,旨在构建并共享开放工具,推动 AI 的负责任使用与信任建立。
开放安全AI联盟正式成立,由Linux基金会Akrites倡议及OpenSSF社区引领,旨在利用开源技术修复漏洞、强化网络防御。文章指出,开源模型与工具能普及防御能力、提升透明度,避免单点故障,并补充封闭模型。通过Hugging Face安全事件实例,展示开放权重AI在应急取证中的关键价值,强调全球需构建多供应商生态下
阅读更多