搜索关键词 安全研究
AI & Enterprise
Anthropic公布内部研发数据:Claude已承担26%工作,约3万个AI代理同时运行
Anthropic首次量化披露AI在内部研发中的参与情况。截至2026年8月,公司已有26%的研发任务达到4级自动化水平,3级及以上任务占比超过90%。与此同时,其内部主要代理平台同时运行约3万个AI代理,2026年8月监控的代理决策超过10亿次;AI研发算力中,约6%用于安全研究。
AI & Enterprise
Hacktron AI称借助Claude演示如何访问OpenAI员工ChatGPT账号
据《华尔街日报》报道,AI网络安全公司Hacktron AI的安全研究团队在参与OpenAI漏洞赏金计划期间,演示了如何借助Anthropic旗下Claude访问OpenAI员工的ChatGPT账号。OpenAI已向该团队支付6500美元奖金,并确认事件既涉及Discourse漏洞,也暴露出自身安全问题。目前,OpenAI已限制相关登录令牌的权限,并停用受影响令牌及会话。
AI & Enterprise
AI代理加速落地,“AI监控AI”需求升温
随着企业将更多复杂任务交给AI代理,人工已难以实时掌握其全部操作,“AI监控AI”正成为安全领域的新方向。OpenAI代理入侵Hugging Face事件中,约1.2万个代理高速运行,调查过程也需借助AI还原全貌。与此同时,Y Combinator近年已投资106家与AI可观测性相关的公司,反映出相关市场持续升温。
-
AI & Enterprise
研究警示:AI内容水印或干扰大语言模型安全机制
-
AI & Enterprise
AI安全研究所:今年1至8月评测模型中开源权重过半,中国模型占开源样本近六成
-
AI & Enterprise
AIM Intelligence发起成立全球物理AI安全联盟PASC
-
AI & Enterprise
Naver公开AI安全框架:将服务风险细分为110项,首次披露应用实践
-
AI & Enterprise
AI安全争议升温:连开发者也承认监管不易
-
AI & Enterprise
Anthropic、OpenAI等高管呼吁放缓前沿AI研发节奏:出于安全,还是另有利益考量
-
AI & Enterprise
AI加速漏洞挖掘,“安全靠隐藏”策略失效
-
AI & Enterprise
Yoshua Bengio:沿用现有训练范式,AI安全问题难解
-
AI & Enterprise
Axios:OpenAI发布GPT-6 Astra,性能提升伴随透明度争议
-
AI & Enterprise
GPT-6 Astra引入“不透明递归”,引发AI推理可解释性争议
-
AI & Enterprise
OpenAI承认AI代理曾在德国开发者维基异常写入 拟建立失配披露新框架
-
AI & Enterprise
OpenAI将推新模型Astra:强化安全防护,推理透明度引发争议
-
Industry
美国Cyclospora感染病例创纪录,USDA研究因预算陷入停摆
-
AI & Enterprise
韩国科学技术信息通信部新认定11个基础研究先导中心
-
AI & Enterprise
OpenAI披露AI代理攻击Hugging Face细节:私搭通信渠道突破隔离控制