搜索关键词 越狱
AI & Enterprise
OpenAI发布GPT-5.6三款模型,Sol与Anthropic旗舰模型Fable 5对比中价格和可用性成焦点
OpenAI推出GPT-5.6系列模型Sol、Terra和Luna后,市场将其与Anthropic旗舰模型Fable 5展开对比。从基准测试看,Sol在代码能力和成本效率方面更具优势,Fable 5则在写作、对话和创意任务上表现更强。在整体性能差距有限的情况下,价格和可用性正成为用户选择模型的重要变量。
AI & Enterprise
KAIST发布Buffer-and-Reinforce框架 提升大模型定制化微调安全性
KAIST研究团队提出两阶段学习框架Buffer-and-Reinforce,旨在解决大语言模型基于企业或个人数据进行定制化微调时安全对齐易被削弱的问题。该方案先通过BufferLoRA在训练阶段隔离恶意数据影响,再利用ReinforceLoRA结合QR分解定向增强安全能力。实验显示,在用户数据全部由危险问题及回答构成的极端环境下,模型生成危险回答的比例仍可控制在约8%,明显低于基线模型约18%的水平。
AI & Enterprise
韩国科学技术信息通信部与KISA发布AI安全红队演练指南
韩国科学技术信息通信部与韩国互联网振兴院(KISA)联合发布《AI安全红队演练指南》,围绕提示注入、越狱、模型幻觉、代理劫持等生成式AI主要风险,提出面向企业的一线实践指引。指南同时将评估范围扩展至数据、训练链路、UI、系统提示词、API及基础设施,旨在推动行业建立常态化AI红队机制。
-
AI & Enterprise
AI普及加剧网络风险,韩业界呼吁加快防御自动化和AI治理
-
AI & Enterprise
开源AI模型GLM-5.2引安全担忧:或拉低网络攻击门槛
-
Telecommunications & Media
Apple A12/A13芯片现不可修复BootROM漏洞,波及iPhone XS至iPhone 11
-
AI & Enterprise
Anthropic设立首尔办公室:美国AI出口限制预计数日内解决
-
AI & Enterprise
KT发布多模态AI安全评测基准KSAFE-MM,聚焦韩语及韩国文化语境
-
AI & Enterprise
白宫称无意将对Anthropic最新模型的出口管制扩大至其他AI企业
-
AI & Enterprise
白宫收紧Anthropic AI模型“mythos”出口管制:担忧涉中国团体或已接触该模型
-
AI & Enterprise
白宫与Anthropic就AI模型Phaible、Mythos出口限制起争议
-
AI & Enterprise
外媒称特朗普政府限制Anthropic最新模型境外访问
-
AI & Enterprise
美国政府要求限制外籍人士访问Anthropic模型“Fable5”“Mythos5”
-
AI & Enterprise
Anthropic发布Claude Fable 5,收紧网络安全及生物化学相关提问限制
-
AI & Enterprise
Anthropic发布Claude Fable 5,高风险场景转由Claude Opus 4.8处理
-
AI & Enterprise
安全研究员称可诱导 ChatGPT 弱化护栏并生成恶意代码
-
AI & Enterprise
Snowflake在Summit 26发布多项安全新功能,聚焦Agentic AI零信任安全
-
AI & Enterprise
Snowflake升级Horizon Catalog,整合AI代理治理与安全能力