搜索关键词 安全对齐
AI & Enterprise
Z.ai发布网络安全模型GLM-5.3:两周内开放权重,CyberGym得分84.5%
中国AI初创公司Z.ai发布网络安全专用模型GLM-5.3,称其在漏洞检测、漏洞利用分析和多阶段安全任务上的能力较上一代明显提升。该公司计划在两周内开放模型权重,并先向安全合作伙伴分阶段开放评估与API访问。基准测试显示,GLM-5.3在CyberGym中得分84.5%,在ExploitBench中升至54.4%;同时,Z.ai还推出OpenVuln计划,支持开源项目安全审计、漏洞披露与修复。
AI & Enterprise
SSI与NVIDIA达成长期合作,将获“Vera Rubin”平台支持
AI研究机构SSI已与NVIDIA达成长期合作,将获得后者下一代GPU平台“Vera Rubin”的支持,以提升研究算力。据TechCrunch报道,这项合作还包含一笔未披露投资,NVIDIA对SSI的投资规模或达数十亿美元。PitchBook数据显示,SSI迄今累计融资已达70亿美元,投后估值为320亿美元。
AI & Enterprise
KAIST发布Buffer-and-Reinforce框架 提升大模型定制化微调安全性
KAIST研究团队提出两阶段学习框架Buffer-and-Reinforce,旨在解决大语言模型基于企业或个人数据进行定制化微调时安全对齐易被削弱的问题。该方案先通过BufferLoRA在训练阶段隔离恶意数据影响,再利用ReinforceLoRA结合QR分解定向增强安全能力。实验显示,在用户数据全部由危险问题及回答构成的极端环境下,模型生成危险回答的比例仍可控制在约8%,明显低于基线模型约18%的水平。