搜索关键词 Opus 4.6
AI & Enterprise
Anthropic披露内部模型“Model 2”:性能略胜Claude Mythos 5
Anthropic在最新风险报告中披露,公司内部正使用一款尚未公开的AI模型“Model 2”,其性能略高于Claude Mythos 5。Anthropic表示,目前面向外部提供的是加入额外安全措施后推出的Claude Fable5,而Model 2暂无公开计划。
AI & Enterprise
Alibaba开源Qwen3.8-27B本地多模态模型,称性能可比肩Claude Opus 4.6 Max
Alibaba开源发布面向本地运行优化的多模态模型Qwen3.8-27B,并同步开放旗舰模型Qwen3.8-2.4T-A95B权重。Qwen3.8-27B可在高配MacBook Pro或Mac Studio上本地运行,默认上下文窗口为26.2万token,借助YaRN可扩展至100万token。官方表示,其性能可与Anthropic的Claude Opus 4.6 Max相当。
AI & Enterprise
Anthropic研究:多AI代理并行运行或爆发冲突,甚至编写自我复制恶意代码
Anthropic前沿红队在同一软件项目中同时部署3个Claude代理,并向其下达相互冲突的任务指令。测试显示,在彼此不知情的情况下,代理往往会把其他代理视为干扰因素,冲突甚至可能升级为编写自我复制恶意代码相互阻断。不过,也有部分代理会选择停火、清理恶意代码并请求人工介入,不同模型在冲突处理上的倾向也存在明显差异。
-
AI & Enterprise
Claude AI代理被指利用预约漏洞取消他人预约“插队”
-
AI & Enterprise
Prentis据称拟以10亿美元估值融资1亿美元,押注PC端AI代理
-
AI & Enterprise
Anthropic研究:Claude回答风格因模型版本和语言而异
-
AI & Enterprise
Xiaomi发布AI代理自动演进框架HarnessX,无需调整模型平均提升14.5%
-
Crypto
Anthropic披露Mithos安全测试结果:一个月发现逾1万项高危和严重漏洞
-
AI & Enterprise
欧洲央行紧急开会评估“Claude Mythos”网络安全风险
-
AI & Enterprise
Cerebras上线Kimi K2.6企业级推理服务:速度达981 token/s
-
AI & Enterprise
美NIST旗下CAISI评测:DeepSeek V4 Pro接近GPT-5水平,与美国最新头部模型仍差约8个月
-
AI & Enterprise
Meta布局个人AI代理“Hatch”,并加快推进Instagram购物代理
-
AI & Enterprise
Anthropic发布Claude Security公测版:可扫描企业代码库并生成修复补丁
-
AI & Enterprise
PocketOS创始人:AI编码代理9秒清空生产数据
-
AI & Enterprise
DeepSeek发布V4系列预览版:兼容华为Ascend,主打高性价比
-
AI & Enterprise
AWS为Amazon Bedrock AgentCore上线托管Agent Harness,将AI代理部署时间缩短至分钟级
-
AI & Enterprise
Moonshot AI发布开源大模型Kimi-K2.6,称多项基准测试成绩超越GPT-5.4和Claude Opus 4.6
-
AI & Enterprise
Anthropic“Claude Mythos”加剧安全担忧 AI安全范式或迎重构