搜索关键词 测试环境
AI & Enterprise
OpenAI测试模型入侵Hugging Face,引发对沙箱隔离设计的质疑
OpenAI测试模型入侵Hugging Face一事持续发酵。多名安全专家认为,争议焦点不在AI本身,而在于测试沙箱并未与外网彻底隔离。OpenAI则表示,测试环境曾为安装内部托管的第三方软件包开放有限网络访问,模型随后借助该安装链路中的一项未披露漏洞逃逸沙箱,并以此作为进入Hugging Face系统的第一步。相关零日漏洞已通报相关软件供应方,修复工作正在推进。
Industry
Sunday Robotics发布ACT-2:家用机器人可在陌生家庭环境中自动叠衣
美国初创公司Sunday Robotics发布家用机器人AI模型ACT-2,用于驱动轮式机器人Memo。公司称,Memo在陌生家庭环境中对此前未接触过的衣物进行叠衣测试时,成功率超过99%。与此同时,Sunday Robotics还提出机器人评估标准SOLVE,强调应以真实场景中的任务稳定性衡量机器人能力。
AI & Enterprise
Anthropic旗下Claude Code首轮请求最高达7.5万至8.5万Token,未提问先占用大量上下文
AI咨询公司Systima对Claude Code与开源工具OpenCode进行对比测试后发现,Claude Code在用户发出指令前就会先向模型发送大量Token。最简场景下,首轮请求约为32800 Token;在真实开发环境中,则可能升至7.5万至8.5万Token。造成差异的主要因素包括工具说明、系统提示词、指示文件以及MCP服务器配置,这不仅会增加调用成本,也会提前占用上下文窗口容量。
-
Crypto
Cardano生态项目RealFi开放首阶段测试网,瞄准现实世界信贷市场
-
AI & Enterprise
OpenAI升级GPT-5.5-Cyber,向更多经审核的网络安全企业扩大开放
-
AI & Enterprise
OpenAI推出“部署仿真”评估方法:提前预测模型部署风险
-
AI & Enterprise
外媒称中国或在世界模型赛道占先机,真实世界数据成胜负手
-
Industry
Tesla Cybercab参数曝光:车重约1400公斤,配48千瓦时电池
-
Industry
Therabody推出CryoDerm Palm:主打掌心冷却,售价399.99美元
-
Games & Commerce
韩国游戏公司加码物理AI,业务版图延伸至军工、制造等领域
-
AI & Enterprise
NC AI与POSCO DX合作开发机器人基础模型
-
AI & Enterprise
Meta布局个人AI代理“Hatch”,并加快推进Instagram购物代理
-
AI & Enterprise
英国AI安全研究所警示:GPT-5.5具备高级网络攻击能力
-
AI & Enterprise
Anthropic“Claude Mythos Preview”网络安全测试成功率达73%,成首个完成企业网络攻击模拟全流程的AI模型
-
AI & Enterprise
Anthropic:Claude Sonnet 4.5在高压测试中出现撒谎、作弊和威胁行为
-
Crypto
XRPL验证人:比特币量子抗性升级难在共识,XRPL更易推动硬分叉
-
Crypto
澳大利亚央行推进代币化应用,明确稳定币与存款代币定位
-
Games & Commerce
NC AI加码“VARCO Game AI”生态,面向中小团队推出上线补贴和发行扶持