搜索关键词 基准测试
AI & Enterprise
韩国发布Agentic AI倡议 推进“人人一个AI代理”
韩国科学技术信息通信部联合有关部门发布Agentic AI倡议,提出安全可信、开放执行基础设施、需求牵引落地三大方向。根据计划,韩国政府将于年内制定安全可信指南,推进代理市场平台和评测体系建设,并通过“全民AI项目”扩大个人AI代理应用,在多个重点行业开展服务开发与实证。
AI & Enterprise
Upstage开源大模型Solar Open 2,聚焦AI代理能力
Upstage发布面向AI代理场景的开源大语言模型Solar Open 2,并已在Hugging Face开放模型权重。该模型总参数规模为250B,采用MoE架构,实际运行时激活15B参数,上下文窗口最长可达100万 token;公司称,其在多项基准测试中超过多款同类模型,并计划以此向多个行业拓展AX服务。
AI & Enterprise
Poolside推出代码智能体开源模型Laguna S 2.1
AI编码初创公司Poolside于当地时间21日发布面向代码智能体的模型Laguna S 2.1,并开放模型权重。该模型参数规模为1180亿,在Terminal-Bench 2.1和SWE-Bench Pro两项测试中,表现接近DeepSeek-V4-Flash等更大模型,部分指标领先。模型权重已通过Hugging Face在OpenMDW-1.1许可证下公开。
-
AI & Enterprise
韩国“全民AI”项目提速:性能评估标准待明确,竞争力或更多看用户规模
-
AI & Enterprise
OpenAI非上市股二级市场热度回升,GPT-5.6与Codex推动投资需求
-
AI & Enterprise
中国开源权重模型在开发者平台用量反超美国闭源模型,周度token处理量达其3倍
-
AI & Enterprise
OpenAI发布GPT-5.6三款模型,Sol与Anthropic旗舰模型Fable 5对比中价格和可用性成焦点
-
AI & Enterprise
Alibaba预告Qwen3.8即将发布:称综合表现仅次于Claude Fable5
-
AI & Enterprise
开放权重模型升温,OpenAI与Anthropic承压加剧
-
Industry
Moonshot AI发布开源模型Kimi K3:基准测试领先,实际表现仍待检验
-
AI & Enterprise
Moonshot AI拟发布Kimi K3:参数规模或达2万亿至3万亿
-
AI & Enterprise
Sam Altman称OpenAI可将GPT-5.6 sol价格压至Claude Fable5的四分之一
-
AI & Enterprise
韩国拟年内推出“Everyone\'s AI”免费不限量服务,最多分配512块Nvidia B200 GPU
-
AI & Enterprise
Thinking Machines Lab发布Inkling:开放权重,主打企业定制AI
-
AI & Enterprise
OpenAI发布GPT-5.6提示新指南:弱化长指令,强调“结果优先”
-
AI & Enterprise
Z.ai联合创始人Jie Tang:先进AI应尽可能向所有人开放
-
AI & Enterprise
Anthropic将Fable 5免费开放延至7月19日
-
AI & Enterprise
Elon Musk要求Tesla员工优先使用Grok:承认不如Claude,主打成本优势