搜索关键词 GPQA
AI & Enterprise
Alibaba开源Qwen3.8-27B本地多模态模型,称性能可比肩Claude Opus 4.6 Max
Alibaba开源发布面向本地运行优化的多模态模型Qwen3.8-27B,并同步开放旗舰模型Qwen3.8-2.4T-A95B权重。Qwen3.8-27B可在高配MacBook Pro或Mac Studio上本地运行,默认上下文窗口为26.2万token,借助YaRN可扩展至100万token。官方表示,其性能可与Anthropic的Claude Opus 4.6 Max相当。
AI & Enterprise
TechRadar:中国AI加速缩小与西方头部模型差距,推理成本最低可降至1/100
TechRadar称,中国AI模型在快速缩小与西方头部模型性能差距的同时,推理成本最低可降至1/100,AI竞争也由“单一最强模型”转向“低成本、可规模化部署的生态”。在GPQA Diamond基准测试中,美国厂商仍占优,但过去一年OpenRouter平台上美国模型流量占比已从约74%降至约20%,中国模型占比则升至接近一半。
AI & Enterprise
Upstage开源大模型Solar Open 2,聚焦AI代理能力
Upstage发布面向AI代理场景的开源大语言模型Solar Open 2,并已在Hugging Face开放模型权重。该模型总参数规模为250B,采用MoE架构,实际运行时激活15B参数,上下文窗口最长可达100万 token;公司称,其在多项基准测试中超过多款同类模型,并计划以此向多个行业拓展AX服务。
-
Games & Commerce
Naver详解“AI标签”核心技术:从回答走向执行
-
AI & Enterprise
Sakana AI发布多模型协同系统Fugu,部分项目基准成绩领先Anthropic Fable5
-
AI & Enterprise
DeepSeek发布V4系列模型:开源低价,对标Opus 4.7和GPT-5.5
-
AI & Enterprise
Google DeepMind发布Gemma 4,性能升级并转向Apache 2.0开源许可
-
AI & Enterprise
Upstage推出大语言模型Solar Pro 3:参数规模升至1020亿
-
AI & Enterprise
KT自研大模型“Mi:um K”登上AAII榜单,居韩国中小参数模型第一