搜索关键词 基准评测
AI & Enterprise
Artificial Analysis:韩国AI跻身全球前三,但仍需补齐与中美头部模型差距
AI评测机构Artificial Analysis表示,受益于主权基础模型项目推动,韩国已跻身全球前三的AI国家之列,但在模型智能水平上仍落后于中美头部模型。该机构建议,韩国应依托先进制造、科学AI等优势领域拓展应用,同时持续加强AGI及通用能力研发。Artificial Analysis还预计,未来AI评测重点将从问答能力转向真实任务执行能力。
AI & Enterprise
SpaceXAI发布Grok 4.6:综合评分与OpenAI持平,软件工程与终端操作测试领先
SpaceXAI推出新一代AI模型Grok 4.6,综合评分与OpenAI的GPT-5.6 Sol Max持平。该模型主要面向多步骤连续执行的Agent场景,并强化了对话交互中的可视化生成能力。在软件工程和终端操作两项基准评测中,Grok 4.6表现领先对比模型,目前已通过Grok Build、Cursor、Grok Bot和API等渠道上线。
AI & Enterprise
SK Telecom进入“自主AI基础模型”项目第二阶段,A.X K1推进多模态升级
SK Telecom牵头的团队已进入韩国政府“自主AI基础模型”项目第二阶段,并将分阶段提升A.X K1的多模态能力。该模型为5190亿参数级大模型,在项目第一阶段NIA基准评测中获得满分10分中的9.2分,在5支团队中与LG AI Research并列第一。第二阶段将率先支持图像相关能力,后续再扩展至语音和视频。