搜索关键词 AI基准测试
AI & Enterprise
韩国“独立AI基础模型”二轮评审引入公众测评,200人体验4款模型打分
韩国政府“独立AI基础模型”项目二轮评审首次引入公众测评。200名按照人口统计结构随机抽取的普通公众,分别体验LG AI Research、SK Telecom、Upstage和Motif Technologies的4款模型,并围绕对话、摘要、创作和安全4个维度打分。相关结果将纳入二轮评审,用于选出3支进入下一阶段的团队。
AI & Enterprise
Sam Altman称OpenAI可将GPT-5.6 sol价格压至Claude Fable5的四分之一
OpenAI表示,旗下主力模型GPT-5.6 sol仍有进一步降价空间。Sam Altman称,该模型当前价格约为Anthropic旗下Claude Fable5的一半,如有必要甚至可压至后者的四分之一;同时,在不少相同任务场景下,GPT-5.6 sol的代币使用效率约为后者两倍。随着中国大模型厂商和云平台持续下探价格,企业级AI市场竞争进一步加剧。
AI & Enterprise
KT自研大语言模型MiDeum K 2.5 Pro获TTA AI可信认证2.0
KT宣布,自研大语言模型MiDeum K 2.5 Pro已获得韩国信息通信技术协会(TTA)AI可信认证2.0(CAT)。该模型参数规模为320亿,定位面向企业场景的闭源大语言模型,主要服务于业务自动化、客户服务和内部办公等用途。与此同时,MiDeum K 2.5 Pro在AAII V3.0与Tau-Square两项基准测试中也取得了较好成绩。
-
AI & Enterprise
Meta旗舰AI模型MuseSpark将推新版本:代码与AI Agent能力升级
-
AI & Enterprise
Google将Gemini 3.5 Pro发布时间推迟至7月
-
AI & Enterprise
OpenAI据传小范围测试GPT-5.6:部分ChatGPT账号疑接入新模型,输出增强但响应变慢
-
AI & Enterprise
xAI上线Grok Imagine Video 1.5 Fast,6秒720p视频最快25秒生成
-
AI & Enterprise
DeepSeek将V4 Pro促销价转为正式定价,降幅达75%
-
AI & Enterprise
Moonshot AI发布开源大模型Kimi-K2.6,称多项基准测试成绩超越GPT-5.4和Claude Opus 4.6