搜索关键词 AI基准测试
AI & Enterprise
Sam Altman称OpenAI可将GPT-5.6 sol价格压至Claude Fable5的四分之一
OpenAI表示,旗下主力模型GPT-5.6 sol仍有进一步降价空间。Sam Altman称,该模型当前价格约为Anthropic旗下Claude Fable5的一半,如有必要甚至可压至后者的四分之一;同时,在不少相同任务场景下,GPT-5.6 sol的代币使用效率约为后者两倍。随着中国大模型厂商和云平台持续下探价格,企业级AI市场竞争进一步加剧。
AI & Enterprise
KT自研大语言模型MiDeum K 2.5 Pro获TTA AI可信认证2.0
KT宣布,自研大语言模型MiDeum K 2.5 Pro已获得韩国信息通信技术协会(TTA)AI可信认证2.0(CAT)。该模型参数规模为320亿,定位面向企业场景的闭源大语言模型,主要服务于业务自动化、客户服务和内部办公等用途。与此同时,MiDeum K 2.5 Pro在AAII V3.0与Tau-Square两项基准测试中也取得了较好成绩。
AI & Enterprise
Meta旗舰AI模型MuseSpark将推新版本:代码与AI Agent能力升级
Meta即将推出旗舰AI模型MuseSpark的新版本。首席AI官(CAO)Alexander Wang近日在X平台表示,新版“很快”发布。按其说法,下一代模型将重点提升代码能力,并优化AI Agent相关表现。与此同时,SiliconANGLE援引Meta内部测试称,开启“熟虑模式”后,MuseSpark在HLE基准中的得分提升了8%。
-
AI & Enterprise
Google将Gemini 3.5 Pro发布时间推迟至7月
-
AI & Enterprise
OpenAI据传小范围测试GPT-5.6:部分ChatGPT账号疑接入新模型,输出增强但响应变慢
-
AI & Enterprise
xAI上线Grok Imagine Video 1.5 Fast,6秒720p视频最快25秒生成
-
AI & Enterprise
DeepSeek将V4 Pro促销价转为正式定价,降幅达75%
-
AI & Enterprise
Moonshot AI发布开源大模型Kimi-K2.6,称多项基准测试成绩超越GPT-5.4和Claude Opus 4.6