搜索关键词 长上下文
AI & Enterprise
Lightbits Labs推出AI推理引擎Infera:扩展KV缓存以提升GPU利用率
Lightbits Labs正式推出AI推理软件引擎Infera,核心在于将KV缓存从容量有限的GPU HBM中扩展出来,并借助预测式预取在HBM、DRAM和NVMe之间进行分层管理。该产品主要面向长上下文、高并发会话等大语言模型推理场景,旨在提升性能表现和成本效率。
AI & Enterprise
OpenAI推出GPT-6 Astra:3D与游戏开发能力突出,写作表现逊于前代
OpenAI于9月3日推出GPT-6 Astra。早期用户反馈显示,该模型在3D空间重建、游戏开发和桌面任务方面表现亮眼,在OSWorld 2.0测试中的任务完成率达到72.6%。不过,在写作基准测试及部分外部评测中,Astra的表现不及GPT-5.6 Sol。与此同时,其网络安全能力明显增强,正通过ChatGPT、API以及Microsoft Azure、AWS Bedrock等渠道逐步开放。
AI & Enterprise
韩国“自主AI基础模型”项目5支团队开放训练数据 在AI Hub开放下载
韩国科学技术信息通信部和韩国智能信息社会振兴院(NIA)27日表示,Naver Cloud、Upstage、SK Telecom、NC AI、LG AI Research等“自主AI基础模型”项目首阶段5支团队,已将开发过程中建设的大规模训练数据在AI Hub对外开放。此次公开数据共29类、约3544万条,折合约1.56万亿Token,覆盖预训练、多模态、后训练及红队测试等多个方向。
-
AI & Enterprise
NVIDIA宣布Groq 3 LPX进入量产:面向AI代理,基准测试生成速度最高达每秒3400个token
-
AI & Enterprise
韩国科学技术信息通信部启动新一代AI基础研发:以物理和数学提升科学预测可靠性
-
Telecommunications & Media
SK Telecom通过韩国自主AI基础模型第二阶段评估,加速布局多模态与AI Agent
-
AI & Enterprise
调查:企业导入AI代理治理层后,错误回答比例不降反升
-
AI & Enterprise
Upstage发布大语言模型Solar Pro 4,接入OpenRouter等平台
-
AI & Enterprise
SK Telecom与MIT联合研究TTT技术 提升自研基础模型推理效率
-
AI & Enterprise
SKT推出A.X K2基础模型,瞄准“执行型AI”
-
AI & Enterprise
LG AI Research开源7500亿参数模型K-EXAONE 2.0,登陆Hugging Face
-
AI & Enterprise
SK Telecom发布6880亿参数自研模型A.X K2,加快产业场景落地
-
AI & Enterprise
韩国发布Agentic AI倡议 推进“人人一个AI代理”
-
Games & Commerce
Naver详解“AI标签”核心技术:从回答走向执行
-
Mobility
XPeng公布自动驾驶AI框架X-Mind:先预测未来路况,再生成驾驶决策
-
AI & Enterprise
Dinothicia开源STAR-KV技术,缓解大语言模型推理内存瓶颈
-
AI & Enterprise
Z.ai发布开源模型GLM-5.2:基于Huawei Ascend AI加速器训练,FrontierSWE成绩接近Claude Opus 4.8
-
AI & Enterprise
外媒实测Gemini 3.5 Flash:代码生成、长上下文推理与多模态任务表现突出