搜索关键词 本地推理
AI & Enterprise
OpenAI拟在韩国推出“推理驻留”,洽谈GPU及云基础设施合作
OpenAI正筹备在韩国推出“推理驻留”服务,计划把韩国用户的AI推理请求放在本地数据中心处理。目前,OpenAI已支持数据驻留,但模型推理环节仍可能调用海外算力。公司表示,相关服务何时落地,取决于韩国本地GPU供应及配套云基础设施的准备情况。
AI & Enterprise
Perplexity推出Portable Computer,发力本地AI代理
Perplexity推出AI代理平台Computer的本地版本Portable Computer,面向NVIDIA DGX Spark和搭载RTX GPU的Linux设备开放。本地运行时,模型、用户文件和任务结果均在设备端处理,且不计入使用额度;如需调用更强的云端模型,须经用户授权。公司同时披露了基准测试结果及订阅开放计划。
AI & Enterprise
企业AI落地提速,工作站需求升温:本地算力成云端短板重要补充
随着企业AI加快进入实际业务场景,面向本地部署的AI基础设施需求持续上升。业界普遍认为,单纯依赖云端在成本、数据主权和隐私保护方面存在明显限制,结合云端与本地资源的混合部署正成为更现实的选择。Dell、Intel与IDC联合发布的报告显示,工作站在AI开发多个环节的应用比例正在提高,但企业IT政策、采购标准及成本认知仍是普及过程中的主要障碍。