搜索关键词 MoE模型
AI & Enterprise
全球AI竞争升温:OpenAI、Meta等转向比拼成本效益
全球AI行业的竞争重心正从单纯比拼性能,逐步转向兼顾价格与成本效益。OpenAI、SpaceXAI、Meta等头部厂商在发布新模型时,纷纷强调Token使用效率和定价优势;企业用户则持续要求进一步压低AI使用成本。与此同时,Microsoft、AWS等公司也在通过调整产品布局和技术路线推进降本增效。
Industry
NVIDIA在韩开放700万条合成人物画像数据,加速复制“CUDA式”生态路径
NVIDIA近期在韩国持续加码AI资源布局,先后在Hugging Face发布并开放包含700万条韩语合成人物画像的Nemotron-Personas-Korea数据集,并追加发布多模态推理模型Nemotron3 Nano Omni。业界认为,NVIDIA正通过模型、数据、框架和硬件四个层面同步推进生态布局,在降低开发门槛的同时,进一步把训练和推理的最优环境引向自家GPU技术栈。
Industry
NVIDIA:AI芯片竞争转向端到端效率,Blackwell在MoE推理中较上一代Hopper快55倍
NVIDIA在首尔举行的开发者活动上表示,AI竞争重心正从单一芯片参数比拼转向覆盖预训练、后训练、推理及Agent应用的端到端效率。公司首次披露实测数据称,Blackwell GPU在混合专家(MoE)推理中的速度较上一代Hopper提升55倍,并介绍了NDFP4、PivotLM、NemoTron Cascade等多项提升训练与后训练效率的新进展。