据The Information当地时间18日报道,由清华大学教授于今年2月创立的北京AI模型初创公司 Naive AI,近期在三轮融资中累计获得4亿美元投资,投资方包括腾讯,公司投后估值已超过14亿美元。
Naive AI 计划最早于本月发布首款大语言模型(LLM)。该模型将以开放权重形式对外发布,路径与 DeepSeek、Moonshot、阿里巴巴 等公司相似。
报道称,Naive AI 由清华大学教授 Daijipeng 创立。过去10年,Daijipeng 的研究方向主要涵盖深度学习、计算机视觉、基础模型与AI智能体。
与从零开始训练模型不同,Naive AI 并未选择完全自建预训练体系,而是基于中国现有的开放权重模型进行开发,以绕开成本高昂的预训练环节。不过,报道并未确认其具体采用了哪一款模型作为底座。
目前,中国大语言模型市场主要由大型科技公司,以及 DeepSeek、Moonshot、Z.ai 等企业推动。The Information称,在这一格局下,Daijipeng 认为,若团队能够在中期训练、后训练等研发后期环节持续提升模型性能,仍有机会切入市场。
Naive AI 的研发重点,是围绕已完成预训练的模型进行架构调整和优化,并通过强化学习等方式提升模型在多任务场景下的表现。公司还在推进“递归自我改进”相关研究,即让AI模型具备自我迭代和持续提升能力。OpenAI、Anthropic、Google 等多家AI开发机构均将这一方向视为关键课题。
报道还指出,基于外部机构模型开发LLM的路径,也已被部分美国AI公司采用。由前OpenAI高管 Mira Murati 领衔的 Thinking Machines Lab 在7月发布首个LLM“IncLing”时披露,其采用了2024年底推出的 DeepSeek V3 开放权重模型。此外,目前已归属 SpaceX 的 Cursor 也曾基于 Z.ai 的模型开发自有编程模型。