搜索关键词 回答质量
AI & Enterprise
KT自研AI模型路由技术AutoModelRouter跻身全球公开基准测试第二
KT宣布,其自研AI模型路由技术AutoModelRouter在全球公开基准测试中综合排名第二。该技术在Rice University研究团队开发的Router Arena平台上,围绕约8400条查询,从回答准确性、成本效率及鲁棒性等维度接受评估。目前,AutoModelRouter已应用于KT“Token Factory”的模型路由能力,用于同步提升服务质量并优化成本。
AI & Enterprise
OpenAI内部项目“Project Lily”曝光:人工审阅ChatGPT真实对话做评估
据报道,OpenAI正通过内部项目“Project Lily”评估ChatGPT回答质量,数百名合同人员会阅读真实用户对话并进行打分。公司称会借助隐私过滤器屏蔽姓名、地址等个人信息,但罕见姓名及部分上下文相关信息仍可能漏检。用户可在“设置-数据控制”中关闭“为所有人改进模型”,降低之后的新对话被用于模型训练的可能性。
AI & Enterprise
Liner发布Model API:自动路由LLM,Token成本可降50%以上
AI智能体初创公司Liner推出“Liner Model API”,可根据用户提问的难度和类型自动路由不同大语言模型(LLM)。公司称,该产品可在保证回答质量的前提下,将LLM的Token成本降低50%以上。Liner披露的测试结果显示,约43%的问题会被分配给高性能模型,其余57%由高性价比模型处理。
-
AI & Enterprise
Anthropic回应Claude文本水印争议:不影响质量,将开放免费检测API
-
AI & Enterprise
AI数据争夺战升温:训练重心从聊天问答转向人类工作流程
-
Games & Commerce
Naver押注线下支付,Kakao发力对话意图,AI时代“生活数据”争夺加剧
-
AI & Enterprise
Anthropic研究:Claude回答风格因模型版本和语言而异
-
Games & Commerce
Naver详解“AI标签”核心技术:从回答走向执行
-
AI & Enterprise
Meta旗舰AI模型MuseSpark将推新版本:代码与AI Agent能力升级
-
AI & Enterprise
ChatGPT iOS版藏有推理强度选项:可按问题复杂度切换
-
AI & Enterprise
研究称:用ChatGPT核对医生、律师建议,或削弱后续合作意愿
-
AI & Enterprise
研究称:让大模型扮演“专家”未必更准,编程和数学任务表现反而下滑
-
AI & Enterprise
Cellon获Primer和The Ventures种子轮融资,推进Memory.inc产品升级
-
AI & Enterprise
Anthropic Claude Code用量限制引争议:月费100美元套餐也迅速触顶
-
AI & Enterprise
Google推出TurboQuant:向量搜索索引生成时间接近归零,或重塑搜索体验
-
AI & Enterprise
TechRadar:原样重复提问2至3次,可提升ChatGPT等AI回答质量
-
AI & Enterprise
KT完善“负责任AI”体系 助推企业AX落地