搜索关键词 Claude 3.5 Sonnet
AI & Enterprise
Lunit、KAIST冲刺韩国产业专用基础模型最终评估,9月9日见分晓
韩国“产业专用基础模型”首批医疗和生物领域项目正进入终评冲刺阶段。入选的Lunit与KAIST两大联合体将于9月9日接受最终评估,其中Lunit已把实证范围扩大至全国9家医院,并将实证数据用于持续训练;KAIST则计划把K-Fold模型规模由2B扩大至7B,同时推进SaaS和本地部署落地。
AI & Enterprise
研究:GPT-4o与Claude 3.5 Sonnet在斯特鲁普测试中准确率随题量上升明显下滑
发表在《PNAS Nexus》的一项研究显示,GPT-4o和Claude 3.5 Sonnet在斯特鲁普测试中一旦遇到词义与颜色冲突,表现便明显下降,且题目越多,准确率下滑越显著。研究团队随后对GPT-5、Claude Opus 4.1和Gemini 2.5 Pro进行补充测试,结果同样显示提升幅度有限。论文认为,这反映出现有Transformer架构在执行注意力和目标导向控制机制上的不足,或将成为AI进一步迈向AGI的制约因素。
AI & Enterprise
韩国医学、生物领域AI基础模型通过中期评估 转入第二阶段开发
韩国科学技术信息通信部公布“AI专用基础模型”项目中期评估结果。Lunit开发的16B医学模型和KAIST开发的2B蛋白质结构预测模型均获得80分以上,达到进入第二阶段的标准。两大联盟后续将继续扩充模型规模,并在医院及机构推进实证验证,相关模型还将于4月初开源发布。