Andrej Karpathy认为,应把提示词整理的负担更多交给模型。图片来源:Shutterstock

Anthropic研究员Andrej Karpathy提出,使用生成式AI时,不必把大量时间花在反复打磨提示词上。相比先把思路整理得足够完整、足够精致,再输入给模型,他更推荐直接通过较长的语音输入,把脑海中的想法顺着思路讲出来,再交由AI负责整理和结构化。

据Business Insider 7月24日报道,Karpathy表示,自己与AI交流时,通常不会刻意修饰表达,而是直接打开语音模式,围绕项目相关的想法连续讲上约10分钟。

在7月22日发布于X(原Twitter)的帖文中,Karpathy将这种方式形容为“完全混乱、什么都允许的意识流(stream of consciousness)”。

他解释称,与其从一开始就追求写出高度完整的提示词,不如一次性把零散的想法、疑问和背景信息都告诉模型。这样一来,大语言模型(LLM)反而更容易理解用户真正想做什么,并据此梳理出更清晰的结构。

Karpathy认为,LLM在很多情况下需要足够多的上下文,才能准确把握用户意图。用户完全可以先把尚未成形的想法说出来,再由聊天机器人将这段“独白”整理成更清晰的输出内容。

在具体操作上,他建议用户在对话一开始先说明,接下来的表达可能比较跳跃,语音转写中也可能出现错词或表述不准确的情况。随后,再尽可能完整地讲出与项目相关的思考,让AI提炼重点并搭建整体框架。Karpathy表示,这样做有助于模型更快进入语境,也能减少后续反复修改。

不过,这一方法并未获得所有用户认同。部分X用户认为,长时间语音输入并不一定总能带来更好的结果,也有人对此持保留态度。同时,也有用户分享了自己的语音输入案例,尝试验证这一方法的实际效果。

Karpathy的这一观点,正值科技公司加快推进语音AI功能之际。OpenAI本月初发布了与ChatGPT语音功能相关的更新,并推出一款售价230美元、配有独立录音按键的迷你键盘,用于将语音提示直接发送给AI agent。

Anthropic也于7月24日公布了语音功能更新。用户现可选择Claude的Opus、Sonnet、Haiku等不同模型进行语音对话。

业内普遍认为,生成式AI的交互方式正从以文本为主,逐步扩展到文本与语音并重,甚至进一步向语音优先演进。Karpathy的建议也被部分观点解读为,语音不再只是输入手段,而正逐步成为帮助用户梳理思路、与AI分工协作的新型交互界面。

Karpathy强调,用户没有必要背负“从一开始就写出完美提示词”的压力。先把不完整的想法和较长的口述内容交给AI进行整理,反而可能以更少的修改成本,更快得到所需结果。

随着语音AI能力持续迭代,这种以长语音输入为基础的交互方式,能否在更大范围内沉淀为新的使用范式,也正在受到关注。

关键词

#Andrej Karpathy #Anthropic #生成式AI #语音输入 #提示词 #LLM #ChatGPT #Claude
版权所有 © DigitalToday。未经授权禁止转载或传播。