Karpathy cho rằng AI nên đảm nhận phần sắp xếp lại ý tưởng thay cho người dùng. Ảnh: Shutterstock

Andrej Karpathy, nhà nghiên cứu AI tại Anthropic, cho rằng để khai thác hiệu quả AI tạo sinh, người dùng không nhất thiết phải mất công viết prompt quá chỉn chu. Theo ông, cách làm hiệu quả hơn là bật tính năng giọng nói, nói liền mạch theo mạch suy nghĩ và để AI tự sắp xếp lại nội dung.

Business Insider ngày 24/7 (giờ địa phương) cho biết Karpathy thường dùng chế độ giọng nói khi làm việc với AI. Thay vì ngồi chỉnh từng câu chữ, ông nói tự do trong khoảng 10 phút về những suy nghĩ liên quan đến dự án.

Trong bài đăng trên X ngày 22/7, Karpathy mô tả cách làm này là nói theo dòng suy nghĩ, có thể khá lộn xộn và không cần gò bó câu chữ.

Theo ông, thay vì cố viết một prompt hoàn chỉnh ngay từ đầu, người dùng nên truyền đạt cùng lúc những ý tưởng còn rời rạc, băn khoăn hoặc mục tiêu chưa định hình rõ. Khi đó, mô hình ngôn ngữ lớn có thể sắp xếp và hệ thống hóa thông tin tốt hơn.

Karpathy cho rằng trong nhiều trường hợp, LLM cần nhiều ngữ cảnh hơn để hiểu chính xác người dùng muốn gì. Cách hiệu quả là con người nói ra những ý tưởng còn dang dở, còn chatbot sẽ chuyển phần trình bày đó thành một kết quả gọn gàng, mạch lạc hơn.

Về cách sử dụng, ông thường báo trước rằng phần trình bày có thể lẫn lộn, đồng thời quá trình chuyển giọng nói thành văn bản có thể phát sinh lỗi. Sau đó, ông nói dài về dự án và để AI tổng hợp lại các ý chính. Theo Karpathy, cách này giúp mô hình nắm ngữ cảnh tốt hơn và giảm đáng kể phần chỉnh sửa về sau.

Dù vậy, không phải ai cũng đồng tình. Trên X, một số người dùng hoài nghi việc độc thoại dài không phải lúc nào cũng cho kết quả tốt hơn. Một số khác thì chia sẻ trải nghiệm thử nhập liệu bằng giọng nói để kiểm chứng hiệu quả.

Nhận định của Karpathy xuất hiện trong bối cảnh các hãng công nghệ lớn đang tăng tốc cạnh tranh ở mảng AI giọng nói. Đầu tháng này, OpenAI công bố mô hình mới GPT-Live để vận hành tính năng giọng nói của ChatGPT. Công ty cũng giới thiệu một bàn phím mini giá 230 USD, tích hợp phím chuyên dụng để ghi âm, hướng tới việc truyền prompt bằng giọng nói trực tiếp cho AI agent.

Về phía Anthropic, ngày 24/7 công ty cũng thông báo cập nhật tính năng giọng nói. Người dùng có thể chọn các mô hình như Claude Opus, Sonnet và Haiku để tương tác bằng giọng nói.

Giới công nghệ nhận định phương thức nhập liệu cho AI tạo sinh đang dần mở rộng từ văn bản sang giọng nói. Đề xuất của Karpathy vì thế được xem không chỉ là một mẹo viết prompt, mà còn là cách tiếp cận mới trong việc phân chia vai trò giữa con người và AI: con người đưa ra suy nghĩ thô, còn AI chịu trách nhiệm sắp xếp và cấu trúc lại.

Karpathy nhấn mạnh người dùng không cần tự tạo áp lực phải viết prompt hoàn hảo ngay từ đầu. Theo ông, để AI xử lý những ý tưởng chưa hoàn chỉnh và các đoạn trình bày dài có thể giúp tiến gần hơn đến kết quả mong muốn với ít chỉnh sửa hơn.

Từ khóa

#trí tuệ nhân tạo #AI tạo sinh #mô hình ngôn ngữ lớn #tính năng giọng nói #ChatGPT #Claude #Anthropic #OpenAI
Copyright © DigitalToday. All rights reserved. Unauthorized reproduction and redistribution are prohibited.