半小時拚出一個 AI 說唱影片工具:免提示詞這件事,比技術本身更值得看
開發者在 V2EX 分享用半小時做出的 AI 二人說唱影片生成工具,本文從「免提示詞」的產品設計看這類小工具的走紅邏輯。
文|沈安
9 月 30 日,V2EX「分享創造」板出現一篇帖子,作者表示自己花了半小時,做出一個 AI 生成二人說唱影片的工具,並附上體驗網址。帖子發布後累積七百多次瀏覽,討論度不算爆炸,但這個「半小時」與「免提示詞」的組合,恰好說明了目前 AI 內容工具正在往哪個方向收斂。
先把可確認的事實講清楚:這是一個網頁工具,使用者上傳任意圖片,可以是自己的照片,也可以是卡通人物,系統就會生成一段雙人對唱風格的說唱影片。作者在帖中提到,這類 AI 說唱影片的梗近期在海外社羣平臺上流傳,工具的賣點是「不需要提示詞,非常 rap」。
對一般讀者來說,「免提示詞」三個字聽起來像功能宣傳,實際上它是一種產品設計選擇。過去一年多,AI 生成工具的最大門檻從來不是模型能力,而是輸入端:你得會描述、得試錯、得知道哪些關鍵字有效。把提示詞拿掉,等於把輸入簡化成「傳一張圖、按一個按鈕」,這種體驗對照的正是短影音的使用習慣。手機拍片的人從來不寫腳本,工具如果不遷就這個習慣,就永遠只屬於會寫腳本的人。
「半小時做出來」也值得單獨看。這個數字背後的前提,是把生成能力外包給現成的 AI 服務,開發者做的其實是互動流程與包裝。這與我們先前討論過的AI 把整套軟體寫完、成品裡卻沒有 AI 功能是同一股趨勢的兩面:AI 一面藏在產品底層當引擎,一面也壓低了把點子變成可用網頁的時間成本。當一個工具的開發時間比寫一篇介紹它的帖子還短,競爭的重點就從「做得出來」移到「有沒有人看見、有沒有梗可搭」。
這也是為什麼此類工具總是跟著梗走。海外社羣流行什麼形式,獨立開發者就在幾天甚至幾小時內跟上,工具本身不追求長期使用,而是承接一波注意力的峯值。對想自己做點小東西的人,這個案例的啟發很實際:與其設計一個功能齊全的產品,不如找到一個正在擴散的內容形式,把參與門檻壓到只剩上傳一張圖。
至於這類工具能活多久、生成品質如何,目前來源只有作者的介紹與一個體驗連結,尚無足夠的第三方使用回饋可供判斷。想驗證的人,直接傳張照片試試,會比看任何介紹文都快。