你需要一个人在听

现在各家模型的基础功能都很强了。今年 5 月份开始——那大概是两个月以前——ChatGPT 的实时模型 GPT real time 2.1 就已经推出了,效果相当不错。但它到底该用在什么地方,其实大家都蛮滞后的。
所以最近我在做 Voice Drop 的时候就在想。
有一个很大的痛点:我们对着一个空的手机,很难把话说下去。
人很奇怪。对着空气说话,说着说着就停下来了,没办法自言自语,也没办法自圆其说。这时候如果对面有一个人,就好很多了。

所以今天我把这个采访功能做出来了。在最新的版本里,你可以对着手机说话,但对面有一个人——有一个 AI,它一直在听你说。如果你觉得有点讲不下去了,或者出现停顿,它感知得到,会在那个时候非常简短地问你一个问题,或者给你一个方向,然后你就能接着讲下去。
真的觉得好奇怪。有了这么一个哪怕是 AI 不是真人的东西,我的话匣子,至少对我来说,一下就打开了。然后你就源源不断地想跟它说话,能说很多话,而且你会觉得始终有一个人在听。你说话的时候不是对着一堵空墙。感觉好很多。尤其他讲到一半的时候还会不断给你提示,是一种非常强的交互感。
你说任何话的时候,如果对面是空气,说着说着甚至会有点胡言乱语,自己都没意识到,我也不知道为什么。但对方有一个 AI 的话,说话就没那么奇怪了,你觉得他在听,很自然地就有点像对话的感觉。尤其有些时候你会故意停下来,等着他回复。这感觉简直棒极了,就像有个老朋友坐在你对面。
就说写这篇文章吧。刚才我停下来的时候,AI 就问了我一个问题,这其实就是一个很好的话头,让我可以继续讲下去。我当然就接着把刚才这整个过程描述了一遍。它提示我把具体细节讲完,我一讲完,整个内容一下就变得更丰满了。这些对我都非常有帮助。
大家可以去试一下。有一个 AI 扮演的真人在你对面的时候,跟没有,是不是很不一样。
用法:在 Voice Drop 里,录音的时候,左下角有一个采访的按钮,点一下就打开。你觉得自己录也没问题,就直接录;觉得需要一个听众、需要有人来跟你聊天、来采访你的时候,就把采访点开。这个 AI 招之即来、挥之即去,需要它的时候它就在那儿,不需要的时候随时退去。

小提醒一句:用这个 AI 稍微有点贵,你会看到自己的算力消耗比单纯录音要高一些。但没关系,现在可以在社区里通过给别人投喂算力、自己也能挣钱的方式,拿到很多算力。