AIGC·非著名程序员
26-05-12 20:55 微博认证:微博新知博主 科技博主 头条文章作者 微博原创视频博主

Andrej Karpathy 最近分享了一个很实用的小技巧:跟 AI 对话的时候,在问题最后加一句"把回答用 HTML 格式输出",然后用浏览器打开生成的文件,阅读体验会好很多。他自己试过让 AI 把内容做成幻灯片,效果也不错。

他更深层的思考是关于人和 AI 之间的信息传递方式。他觉得人类给 AI 输入信息,语音是最自然的方式;而 AI 给人类输出信息,视觉才是最高效的通道。毕竟我们大脑大概三分之一的区域都在处理视觉信息,这相当于一条十车道的高速公路,带宽远超文字阅读。

他列了一个 AI 输出形式的演进路线:最早是纯文本,读起来费劲;然后是 Markdown,有了加粗、标题、表格,稍微好看一点,这也是现在的主流;接下来就是 HTML,虽然底层还是代码,但在排版、图形、交互性上灵活太多了,正在成为新的默认选项。再往后看,终极形态可能是某种由神经网络直接生成的交互式视频或模拟环境,类似最近很火的那些 AI 生成的沉浸式体验。

输入端同样有改进空间。光靠语音、文字或视频都不够,比如你经常需要指着屏幕上的某个东西跟 AI 说"就是这个",就像你身边坐着一个人帮你看电脑一样。

评论区的反馈也很有意思。有人说用了一周 HTML 输出,方向是对的,但每次回复的 token 消耗是 Markdown 的两三倍,成本不低。也有人提到 Claude 有时候会自己主动生成 HTML 来展示结构化信息。还有 Meta 的员工说他们内部天天互相发 HTML 做报告和原型,但没法直接评论协作,只能截图发群里聊。

总的来说,人和 AI 之间的沟通界面还处于很早期的阶段,在脑机接口真正到来之前,光是在输入输出的形式上做文章,就还有巨大的提升空间。

#科技先锋官##How I AI#

发布于 山东