AI 时代的人类心智入口,到底会被装在什么硬件里
Published:
抢占 AI 时代的人类心智入口,说到底是一场关于 token 吞吐权力的隐秘战争。
朋友 boj 之前分享了他在一两年前订购的 Limitless 录音吊坠。这玩意当初只花了他几十美金,后来因为各种物流和海关原因被他彻底忘在了脑后,直到两年后突然被清关送到。
那天晚上他带着这个吊坠去吃火锅,回来说效果好得离谱。在人声嘈杂、热气腾腾的火锅店里,这个吊坠竟然把他们聊的绝大多数内容都正确识别了出来,而且打开 think 模式之后,AI 还能把录音里的各种细节分析得井井有条。
Limitless 吊坠里附带了一张小卡片,上面写着一句话,大意是他们的愿景是将人类心智从生物学局限中解放出来。
这句话真的戳中了我。
这不就是今天所有的 AI 开发者和产品经理梦寐以求的愿景吗。
但是这几天的兴奋劲过去之后,我开始琢磨另一个问题。
为了把我们从生物学局限中解放出来,我们到底需要什么样的硬件,到底什么才是真正的 AI 入口。
在传统的移动互联网时代,我们对「入口」这个词并不陌生。
浏览器是入口,应用商店是入口,微信也是入口。谁掌握了入口,谁就掌握了流量的分发权,也就是掌握了用户的注意力和时间。
但除了这些显性的软件入口,还有一个更底层、几乎被大众遗忘的「物理入口」:海底光缆。
虽然我们感觉互联网是“无线”的,但实际上全球有超过 99% 的国际数据流量是依靠深埋在海底的光缆(Submarine Cables)传输的。像 Google 这样的巨头早就不止是提供软件,而是亲自下场成了互联网“物理基础设施”的建设主力。他们在全球投资了数十条专属海底光缆,直接连接亚洲、北美和欧洲。
这种对物理传输权的掌握,直接转化成了恐怖的成本优势。你在全球任何地方刷 YouTube 都极其流畅,而对 Google 来说,YouTube 的带宽成本几乎为零。这是像 B 站(Bilibili)或国内其他视频网站可能永远无法逾越的成本天堑——它们每年都要向运营商支付数以亿计的“带宽买路钱”。
这种对「入口」的掌控力在系统层面同样有效。Google 靠安卓掌握了移动端,靠 Chrome 掌握了桌面端。所以当苹果(Apple)挥舞 iOS 隐私政策的大棒,打得 Meta(Facebook)和 Snap 满地找牙时,Google 几乎没受影响。这也是为什么扎克伯格现在倾全公司之力去赌 META 的硬件,他受够了寄人篱下,他必须拥有自己的流量入口。
但在 AI 时代,入口的定义变了。
现在的 AI 智能体不再是通过精美的 UI 界面和我们交互,而是直接通过吞吐 tokens 来替我们完成任务。
你输入声音、画面、文本,它输出思考、指令、动作。
从这个角度来看,未来的 AI 时代,谁能最直接、最无摩擦地捕获我们日常生活的输入 tokens,并且最快、最准地输出我们想要的交付 tokens,谁就是那个真正的系统级别的人类心智入口。
这不再是流量的争夺,而是注意力和思考的无缝托管。
为了抢占这个心智入口,现在所有人都在发了疯一样做硬件。
市面上冒出了各种奇奇怪怪的载体,包括录音笔、智能眼镜、智能手环、还有智能戒指。
我跟不少做硬件和做 AI 的朋友聊过,大家对这些载体的看法分歧很大。
我们不妨把这四个载体拿出来逐一盘盘,看看它们的 game 点到底在哪。
第一个是录音笔或者吊坠,比如 boj 拿到的那个 Limitless。
这玩意的优势非常明显,就是几乎没有摩擦。充一次电能录十几个小时,挂在脖子上或者别在衣服上,你完全可以忽略它的存在。它悄无声息地记录你听到的、说过的每一句话,成了你的第二大脑。
但它的硬伤也同样致命,就是没有眼睛,也没有一个好用的主动输出渠道。它只能被动地记录声音,如果你想在公共场合跟它频繁交互,大声说话会显得像个疯子。
第二个是智能眼镜。
我朋友里体验过智能眼镜的人,反馈确实非常惊艳。它不仅拥有录音笔的功能,最牛逼的是它拥有一双和我们一模一样的眼睛。
你想意会一下,眼镜能看到你看的一切,听到你听的一切。第一人称视角的视觉输入,是这个世界上最丰富、最高维度的 token 输入源。它不需要你拿出手机拍照或者打字描述,它直接跟你共享视网膜上的上下文。
但眼镜的痛点也在于它太重了,电池续航很难突破,而且在很多社交场合,戴着一个能随时录音摄像的眼镜会让对面的人感到浑身不自在。更重要的是,我们怎么去控制它,难道每次都要用语音大声喊出指令吗。
这时候,第三个载体智能手环或者手表,以及第四个载体智能戒指,就展现出了它们独特的价值。
手环和戒指其实不应该被看作是独立的 AI 硬件,它们更像是这套感官网络里的控制中枢。
戒指戴在手指上,可以作为全家智能家居或者其他设备的物理开关,甚至能通过微小的手指动作实现盲操。
手环则更进一步,它长年贴在我们的手腕上,不仅能监测体征,还能在眼镜需要悄无声息地交互时,通过微小的手势或者骨导打字技术来实现静音输入。
顺着上面的盘点聊下去,你会发现一个很有意思的结论。
没有任何一个单一的硬件能独自成为完美的 AI 入口。
真正的 AI 时代入口,绝对不会是又一个塑料感满满的、需要你拿在手里摆弄的独立硬件,更不会是现在这个把我们困在椅子上的、发着光的玻璃砖块。
屏幕是这个时代最大的隔阂。
我们在上一篇关于乔布斯的博客里聊过,乔布斯当年用多点触控干掉了物理键盘,如果他今天还在,他一定会想方设法干掉屏幕。
未来的 AI 入口,其实是一个分布式的感官网络。
它是由一副轻便的、共享第一视角的智能眼镜负责看,一个贴身的录音吊坠负责听,一个戴在手上的戒指或手环负责静音控制,再配合一个戴在耳朵里的隐形耳机负责反馈。
这套网络就像一层隐形的空气一样笼罩着我们。
你不需要低头看屏幕,不需要点开一个个红点闪烁的 App,也不需要焦虑地在不同的 SaaS 面板之间反复横跳。
你只需要像往常一样生活、观察、说话,AI 在背后默默地捕获这些 token,替你把脏衣服洗干净送回来。
这才是真正的零摩擦,这才是真正的把人类心智从生物学局限中解放出来。
这块给正在做 AI 产品和硬件创业的朋友们提个醒。
别再去想怎么做一个更好的手机 App,或者怎么在智能手机里抢占地盘了。
我们要去适应一个没有屏幕、没有显性 UI 交互的新生态。
如果你的服务不能在三秒钟之内,被这个分布式的感官网络通过 API 悄无声息地调用并且准确返回结果,那在未来的智能生态里,你的产品就等于不存在。
真正有价值的 AI 产品,应该是无形的。
它就像一辆重新设计的心灵自行车。
四十年前,乔布斯说计算机是心灵的自行车,让我们以难以想象的效率前进。
但过去几十年,这辆自行车被装上了太多繁琐的仪表盘 and 需要学习的按钮,普通人骑上去只觉得累。
现在,AI 终于给了我们一次机会,把所有的按钮都拿掉,只留下纯粹的骑行体验。
你只要踩下去,它就带你飞奔,你甚至感觉不到自行车的存在。
这就是我们正在见证的变革。
它不是什么酷炫的科技展示,而是一种悄无声息地、把人类心智从生物学遗忘和迟钝中解救出来的日常魔法。
说真的,我已经有点等不及了。
