公司动态

跟AI聊了10分钟废话,硅谷最懂AI的人发现了什么?

📅 2026/7/26 2:18:50
跟AI聊了10分钟废话,硅谷最懂AI的人发现了什么?
安德烈·卡帕西Andrej Karpathy有一个奇怪的习惯。每天早上他会打开手机上的语音模式对着AI助手连续说话大概十分钟。没有提纲没有组织过的思路想到什么说什么——今天要写的代码框架、昨晚读到的论文片段、一个还没想清楚的产品想法甚至是对某条推特的吐槽。全程乱七八糟。然后AI会帮他把这一团乱麻捋成清晰、有条理的文本。这并不是行为艺术。7月25日这位创造了氛围编程Vibe Coding概念、现任Anthropic核心研究员的AI界重量级人物在一次公开分享中透露了这个技巧。他的核心观点出奇简单不要琢磨提示词了想到什么就说什么一直说下去。有时大语言模型需要获得更多信息才能真正明白你想完成什么。卡帕西说。他会在一开始就提醒AI——我的思路可能比较混乱语音转写也可能有错别字——然后就让对话自由流淌。结果呢后面需要纠正的内容少得多。这听起来像反直觉的建议。毕竟过去两年整个行业都在教人们如何写好prompt。提示词工程成了新职业网上充斥着让ChatGPT回答质量翻倍的10个技巧。但现在站在AI研究最前沿的人却说别琢磨了随便聊。从写提示词到聊聊天卡帕西说出这番话的时机很微妙。就在他分享这个建议的同一天他所在的Anthropic刚刚发布了Claude Opus 5。公司声称这款模型在多个领域接近Fable 5的能力——Fable 5是那个曾经惊动美国政府、被短暂下线审查的Mythos级模型。而Opus 5的定价只有Fable 5的一半。更大的变化藏在细节里。Anthropic为Opus 5加入了语音模式用户可以在Opus、Sonnet和Haiku之间自由切换。与此同时OpenAI本月初推出了GPT-Live驱动的全新语音模式——不只是对话ChatGPT现在可以帮你查日历、写邮件、准备会议全程语音操作。为此他们还专门出了一款售价230美元的迷你键盘核心卖点就是那个语音录制按键。这是硅谷正在发生的集体转向。从OpenAI到Anthropic从Google的Gemini Spark到Meta的AI助手所有人都在把重心从键盘输入移向语音交互。不是因为语音识别技术突然变好了——那早就够好了——而是因为这些公司终于意识到了一件事打字是人类和AI之间最糟糕的交互方式。想想看。你每天脑子里闪过的想法、想解决的问题、想验证的猜测有多少是你能坐下来有条不紊地敲进对话框的大多数时候真正的思考是碎片化的、跳跃的、在走路和洗澡时冒出来的。当你需要先把它们组织成prompt才能交给AI时你已经损失了大量信息。卡帕西的10分钟废话策略本质上是在说让AI来承担组织这个工作。这是分工的根本性变化。一场无声的交互革命这件事比它听起来更深远。过去几年的AI产品竞争焦点几乎全在模型能力上——谁的参数量更大、谁的benchmark更高、谁能多处理几万token的上下文。但现在最大的几家AI公司同时在做同一件事把对话的门槛降为零。OpenAI的ChatGPT Health已经面向所有用户开放你可以用语音描述症状、讨论检查结果。Anthropic强调Opus 5最不容易被诱导滥用同时给它配备了更强的网络安全防护——这是在跟美国政府打了几个回合交道之后的产物。Google把Gemini Spark从Ultra专属下放到了Pro用户。Yelp开始把自己的评论数据喂给ChatGPT用户在聊天窗口里就能比较餐厅。每一件事单独看都不算革命性。但合在一起指向的是一个正在形成的现实AI的使用方式正在从写代码变成说话。这会让一大批人感到不适。对于那些花了几个月打磨提示词技巧的人来说卡帕西的建议简直像在拆台。但它也解释了一个一直被忽视的问题——为什么很多人至今没有真正用上AI不是因为不够聪明而是因为需要正确地提问这件事本身就构成了障碍。卡帕西的直觉或许是对的。他描述的是一种更自然的交互模式人负责喷涌AI负责整理。十年前这个分工是反过来的——人类整理好需求交给机器执行。现在机器聪明到可以处理混乱了人类反而应该回到最自然的状态想到什么说什么。当然不是没有代价。Uber刚刚裁掉了10%的客服人员理由是要拥抱AI。Patreon也裁了20%的员工CEO的解释是AI改变了运营和组织方式。这些事件和卡帕西的轻描淡写放在一起构成了某种矛盾的画面一面是硅谷精英们在享受AI带来的智力放大另一面是普通劳动者正在被同一个趋势挤压。但技术扩散的方向从来不由这些矛盾决定。它由最简单的使用体验决定。而当最懂AI的那个人告诉你最好的使用方式是别想了直接说的时候你大概可以相信键盘主导的人机交互时代确实在翻篇了。文中所用图片来源于网络仅供技术学习与交流。如权利人认为存在侵权请联系我们我们将在24小时内处理。