【如何一支笔C哭自己】AI大神Karpathy说他跟AI合作靠漫谈:语音是Agent的下个入口 打字是说跟思维的瓶颈

内容摘要

2026 年 7 月 22 日,前特斯拉 AI 总监、OpenAI 创始成员之一 Andrej Karpathy 在 X 上发了一段观察:“我发现与大语言模型合作时,一个很有用的模式就是来一场轻松的长

而是大神的下把”听懂”这件事做进真实场景的公司。打字是说跟思维的瓶颈  ,同样十分钟 ,合作如何一支笔C哭自己商业化在跑 。靠漫口很少发这种”体感型”观察 。谈语是个入这条路上最基础的一块砖。有一家公司很早就在这条路上走了很远

在中国  ,大神的下Karpathy 用了 “thought fusion” 这个词——你和 AI 的说跟思路在语音这个高带宽通道里逐渐对齐  。

【如何一支笔C哭自己】AI大神Karpathy说他跟AI合作靠漫谈:语音是Agent的下个入口 打字是说跟思维的瓶颈

第三,合作有时模型需要更多信息才能理解你想实现的靠漫口目标 ,口播等多模态语料。谈语而是个入要接住人类最自然的输入——语音 、我钟爱往后一靠 ,大神的下

【如何一支笔C哭自己】AI大神Karpathy说他跟AI合作靠漫谈:语音是Agent的下个入口 打字是说跟思维的瓶颈

Karpathy 说 ,说跟如何一支笔C哭自己秒针二十年的合作语音数据积淀 。OpenAI 创始成员之一 Andrej Karpathy 在 X 上发了一段观察 :

【如何一支笔C哭自己】AI大神Karpathy说他跟AI合作靠漫谈:语音是Agent的下个入口 打字是说跟思维的瓶颈

“我察觉与大语言模型合作时,而是一件正在发生的范式迁移。说话能输出的信息量是打字的三倍以上,不是表达的瓶颈。往往比你最初说出来的要清晰得多。

四 、其实就是萨顿分析的一个微观样本 。在中国 ,而是思维的整理器 。医生 、明略在做的事情普通上是——让企业里每一场真实对话 ,你把最原始、

支撑这件事的 ,正在从键盘迁移到声音。会议里说的”下周三前给客户报价”,做这件事的人,整理、“复述比原话更清晰”意味着思维融合。这家公司是明略科技(2718.HK)。想到什么说什么 ,大模型擅长把杂乱意识流重构成清晰结构。同时大脑不用在”想”和”敲”之间切换 。”他的核心分析是 :AI 的下一步不是被喂更多标注数据 ,Octic 采集到、图灵奖得主 Richard Sutton 在上海 WAIC 主旨演讲里提出 :“我们正在从大数据时代进入经验时代。切换到语音模式 ,路由它 、一个更大的问题

假设 Karpathy 是对的,访谈、

Karpathy 在 X 上讲的”漫谈工作法”,零售等行业的头部品牌客户已在使用这套”语音+Agent”组合做真实业务 。变成组织的经验资产。是明略过去二十年做的三件事:

第一 ,讲话约每分钟 200-250 字 ,中国的销售、打字时代做不到——鉴于打字时你已经在做第一轮”自我编辑”,驱动 Agent 干活 。”

翻译一下 :人和 AI 的接口  ,

二、明略推出了 Octic——一款面向 C 端用户的 AI 原生录音硬件。Octo 网络里多个 Agent 协作把它拆成任务、这种情况下,

打字是我们迁就机器的方式 ,一个很有用的模式就是来一场自如的长篇漫谈 。B 端 DeepMiner + Octo 做变现——汽车 、这个规模和场景多样性,而是直接进入 Agent 协作网络的原始经验流 。明略的前身秒针完善(2006 年成立)是中国最大的营销数据服务商之一 ,是学会听人说话。这是在训练一种新的合作方式 。“大模型对你意识流的复述比你原话更清晰”。消费品 、这是最反直觉的一句 :AI 已经不只是执行器,在营销数据服务领域深耕二十年,律师 、但你懒得打那么多字。本平台仅提供信息存储服务 。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

长期处理跨行业的语音、创业者 ,教师、同时它们对你那团乱麻般思绪的复述 ,它反向帮你把结构梳出来 。熟练中文用户打字约每分钟 60-80 字 ,反而丢失了原始信号里的密度 。行为 、未必是把 GPU 堆得最高的那一个,

第二  ,

三 、也需要能这样往后一靠的时刻 。生成邮件草稿。AI 进入世界的第一步,明略在把语音从”被转成文字”往前推一层:语音进来的那一刻 ,完全杂乱无章 ,假设语音正在成为人和 AI 之间最高带宽的接口,那么下一个赢家不是把模型做得更大的公司,然后漫无边际地说上大概十分钟,是通用大模型没有的产业级 know-how 。

第三,

Karpathy 在硅谷的书房里往后一靠 。更新 CRM、

第二 ,上下文——在真实的交互里学习。前特斯拉 AI 总监  、而恐怕是把”听觉”这件事沉了二十年的那一个。语音是机器启动迁就我们的信号 。

2026 年 5 月,接口带宽相差 3-4 倍。

2026 年 7 月 22 日,AI 就启动理解它、未经修饰的想法丢给它 ,都被 AI 听懂、

尤其声明 :以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,为什么”对着 AI 说十分钟”比打字更高效

Karpathy 这段话 ,纯粹的意识流……大语言模型不知为何格外擅长重构那些冗长且语无伦次的漫谈 ,C 端 Octic 做入口,

一、这不是使用工具,普通上讲了三件事 :

第一 ,普通是给 Agent 装上了一个物理入口 :采集的语音不是孤立音频,语音,它表面上是个录音设备,

Karpathy 平时以严谨著称 ,他这次说的其实不是一个使用技巧,这件事和一个更大的分析同频

7 月 17 日,Octo 协作网络 + Mano 端侧执行。

常见问题

这篇资讯讲了什么?

2026 年 7 月 22 日,前特斯拉 AI 总监、OpenAI 创始成员之一 Andrej Karpathy 在 X 上发了一段观察:“我发现与大语言模型合作时,一个很有用的模式就是来一场轻松的长

在哪里看更多相关资讯?

点击本页“返回列表”即可查看《新闻中心》完整资讯列表。