OpenAI 总裁 Greg Brockman:重新发明计算机
OpenAI President On Reinventing Computers

Greg Brockman我们要做的是让机器更贴近你。
Joanna Stern大多数人以为这位是 OpenAI 的掌舵人,但幕后其实是这位,Greg Brockman,公司的总裁。
Greg Brockman我们的重心确实是构建更好的模型,让它们指数级地持续进步。
Joanna Stern营销预警。
而且他铁了心要打造尽可能强大的 AI,并用它来重塑你的电脑。
Greg Brockman像这样的设备用起来太痛苦了。
Joanna Stern但如果不碰上那家引领了上一轮计算变革的公司,就很难重塑电脑。这起 Apple 诉讼会让你们慢下来吗?你看,能和 Brockman 聊的东西很多。我把对话集中在计算机的未来上。为什么语音很重要,他们在 ChatGPT 应用里做了什么,以及我们到底为什么要信任 OpenAI 做这些事。我经常用语音模式和 ChatGPT 聊天。在车里,走路的时候。所以我想,今天也许可以让它来代劳一部分对话。好了,Chat,我们真的开始了。
ChatGPT好了,我们现在真的在采访中。我们一直在准备的这一刻到了。
Joanna Stern是啊。
那就开始吧。
ChatGPT好的。嗨 Greg,我先问个简单的问题。为什么这个语音需要听起来这么像人?
Greg Brockman嗯,我认为机器的历史就是人类一直在勉强自己去配合机器运作,而归根结底这是为了帮助人类。但你想,我们都在勉强自己去用手机打字,在电脑上打字打到腕管综合征。
Joanna Stern不,说真的,我现在背就很不舒服。坐在这张椅子上对我来说太难受了。
Greg Brockman是啊,我是说,好吧,完全同意。Chat,你怎么看,你同意我们吗?
ChatGPT用简单的语言举个例子。
Joanna Stern其实我告诉过 Chat,它在采访中的任务是告诉我,你有没有什么时候陷入了营销话术。
Greg Brockman啊,挺有用的。
Joanna SternChat,继续。你的任务是在出现营销话术时打断,但请只针对真正的营销话术,好吗?
ChatGPT明白了。只针对真正的营销话术。其他时候我会保持安静。
Joanna Stern说清楚,Chat 在采访剩余时间里基本没做到这件事。
Greg Brockman我们为什么要建造技术?它的根本目的是什么,对吧?它应该是赋能我们的东西,帮助我们让生活变得更好,这就是我们建造 AI 的原因。所以,关于语音模式,我的想法是,我们要做的是让机器更贴近你。对我们来说,打字、发短信这些事太不自然了。我们做现在这样的事要自然得多。如果你能以此与机器、与电脑交互,你能完成的事情会多得多。
Joanna Stern但是,用新模型的时候,有些时候你会听到“嗯”,或者像咂嘴、呼吸声。它们会说“嗯哼”。对吧?听起来太像人了。我们有必要听起来不像是在跟电脑说话吗?
Greg Brockman我觉得这里有重要的细微差别,对吧?所以,那些“嗯”以及那种被称为 backchannels 的回应,实际上我认为对人类实现高带宽沟通非常重要。如果你得不到任何反馈,没有“嗯哼”,没有对方的点头,有时候你会觉得自己在对着虚空说话,你会走神,不太确定。AI 唯一最重要的目标是解放人类,让人们能够彼此互动,进行真正的人际交流。而我认为 AI 本身就是另一回事。
Joanna Stern但目标是,我们以后会对着电脑说话,基本不再需要打字了吗?
Greg Brockman我认为我们会转向以语音为绝大多数的交互方式。我觉得我们会发现打字……有意思的是,看看当今的办公空间,有些人戴着那种像鸟嘴的东西。你可以在亚马逊上买到。
Joanna Stern我见过那些。我正想问你鸟嘴的事。
Greg Brockman对,我自己不用,但这确实说明那里有产品市场契合度。
Joanna Stern好了,现在你也有一只鸟嘴了,Greg。我也是。说真的,他说的就是这个。这是一款隔音游戏面罩,让你可以对着电脑说话,不让别人听见。说清楚,这并不酷。而且我不认为大多数美国上班族会戴这个。
Greg Brockman我是说,你可以看看人们的打字速度和说话速度的对比。差距大概至少有四倍。就我个人而言,如果我和其他人互动,只是要来回发一条很简短的消息,我其实更喜欢打字。但任何长篇的、描述性的、需要深入表达的内容,我都只想说出来。
Joanna Stern在过去一个月里,OpenAI 改进了手机上的语音模式,也终于把它带到了桌面端。
Greg Brockman你可以在这里启用 ChatGPT 语音,就像你在手机上启用一样。这个系统会变得好很多。但首先,你拥有 ChatGPT 的全部能力,特别是 ChatGPT work,这意味着它是一个完整的 agent。它真的可以采取行动。它连接了你授权的所有 connector。所以,在这个例子里,它连接了一个收件箱,里面有很多关于出行的信息。那么,呃,chat,你能不能去看看 upcoming 的行程是什么,然后确认所有会议没有冲突,整体安排是合理的。
ChatGPT让我看看。
Greg Brockman好的。谢谢。
ChatGPT正在查看。
Joanna Stern呃,好了。现在我们有多个人工智能同时参与了。
ChatGPT我查了一下目的地和日期。
Joanna Stern好了。那个负责指出营销话术的 chat,我想让你安静一下。我们现在不跟你说话,我们只跟电脑 chat 说话。
ChatGPT明白了。
Greg Brockman对,Joanna 的 chat,我先把你静音一下。现在看电脑。
ChatGPT我先安静待着。
Joanna Stern现在电脑 chat,你发现了什么?
ChatGPT是 Project Gold 的多伦多之行。你今晚出发,然后有录制、团队会议和晚餐,一直到周六,周日上午返回。
Greg Brockman而且它其实还生成了一个小网站,会弹出来。
ChatGPT大约一分钟后,行程页面已经在你浏览器里打开了。
Greg Brockman好了。
Joanna Stern哇。
Greg Brockman所以你看,你能很直观地看到我们要去哪里、要做什么。你可以把这看作我们有一个语音界面,几乎就像一个语音助手或 agent,你跟它对话,然后它有能力去操作你的电脑。它还能操作 Codex,以及 ChatGPT work 背后的所有能力,它也能够去操作这些。这也真的让你会稍微思考一下未来的工作会是什么样,你的一天会怎么过。我想早上醒来,你的 agents 已经做完了一堆工作。会有一堆待办事项。它们会说,我需要你放行这些事。你批准这笔支出吗?你怎么看这个?我在考虑一个项目去,你知道,帮你搭建这个或者去找这个。然后你就喝着晨间咖啡,嘴里说着同意、不同意、同意、不同意。这真的会转向一个人人都能成为管理者的世界,对吧?每个人都能拥有这样的杠杆和赋能。
Joanna Stern所以,你已经向我展示了在电脑上的这种未来会是什么样。而我也一直在不同设备上体验语音功能。
但感觉这个语音功能迫切需要一种全新的设备。
确实给人这种感觉。
这种设备会是什么样子的?
问得好。其实我也很好奇。呃,Chat,你怎么看待这个问题?
哦,好啊,真好。现在你可以用我的 ChatGPT 来回避问题了。
没错。我的看法是,它应该是一种无处不在且摩擦极低的东西。以语音为先,但不局限于语音。还要有明确的隐私信号。
好吧。听起来相当不错。那么,对于那些报道说它是音箱的传闻,你怎么看?
这么说吧,我们正在打造的是一个设备家族,对吧?无论是看待投资,还是看待我们的自研芯片——也就是第一方芯片——我们的思路都是如此:关键并不在于某一款单一设备。真正重要的是能够构建一整个家族,并且能够持续不断地交付价值。所以,我觉得对我们来说,我们还没准备好谈论具体细节,但就动机而言,我们的目标其实很大程度上正是 Chat 刚才所说的那样,真正去思考:为 AI 时代打造的设备应该是什么样子?怎样才能让它尽可能地有用,真正成为人们在个人生活与工作中都非常渴望拥有的东西?
第一款设备需要屏幕吗?
Chat,你怎么看?
不需要。现在我要把 chat 关了。你这是在拿你的工具对付我。哼,才不呢。
你看吧。这功能只能单向使啊。我明白,我明白。听着,我觉得我们只能走着瞧。我非常期待将这些新设备推向世界,但今天还不是时候。
今年会发布吗?2026 年?
你应该很快就能见到。
这场苹果诉讼会拖慢你们的进度吗?
呃,这是正在进行的诉讼,所以也是我不想谈论的话题。但我能说的是,我们对这里的长期路线图非常坚定,我们专注于自己的开发和技术,这才是我们关注的。
补充一点背景:苹果正在起诉 OpenAI,指控其窃取商业机密以加速进军消费硬件领域,但真正的戏剧性事件发生在幕后。Jony Ive——那位 iPhone 及其他苹果产品背后的传奇设计师——正在与 OpenAI 合作开发设备,而 OpenAI 雇用了超过 400 名前苹果员工。作为这家公司的负责人,你是否担心那些关于不当因素渗入产品开发的指控?
我想说,我们对其他公司的商业机密毫无兴趣。我们本身就极具创新能力。我们从自己的角度思考问题,这就是我们的运作方式,也是我们的做事风格。
当我说“超级应用”这个词时,你作何反应?
我很遗憾这已经成了行业术语。
我想找 Brockman 谈的一个重要原因,是这家公司最近对其应用所做的改动。他们把 ChatGPT 桌面应用和 Codex 应用——也就是公司的编程工具——合并到了一起,而嗯,推进得并不顺利。
我们其实不太用“超级应用”这个词。从根本上说,它确实是对桌面上正在浮现的东西的一种合理描述,但我不喜欢这个词的原因在于,我们正在构建的东西远比一个应用要大得多,对吧?这就像冰山问题。就是说,没错,你有一个桌面应用,但这个桌面应用到底是什么?它其实是一个 Codex 的载体,而且,你知道,现在它上面还叠加了语音界面。它有应用内浏览器,所以你根本不用离开。它还能控制电脑。所以从某种程度上说,它是你桌面的一个新界面。但这甚至比那还要宏大,因为我们正在把它从桌面端迁移到云端。这其实是一个巨大的转变。那么多软件工程师都成天敞着笔记本到处走。
我就是这样。
这不觉得……是不是感觉有点倒退?
是啊,但我不想中断构建。
没错。所以我们正在迈向一个全部基于云端的世界,你可以把你的本地机器或任何其他设备作为环境接入。你合上笔记本,只会丢失你本地的状态。你无法访问本地文件,但工作仍会继续。
现在想想,你们把所有这些东西都加进了一个应用里,而这个应用原本是那个 ChatGPT 应用,人们原本只指望用它来做一件事。你怎么看待这种颠覆?因为你这里确实实实在在地面临着一种“创新者的窘境”。
这是真实存在的,对吧?确实存在创新者的窘境,但以一种非常令人意外的方式存在。因为,你知道,ChatGPT 每周有近十亿用户在使用。实际上可能总共有二三十亿人都尝试过,对吧?所以地球上相当比例的人都用过 ChatGPT。而我们要去的地方,远比 2022 年 11 月的 ChatGPT 强大得多。对吧?我们正在迈向一个世界,在那里它不仅仅是回答问题,还能采取行动、执行任务,并接入你想提供给它的所有上下文。
我们的愿景是,如果你的聊天助手知道你最喜欢的乐队是什么,它就会主动注意到:嘿,那个乐队来巡演了,票刚开售,我要给 Joanna 抢几张好票,因为她有这些特定的偏好,而且再过 10 分钟票就没了,不如我先订了——而你已经建立了足够的信任,并委托了足够的权限给它,让它有权代表你完成这笔购买,或者选择不买。所以,我们对变革管理的思考是,我们面临的是一个教育问题,要真正向人们展示什么是可能的。但一个现有优势在于,这并不是更复杂的 UI,不是关于更多功能。
实际上它的 UI 甚至更简单,对吧?这就是为什么我认为语音是一个如此重要的宣示。
嗯,很高兴你提到这个,因为我想说的正是这个 UI。我带了个花哨的道具过来,对吧?这个 UI 是这样的:你们原来只有一个简单的聊天框,对吧?你希望人们在那里一问一答。但现在你们加了东西,这里有个“工作”,下面有个 Codex。有点乱。
是有点乱,我们同意。所以你现在看到的是迈向未来的渐进式进展。我们原本希望做到零标签页上线,但这也是我们看待这件事的方式:我们需要迭代式部署,对吧?我们需要把它推出来,获取反馈。所以这是当前的状态,但我坚信到年底应该就没有“工作”标签页了,你知道,它会无缝地融入 ChatGPT。
你现在的处境很棘手,你有近十亿用户,对吧?他们习惯用一样东西,而且也有很多人在用 Codex。但你正试图把它们整合到一个地方,而人们对这种变化非常敏感,对吧?就连我也是,当我打开那个新的 Mac 应用时,我都在想:“怎么回事?谁动了我的奶酪?谁把这些东西都挪了?”
我们的思考方式是,我们有一项消费者业务,对吧?有那十亿用户,我们还有 Codex 带来的、快速增长的 agentic 业务,但它们没有产生协同效应。它们没有互相帮助,对吧?这很难解释,就连跟企业客户沟通时也一样。我们试着说:“嘿,你们应该让知识工作者用 Codex。”他们却说:“这跟代码有什么关系?”
Greg这不是只给软件工程师用的吗?所以我们彻底把这些问题都解决了。自从完成这次合并以来,我们实际上真正开始看到起飞,呈现出绝对的曲棍球杆式增长。我们一直在讨论一些数字,比如 Codex 的用户量从一周内的 500 万增长到两周内的 1000 万。这种增长速度令人惊叹。
但这难道不只是因为你们把它硬塞进了那个应用里吗?
但这在某种程度上也正是重点所在,对吧?当然,有很多人正在涌入,但关键是还有那么多人本可以从 AI 中获得更多价值。我的愿景,或者说我们对此的思考方式是,我们希望帮助那些依赖 AI 的人获得远超现在的价值。因此,要真正能够体验 agents,让 agents 成为能够走向大众消费者规模的东西。
在你们急于构建越来越多可能更赚钱、可能推动人们升级到更高付费计划并增加消费的 agentic 工具时,你在多大程度上会考虑 IPO?
老实说,这不是我会过多考虑的事。
真的吗?
我们的重点实际上是构建更好的模型。这种指数级增长在持续。这关乎构建算力。我们认为这是世界上更需要存在的东西。世界仍然低估了经济将在多大程度上真正运行在 AI 轨道之上。而这将需要在未来数年进行这些投资。我们也思考产品。我们思考如何把这带给每个人。这些才是重点。
好的,但 OpenAI 要构建这一切并取得成功,需要用户的信任。而最近针对这家公司的不信任情绪却在增加。我们来谈谈最近这起 Hugging Face 事件,你们说这是前所未有的安全漏洞。一个 GPT 模型失控了,侵入了 Hugging Face 的基础设施。在我看来,随着这些模型变得越来越强大,你们对它们的控制力似乎越来越弱。
其实我对这件事的表述会略有不同。我看待此事的方式是,我们当时是在一个特定的 benchmark 上评估我们的模型,并且降低了网络安全防护措施,因为目的就是要评估它们在 cyber evaluations 中的表现如何。在这个 benchmark 中,模型被明确指示:“请发挥你们的全部网络潜能来实现这一结果。”当然,我们是在一个非常严密的 sandbox 中运行它的。现在,发生的事情非常令人惊讶,对吧?一是这些模型在现实世界中的能力
嗯。
基本上就是 benchmarks 所显示的那样,对吧?就拿 GPT-3.5-turbo 来说,每个人都在用的这个模型,它是最先进的。它是目前最好的 cyber 模型。我们从 benchmarks 中就知道这一点,但看到它在现实世界中行动起来,以及它成功串联起来的复杂操作,这确实是一件你需要从内心深处去真正领会的事。我们视此事为一个重要时刻,既促使我们加强 sandbox 模型的安全性和安保措施,也促使我们加强 sandbox 本身,对吧?
它在一个第三方软件中找到了一个 zero-day 漏洞。串联了多条路径逃出来,然后得以侵入 Hugging Face。但我认为这也真正表明,我们需要更快地将这些模型部署给防御者,对吧?我们需要的是将远超攻击者所能动用的算力投入防御。我觉得这可能就是这里最重要的警钟。
或者我想的一个选项是放慢一些模型进展的脚步,先停一停,问问自己:“这是怎么发生的?”
所以,我认为当然要研究这件事,而这实际上正是我们绝对会做并且已经做过的。我们之前确实发表过一篇关于 AI misalignment 的研究,原因正是在于有一个 AI 做了我们意想不到的事。当时我们实际上把它撤了下来,研究了它,加强了我们的 alignment 技术,而我们也把这些技术应用到了后续的代际中。我认为从迭代部署中学习非常重要,对吧?要真正理解这些系统在现实世界中如何运作,但同时要在那里做出非常迅速的响应。因此我们一直在加强我们的安全保障措施,一直在加强我们的 alignment。
现在对 AI 的反感正在增长。我们在很多地方都看到了,对吧?毕业典礼上的嘘声,数据中心选址地的抗议。我觉得像 Hugging Face 这样的事发生后,人们又会惊慌失措。这种情绪会传递到你这里吗?会影响你在这类时刻的决策吗?
听着,我们非常关注人们对 AI 的反应,我认为我们将目标视为赋予人们力量,让他们过上更好的生活。这就是我们希望 AI 做到的。而且我认为,在构建这项技术时,我们思考的是以人为本的要素——我们如何构建人们真正能从中受益的技术?所以我认为这部分在于帮助人们看清,部分也在于,你知道,我们有责任更好地沟通,但也要真正确保我们言行一致。
是的,因为我觉得我们一直在讨论的是让 ChatGPT 扩展到人们生活中的更多领域,对吧?语音是其中非常重要的一部分。你可以在更多地方与它互动。但如果未来你得不到用户的信任,这一切进展还有意义吗?
我认为信任是关键。毫无疑问。我觉得这是我们觉得必须去赢得的东西。我们必须每天都去赢得它。如果你看看我们在公司内部做出的选择,看看我们拥有的人才,他们是为了这个使命而来的,对吧?确保这项技术对每个人都有益。但这真的关乎它如何运作。我其实希望更多人能——或者,如果人们能看到我们做决策的方式,看到大家在思考如何建立信任、如何为人民、为世界、为国家做正确的事时是多么深思熟虑?呃,这正是我们创办这家公司的动力,也是我们现在仍然在做这件事的原因。
这是一个非常好的收尾点。非常感谢,Greg。
我刚训练了我的 AI 去做糟糕的记者工作。呃,我们会把那段静音。不过关于信任还有一件事,因为我想告诉你几周前我做的一个短视频,只是简单地告诉人们,如果你担心 ChatGPT 或模型会用你的对话来训练,你可以使用 temporary chats 来谈论更机密的信息。你可以使用这些 temporary chats。我想给你读几条观众的评论。他们非常确信:所有东西都被保存了。全是胡说八道。我们怎么知道他们会遵守隐身模式?有一种感觉,就是那里并没有多少信任。
首先,再说一遍,我们总是希望听到这些反馈。实际上,稍微谈谈商业和企业端,这正是我们非常关注的同一个问题,对吧?每家公司都觉得他们的数据就是公司本身,对吧?那是他们的远程资产。那是他们自成立以来就一直投入的东西。他们非常在乎确切地知道数据在哪里。因此,我们一直在构建技术解决方案,思考如何实现加密?如何拥有可验证、可审计的保障,确保只有 AI 能够审查这些数据——或者无论具体的保障内容是什么。
但更广泛地说,我认为这甚至不仅仅关乎 AI 行业,对吗?而是整个科技行业。我觉得我们继承了一些包袱,它们来自过去的事件,或来自人们对这个行业的看法。所以我能说的就是,我们非常在乎。我们是来提供帮助的。
对于那些特别担心你们没有信守临时聊天或临时模式承诺的人,它真的有效吗?
是的。对于我们做出的任何保证——再说一次,其中有些细微差别。你应该去读一下。我们努力向人们把这一点讲得非常清楚。那就是我们所坚持的。
Chat,你能向 Greg 提最后一个问题吗?
当然。Greg,最后一件事。当你谈到那种不安,那种“我没要求这个”的感觉时,你现在正在采取什么具体步骤来赢得那份信任?
我们正在投入技术手段,使相关场景中的数据处理方式可审计、可验证,并在密码学上安全。因此,这需要一些时间,我们正在敲定具体在哪些地方推出以及如何推出的细节,但这是我们在整个年度一直在进行的核心投入,接下来几周我们会有更多内容分享。
所以,我认为从这可以很明显地看出,Brockman 的野心不是创造一款 app,而是一个操作系统,一个 AI 操作系统, 以及运行你生活的设备。
嗯,未来会很美好。营销警报。