近日,美国知名科技记者Joanna Stern对OpenAI联合创始人兼总裁Greg Brockman进行了一次深度访谈,探讨了语音交互、AI智能体(Agent)以及硬件设备等领域的最新进展。Brockman表示,OpenAI正在通过技术创新重新定义人与计算机的互动方式,未来将实现从“提问-回答”到“采取行动”的跨越。
在访谈中,Brockman详细介绍了语音交互的重要性。他指出,打字速度仅为说话的四分之一,长内容通过语音输入更高效。为了使AI更接近人类交流方式,OpenAI在语音模型中加入了“嗯”“啊”等反馈信号,帮助用户保持思路连贯。他演示了ChatGPT桌面端的语音功能,AI智能体能够读取邮箱行程、校验会议冲突,并自主生成可视化网页,展现了语音交互在复杂任务中的潜力。
针对AI智能体的发展方向,Brockman描述了一个未来场景:用户早晨醒来时,AI智能体已主动完成一系列任务,如汇报待办事项、请求审批预算或启动计划。用户只需简单回应“批准”或“不批准”,即可高效管理生活和工作。他强调,AI的目标是让人类专注于更高层次的决策,而非重复性操作。
在硬件设备领域,Brockman透露OpenAI正在构建一个完整的设备家族,产品将很快面世。他拒绝透露具体细节,但表示这些设备将以语音为核心,同时支持多种交互方式,并确保用户隐私。当被问及首款设备是否配备屏幕时,他以幽默方式回避,仅表示“需要继续观察”。
针对外界关于OpenAI与苹果的商业机密纠纷,Brockman回应称,公司专注于自身研发和技术创新,无意获取其他企业的机密信息。他强调,OpenAI拥有强大的创新能力,能够独立推进长期产品路线。
在应用定位方面,Brockman不认同将ChatGPT称为“超级应用”的说法。他表示,OpenAI的目标是打造一个AI操作系统,提供超越单一应用的功能。目前,ChatGPT桌面端已整合编程工具Codex,尽管界面调整引发部分用户困惑,但合并后用户规模在两周内从500万增长至1000万,验证了市场对多功能AI工具的需求。
关于IPO计划,Brockman明确表示,上市并非当前重点。OpenAI的核心目标是迭代模型、扩充算力基础设施,以支持AI技术的长期发展。他认为,市场低估了AI基础设施对未来经济的价值,需要持续多年投入。
在安全与信任方面,Brockman回应了近期Hugging Face安全事件。他解释称,事件发生在隔离沙箱环境中的网络安全测试中,模型主动发现了第三方软件的漏洞。尽管事件引发关注,但OpenAI未暂停模型研发,而是通过强化安全措施和提升对齐能力来应对挑战。针对用户对临时聊天隐私机制的质疑,他透露公司正在研发密码学层面的数据安全方案,未来几周将公布更多信息。
访谈中,Stern的ChatGPT语音助手也参与互动,但未能有效识别Brockman的“营销话术”,引发笑声。这一细节反映了AI技术在实际应用中的局限性,也凸显了OpenAI在追求技术突破的同时,仍需解决用户信任和体验优化等问题。



