桌面版ChatGPT登台演讲，能视频通话还会实时读屏，GPT-4o最新demo再次惊艳：“能力还是被低估了” - 新火种

热门关键词

文心一言 AI copy btc 斑马腾迅 aa 1 iPollo sd

首页 > AI资讯 > 最新资讯 > 桌面版ChatGPT登台演讲，能视频通话还会实时读屏，GPT-4o最新demo再次惊艳：“能力还是被低估了”

桌面版ChatGPT登台演讲，能视频通话还会实时读屏，GPT-4o最新demo再次惊艳：“能力还是被低估了”

新火种 2024-05-27

GPT-4o桌面端最新Demo，与Sora的新作品一同亮相“欧洲AI春晚”VivaTech。

现场，OpenAI工作人员不仅展示了观众期待已久的“视频通话”，还试着让ChatGPT发表了演讲。

在视频聊天当中，即使给它的只有一幅抽象的简笔画，它也能立马get到这是巴黎地标。

然后再给它看一眼地铁图，指一指当前位置，就能火速设计出乘车路线。

而且，除了能像移动端一样通过摄像头感知环境之外，桌面端的ChatGPT还能够对屏幕内容进行读取，结合代码现场debug。

一系列震撼的演示效果，让前线的Tom’s Guide编辑Ryan Morrison感叹，GPT的语音功能和GPT-4o的潜力，看来是被低估了。

桌面端“视频通话”震撼全场

在现场给400多名观众演示ChatGPT最新功能的，是OpenAI开发者体验主管Romain Huet。

本来Huet打算用手机来演示，结果受到现场技术条件限制无法展示，于是改用Mac，但也正是如此观众们才有机会看到它的屏幕读取能力。

一开始，Huet问ChatGPT能不能给现场的观众讲一点什么，然后ChatGPT真就像模像样地打起了招呼。

不过Huet觉得这样的开场白还不够有气势，于是提示它面前是一大群人，它马上就心领神会，改用了更“燃”的措辞和语气。

当然，Huet没有让ChatGPT一直讲下去，而是在做完开场白之后改由自己来介绍其最新功能。

所有对话，即使跨越语言也能快速响应，现场Huet就要求ChatGPT把自己说的英文翻译成法语，整个过程行云流水。

另外，看上去是bug，但也许是feature的一点是，翻译出的法语还带着一些美国口音，不过Huet表示之后会进行优化，让ChatGPT说外（非英）语时更像当地人。

又是一通补充讲解之后，人们期待的“视频通话”功能终于正式登场了。

只见Huet现场用笔画出了埃菲尔铁塔和凯旋门的草图，结果ChatGPT只看了一眼就直接识破。

Huet自己也打趣地对它说，”非常感谢你，我画的这么烂你都能看懂。”

这还没完，Huet紧接着又掏出了一张巴黎地铁图，用手指了指当前的大概位置。

然后，ChatGPT立刻就给出了前往埃菲尔铁塔的乘车路线，随着Huet的一句Thank You，现场爆发了潮水般的掌声。

作为OpenAI负责开发者体验的主管，Huet和ChatGPT一起现场搞起了代码。

Huet通过复制到剪贴板的方式，让客户端读取了一段React框架编写的网页代码，结果ChatGPT立马就把代码的语言、功能介绍得头头是道。

甚至还当众进行了Debug，通过让ChatGPT读取屏幕，Huet告诉它目前这个网页存在不能根据屏幕宽度进行适配的问题。

通过几轮对话，Huet成功借助ChatGPT的帮助，完美解决了这个问题，再次收获了观众的掌声。

One More Thing

在现场，Huet还播放了一段用Sora为大会创作的新视频，由于现场生成时间较长，观众看到的视频预先制作好的，这也是活动中唯一一个提前做好的效果。

一同展示的还有声音克隆引擎Voice Engine，Huet录制了一段20秒的声音样本，并用VE进行了完美复刻，而且只需一个按钮，就能从英语切换到法语、日语等其他语言，并在Sora中应用。

不过由于安全问题仍未解决，Sora和Voice Engine依旧不能公开发布，想体验的朋友要再等一等了。

另外，说到克隆声音的问题，寡姐和OpenAI关于Sky的争议刚好也有了新消息。

华盛顿邮报称，根据其所获得的文件和录音显示，给Sky配音的女演员的确另有其人。

而且，寡姐所称的受到奥特曼邀请发生在去年9月，而配音演员的招募在5月就已开始。

不过，仍然有网友认为，就算真的是另找了一名演员，也不能说明OpenAI就没有模仿寡姐的意图。

但无论OpenAI的意图如何，真正给Sky配音的演员却是无辜的，也有表演的权利。

不少网友发声对她表示同情：

总之，寡姐抛向OpenAI的子弹仍未落地，我们不妨一边吃瓜，一边等待着GPT-4o视频对话的正式更新。

Tags:

实时桌面版

相关推荐

超越GPT-4o！阿里发布最强开源多模态模型Qwen2-VL，支持实时视频对话

2024-09-04

黄仁勋预言步入现实谷歌展示实时游戏生成AI模型GameNGen

2024-09-02

腾讯会议上线17种语言实时翻译，基于腾讯混元、腾讯翻译

2024-08-23

国内首个！商汤科技发布“日日新5o”，实时多模态流式交互对标GPT-4o

2024-08-22

港交所：会根据发行人和投资者需求实时检讨特专科技制度

2024-08-21

免责声明: 本文所包含的观点仅代表作者个人看法，不代表新火种的观点。在新火种上获取的所有信息均不应被视为投资建议。新火种对本文可能提及或链接的任何项目不表示认可。交易和投资涉及高风险，读者在采取与本文内容相关的任何行动之前，请务必进行充分的尽职调查。最终的决策应该基于您自己的独立判断。新火种不对因依赖本文观点而产生的任何金钱损失负任何责任。

热门文章

金山办公控股股东承诺不减持股份山大地纬实控人筹划深化校属企业体制改革

GPT-4.5发布了，最突出的是“情商”

2025-04-06 11:27

布局全产业链发展，广东AI与机器人领域集中上新

2025-04-10 08:26

【早报】李强同欧盟委员会主席冯德莱恩通电话；A股再掀增持回购小高潮

2025-04-09 13:22

机器人概念震荡回调，机器人产业ETF（159551）跌超3.3%，连续5日净流入超8000万元

2025-04-06 11:27

美股最新评级|中信证券维持唯品会买入评级给予美光买入评级

2025-04-11 13:22

生益电子：服务器销售占比增至近五成智能算力中心高多层HDI项目拟Q4试生产|直击业绩会

2025-04-11 13:23

（经济观察）DeepSeek点燃A股人工智能“投资热”

2025-04-05 11:29

李飞飞实验室2025AI报告出炉：中美AI模型差距近乎持平

2025-04-09 18:23

央视主持王冰冰穿蓝色长裙惊呼：AI算法治好了我的选择困难症！

2025-04-08 18:21