增强版 Sora 生图模型发布:不仅能直接在 ChatGPT 用,还抢了梗图作者的饭碗
在 DeepSeek 24 小时前刚刚发布了 V3 模型 0324 版本更新之后,OpenAI 似乎真的有点「不甘示弱」的较劲感,在北京时间 3 月 26 日凌晨宣布了新产品的发布预告。
虽然在正式开始之前,有一些传言猜测本次有可能发布 GPT-5,但根据以往 OpenAI 的各种产品发布节奏来看,这次并不会是一次重磅更新,但本次直播中,发布的整合进 ChatGPT 中的新版 Sora,还是给大家带来的意料之外的「节目效果」。
目前,整合进 ChatGPT 中的 Sora,相比于独立应用版本,能力暂时被局限在了图像生成,但据 OpenAI 在直播中介绍,该模型比之前的模型有了质的飞跃。
据介绍,开发团队使用了GPT-4o「全模态」(或可以生成文本、图像、音频和视频等任何类型数据的模型)能力为基础,来开发这个版本的 Sora。因此用户可以直接说出自己的需求,甚至上传或者拍一张照片,作为提示词来使用。
比如直播现场的演示环节,就直接用手机给 Sam Altman 在内的三人来了张自拍,并要求 Sora 生成一张「动漫风格的版本」。
这还没完,他们三人甚至还现场演示了让 Sora 在图片上添加一段文本「Feel The AGI」(感受通用人工智能)。现场画了第一张新版 Sora 的表情包。
这个现场生成的表情包不仅文本准确清晰,并且准确理解了当代流行梗图中的包括粗体字等必备元素,已经能直接拿来当梗图发到各种群里了。
由于是 OpenAI 官方带头整活,评论区也有不少用户也被激发热情,尝试着把相同的提示词喂给 Grok,用相同的提示词和照片,生成同样风格的内容 ———— 但显然效果还是比新版 Sora 差了不少,反而带来了更喜感的效果。
除了带头画梗图,OpenAI 还演示了新版本 Sora 在文本渲染方面的改进,可以让在图像上生成没有拼写错误的连贯文本的成功率明显提升。
在另一个演示场景中,OpenAI 团队让 Sora 去生成一幅用于理解相对论的漫画卡片。
不同于以往生图模型中,在文本生成部分经常容易变得混乱不堪,甚至是「AI 造字」的情况发生,新版 Sora 其原生图像生成,生成的文本,已经没有任何明显错乱,甚至还在漫画生成了非常自然流畅的日文,意外的让日文社区的不少日本用户「炸锅」。
对于图片生成模型来讲,过去正确渲染文本是一个巨大的挑战。如果小标题或文本元素有拼写错误或错误,整个图像都可能变得无法使用。
此外在这个案例中,OpenAI 还演示了类似对相对论这样「世界上现有知识」的正确引用。
「如果我画一张图像,我会受到自身技能的限制……以及我积累的所有世界知识的限制,」 ChatGPT多模态产品负责人 Jackie Shannon 在接受媒体采访时解释这个功能的必要性。
「该模型将世界知识代入其中,因此当你要求生成牛顿棱镜实验的图像时,你无需解释「牛顿棱镜实验」这件事它本身是什么,就能得到准确的图像。」
除了上述这些直播中提到的模型能力改进,OpenAI 还表示新版 Sora 大幅提升了在属性和对象之间保持正确关系的能力。例如,绑定能力较差的模型可能会将要求生成蓝色星星和红色三角形的提示词,生成为红色星星而没有三角形。
据 OpenAI 介绍,现有的大多数图像模型在这方面都很容易「犯错」,尤其是当被要求渲染多个项目(通常在5到8个左右)时,经常会混淆颜色和形状。而新版 Sora 的图像生成功能,可以正确绑定15到20个对象的属性,在理解各自的复杂需求的同时,保证不会被误导,从而大幅提高成功率。
除了这些使用体验上的改进,还有一个细节是,OpenAI 已经确认,新版 Sora 生成图像的时间比以前更长,但 OpenAI 认为这是一个值得的权衡。
「虽然我们在延迟方面肯定还有改进的空间……但(我们觉得)这些生成图片的质量、功能和世界知识,确实弥补了用户需要等待的额外几秒钟,」Shannon说。
至于生图领域的安全问题 —— 从去年到今年已经出现多次伪造名人不雅图像、热点事件虚假图像,以及 Google Gemini 去除照片原水印这样的问题,OpenAI 团队强调新版 Sora 已经可以去除照片水印,同时阻止生成性深度伪造图像,并拒绝生成相关的内容请求。同时所有生成的图像都将包含标准的C2PA元数据,以标记该图像是由OpenAI创建的。
目前,新版集成在 ChatGPT 内的 Sora 图像生成模型功能,已经开放给 Pro 和 Plus 订阅套餐的用户,并且 OpenAI 承诺,新版 Sora 也会在不久的将来,提供给免费版本和 API。
现在我最想做的,就是立即让它帮我画自己的梗图了。
欢迎加入深潮TechFlow官方社群
Twitter官方账号:https://x.com/TechFlowPost
Twitter英文账号:https://x.com/DeFlow_Intern
1.资讯内容不构成投资建议,投资者应独立决策并自行承担风险
2.本文版权归属原作所有,仅代表作者本人观点,不代表本站的观点或立场
您可能感兴趣
-
观点:FRAX为何是稳定币叙事的最佳投资标的?
作者:Kyle, 加密 KOL编译:Felix, PANews注:加密 KOL Kyle 目前持有 FRAX;本文仅代表 Kyle 个人观点,不代表 PANews 的观点。要点:市值 2.76 亿美元
-
xbit比特币安全可靠吗,xbit比特币是否安全?
xbit比特币在安全性和可靠性方面表现良好,通过链上透明验证、MPC+TEE密钥管理、智能风控等技术手段,全方位保障用户资产安全。其跨链生态和合规化升级进一步提升了交易效率和隐私保护能力,为用户提供了安全、透明且高效的交易环境。
-
STARTUP半小时涨40倍,him如何成为Believe的情绪之王?
5 月 15 日链上信息显示,一名加密 KOL him(@himgajria)通过喊单让一个 meme 币一小时翻 40 倍,莫非比特币重回 10 万美元后,Solana 链上的春天又回来了?一大早,
-
xbit平台app用户体验如何?xbit平台APP使用教程最新版
在2025年,xbit平台的APP凭借其去中心化交易功能和创新技术,逐渐成为许多加密用户的选择。
-
cobo钱包能兑现吗,cobo钱包转账多久转出?
Cobo钱包作为一款功能相对全面的数字货币钱包,支持多平台、多币种,集存储、交易、理财于一体。用户在下载安装Cobo钱包完毕之后,通过注册与创建钱包即可使用其接收与发送资产、理财、安全设置以及高级功能与增值服务等特色功能。
-
Coinbase月度展望:全球货币体系转向,比特币开始上桌谈判
原文标题:Monthly Outlook: Dethroning the Dollar 原文作者:David Duong, CFA - Global Head of Research 编译:Daisy
-
TP钱包是冷钱包还是热钱包呢?
TP钱包(TOKEN POCKET)属于热钱包,因为它需要联网才能使用,适合日常交易和小额支付。虽然热钱包的便捷性高,但安全性相对较低,用户需要采取额外的安全措施来保护资产。
-
bitget交易所能防风险吗?bitget交易所风险预防措施介绍
bitget交易所通过多重加密技术、实名认证与KYC、风险控制系统以及资产安全保护基金等措施,有效预防和应对各类风险。
- 成交量排行
- 币种热搜榜

