코인정보

OpenAI发布ChatGPT图像2.0,解决韩文显示问题

宣在官 기자 2026-04-22 17:40
OpenAI放弃Sora,专注图像生成 引领设计市场
ChatGPT图像2.0结合多种视觉元素生成高质量视觉示例
ChatGPT图像2.0结合多种视觉元素生成高质量视觉示例[图片=OpenAI]

[经济日报] 美国人工智能公司OpenAI于21日发布了最新的图像生成工具ChatGPT图像2.0。

该服务基于ImageGen 2.0模型设计,是在Arena平台上表现出色的代号“胶带”的正式版本。它几乎完美地解决了以往图像生成模型在文字表达上的缺陷,吸引了全球技术界的关注。

过去,人工智能生成的图像中插入文字时,常出现字母排列无序或模糊的问题。即使用户要求修正,也常需耗时且结果不佳。然而,新模型能够准确呈现韩文,消除了人工智能生成图像的违和感。

国内外用户在网络社区分享了多种结果,认为消除乱码现象是一项创新。该模型能精确反映用户的详细指令,立即提供高实用性的结果。图像中物体的位置和关系被精细构建,小字和图标也能自然地排列在紧凑的布局中。

支持从3:1到1:3的宽屏比例,能够高质量再现照片、漫画和电影等多种视觉风格。文本渲染质量显著提升,不仅在韩文,还在日文、中文、印地语和孟加拉语等非拉丁文字语言中表现出色。OpenAI预计该模型将在海报、说明资料和图表等专业设计工作中广泛应用。

此次版本首次引入基于ChatGPT图像思维的生成功能,实现技术差异化。思维模型和专业模型支持通过网络搜索获取最新信息,并基于单一提示生成多个图像。由于经过思维链过程,生成漫画时能完美保持角色外观和服装的一致性。

新模型发布正值OpenAI调整业务战略后,备受关注。OpenAI宣布将完全停止视频生成工具Sora服务,专注于核心业务。OpenAI核心人士表示,ChatGPT在进化为终极个人助手的过程中,图像生成是必不可少的核心要素,但市场对视频的需求尚未达到预期。

对于图像工具可能被用于传播虚假信息或政治目的的担忧,OpenAI推出了强有力的防御措施。公司实时监控用户的恶意使用,并谨慎控制生成内容对社会的影响。通过引入SynthID等强大的数字水印技术,确保任何人都能轻松识别人工智能生成的结果。

目前,ChatGPT图像2.0的基本功能可供所有平台用户免费使用,而需要高推理能力的思维模型和专业模型的高级输出功能仅限于每月20至200美元的Plus和Business订阅用户。此策略旨在提高信息可及性,同时通过收费的商业功能创造稳定的收入模式。

业内人士预计,ChatGPT图像2.0的发布将彻底改变由谷歌的纳米香蕉模型主导的图像生成市场。谷歌以精细描绘能力占据市场,而OpenAI则以文本实现能力和设计布局的便利性对其发起强烈挑战。

巧合的是,新模型发布正值全球最大图像软件公司Adobe举办年度峰会期间。随着人工智能模型进入高端设计领域,传统图形软件公司之间的激烈市场竞争不可避免。Adobe合作伙伴关系负责人萨希尔·古普塔表示,客户会根据不同用途使用各模型,淡化了竞争担忧,但市场的危机感正在加剧。

人工智能技术专家认为,胶带的正式发布开启了真假难辨的新视觉媒体时代。曾被视为专业设计师领域的商业图像编辑和排版工作,如今只需点击几下即可完成,预计将对内容制作行业带来巨大变革。技术的飞跃发展带来的产业创新和伦理保护措施的制定成为我们面临的重大课题。





※ 本报道经人工智能(AI)系统翻译与编辑。

《 亚洲日报 》 所有作品受版权保护,未经授权,禁止转载。