虎嗅

GPT Image 2.5가 출시되었습니다. OpenAI가 Banana의 기술을 모방하기 시작했습니다.

原文:GPT Image 2.5来了,OpenAI开始抄Banana的作业

一、 핵심 내용의 쉬운 설명

오픈AI는 최근 새벽에 자사의 AI 이미지 생성 도구인 GPT Image 2.5를 업데이트했습니다. 이번 업데이트에서는 업계를 뒤집을 만한 혁신적인 기술은 전혀 없었으며, 모두가 불평했던 ‘이미지 수정’ 기능에 중점을 두었습니다. 이전에는 사용자들이 AI를 이용해 이미지를 생성한 후 특정 부분을 수정하려고 하면 전체 이미지가 망가지거나 품질이 저하되는 문제가 있었습니다. 하지만 새로운 모델은 이러한 문제들을 대부분 해결했으며, 생성 속도도 절반으로 빨라졌습니다. 무엇보다도 가격은 이전 버전과 동일하게 유지되었습니다.

흥미롭게도, 이번에 강조된 주요 이미지 수정 기능들은 구글이나 국내의 텐센트 혼원, 통의만상과 같은 기업들이 이미 1년 전부터 차례로 개발해왔던 것들입니다. 오픈AI는 이전에 놓친 부분을 보완한 셈입니다. 하지만 수억 명의 챗GPT 사용자들 덕분에 이번 업데이트로 AI 이미지 생성의 실용성이 크게 향상되었습니다. 일반 사용자들은 더 이상 수십 번씩 이미지를 생성하며 수정하는 번거로움을 겪지 않고, 두세 번만 수정하면 사용 가능한 결과물을 얻을 수 있게 되었습니다. 실제로 이번 업데이트의 영향은 많은 사람들이 예상하는 것보다 훨씬 큽니다.

---

두、 세부적인 해석

1. 이번 업데이트는 혁신이 아니라 오픈AI가 사용자들에게 빚진 ‘이미지 수정’ 기능을 보완한 것입니다

많은 사람들이 오픈AI가 “1년 늦게 따라온 것”이라고 불평하지만, 이는 오히려 과장된 말입니다.

이전에는 GPT의 기존 이미지 생성 도구나 다른 AI 이미지 생성 제품들도 모두 “한 번에 결과물을 받는” 방식이었습니다. 사용자가 텍스트를 입력하면 이미지가 생성되었지만, 이미지 속의 물건 색상을 바꾸고 싶어도 전체 구성이 바뀌는 경우가 많았습니다. 사용자들은 만족스러운 결과를 얻기까지 반복해서 수정해야 했습니다.

하지만 구글은 1년 전에 이미 “여러 번 수정해도 이미지가 망가지지 않는” 기능을 자사 제품의 핵심 기능으로 만들었으며, 4개월 후에는 이미지의 특정 부분을 선택하여 수정할 수 있는 인터페이스를 도입했습니다. 이후에는 이미지의 조명이나 카메라 각도를 직접 조절하거나 여러 인물을 동시에 조정하는 기능도 추가되었습니다. 국내 기업들도 이미지에 낙서를 그리거나 선화를 그려 AI가 그에 맞게 이미지를 생성하는 기능을 지원하고 있었습니다. 오픈AI는 이러한 실용적인 업데이트를 늦게 따라왔지만, 이번 업데이트로 AI 이미지 생성의 사용 장벽을 크게 낮추었습니다. 일반 사용자들은 더 이상 반복적으로 수정하는 번거로움을 겪지 않고, 두세 번만 수정하면 사용 가능한 결과물을 얻을 수 있게 되었습니다.

2. 진정한 가치: 이미지 수정이 더 이상 전체 이미지에 영향을 미치지 않아, 일반 사용자들의 시간이 80% 절약됩니다

이번 업데이트로 실용성이 크게 향상되었으며, 두 가지 핵심 기능이 사용자들의 불만을 해결했습니다:

첫째, “원하는 부분만 수정할 수 있다”는 점입니다. 포스터를 만들 때 제품 문구만 두 단어 바꾸고 싶어도 배경이나 로고, 제품의 모양이 변하지 않습니다. 둘째, “여러 번 수정해도 이미지 품질이 저하되지 않는” 점입니다. 이전에는 두세 번 수정하면 이미지가 망가졌지만, 이제는 초안을 먼저 만들고, 첫 번째 라운드에서 인물의 옷 색상을 수정하고, 두 번째 라운드에서 배경 조명을 수정하며, 세 번째 라운드에서 작은 장식을 추가할 수 있습니다. 심지어 10번이나 수정해도 이전에 만든 변경 사항이 유지되고 이미지 품질이 저하되지 않습니다.

오픈AI는 모델을 두 가지 버전으로 나누었습니다. 하나는 속도를 중시하는 버전으로, 기존 버전보다 속도가 절반으로 빠릅니다. 다른 하나는 이미지 품질을 중시하는 버전으로, 광고나 상품 이미지를 만드는 전문 사용자들을 위한 것입니다. 두 버전의 가격은 모두 이전 버전과 동일하며, 이는 모든 기존 사용자들에게 무료로 업그레이드를 제공하는 것과 같습니다. 테스트 데이터에 따르면 새로운 버전의 복잡한 편집 기능이 기존 버전보다 80% 이상 향상되었습니다. 많은 사용자들이 애니메이션 프레임이나 투명한 배경의 게임素材를 만들 때, 수정 후 바로 디자인에 사용할 수 있어 디자이너의 작업 시간을 크게 절약할 수 있습니다.

3. 눈에 띄지 않는 두 가지 작은 기능이 사실은 AI 이미지 생성을 ‘단순한 도구’에서 ‘소셜 협업 도구’로 변화시키려는 것입니다

이번 업데이트에서 추가된 두 가지 기능은 기술적으로 복잡해 보이지 않지만, 실제로는 큰 의미가 있습니다:

첫째, “스케치 생성” 기능입니다. 이전에는 AI에게 무언가를 그리게 하려면 긴 텍스트를 작성해야 했지만, 이제는 화면에 간단한 스케치를 그리기만 하면 AI가 그에 맞게 완성된 이미지를 생성해줍니다. 둘째, “파라미터를 포함한 공유” 기능입니다. 이전에는 생성된 이미지를 친구에게 보내도 친구가 어떤 텍스트를 입력했는지 알 수 없어 수정이 어려웠지만, 이제는 생성된 모든 파라미터를 함께 공유할 수 있어 친구가 자신의 사진에 적용하거나 세부 사항을 수정할 수 있습니다. 여러 사람이 같은 이미지를 공유하며 다양한 변형을 만들 수 있습니다. 이러한 기능들은 이미 다른 기업들도 개발했지만, 오픈AI가 이를 도입함으로써 수억 명의 챗GPT 사용자들이 새로운 앱을 다운로드하지 않고도 이러한 기능을 사용할 수 있게 되었습니다. 이는 AI 이미지 생성을 단순한 작업 도구에서 친구들과 함께 즐길 수 있는 소셜 콘텐츠로 변화시킨 것입니다.

4. 완벽한 도구라고 과장하지 마세요. AI 이미지 생성의 경쟁은 이제 막 시작되었습니다

많은 사람들이 GPT Image 2.5가 경쟁자들을 물리쳤다고 하지만, 아직도 문제점들이 남아 있습니다. 예를 들어, 이미지의 왜곡 문제나 복잡한 지시사항의 오해 등입니다. 상품 이미지의 정확도가 매우 중요한 경우에는 구글의 모델이 더 신뢰할 수 있습니다.

하지만 이번 업데이트는 AI 이미지 생성 업계의 경쟁 방향을 완전히 바꾸었습니다. 이전에는 누가 더 아름다운 이미지를 만들 수 있는지 경쟁했지만, 이제는 누가 사용자들이 더 쉽고 편리하게 이미지를 수정할 수 있게 해주는지 경쟁하고 있습니다. 포스터를 만드는 사람, 게임素材를 만드는 사람, 단편 영상 애니메이션을 만드는 사람 등, 누구의 도구가 더 원활하게 사용할 수 있는지가 중요해질 것입니다. 결국, 모든 기능이 이미 다른 기업들이 개발했더라도 오픈AI는 ‘저비용으로 이미지를 수정할 수 있는 자유’를 수억 명의 일반 사용자들에게 제공했습니다. 이전에는 많은 사람들이 AI 이미지 생성을 번거롭다고 생각해 사용하지 않았지만, 이제는 장벽이 사라져 일반 사용자들의 사용 빈도가 급격히 증가할 것입니다.