이제 Gemini에 사진을 업로드하고 편집할 수 있습니다.
전문화:
- 이제 Gemini에서 사진을 무료로 업로드하고 편집할 수 있습니다. 이 기능은 오늘부터 모든 사용자에게 점진적으로 제공됩니다.
- 사용자는 대화형 텍스트 프롬프트를 통해 Gemini에서 AI 이미지를 만들고 편집할 수도 있습니다.
- Google은 Gemini에 있는 모든 AI 생성 이미지에 눈에 보이는 워터마크와 눈에 보이지 않는 SynthID 디지털 워터마크가 포함될 것이라고 확인했습니다.
마지막으로, Google은 Gemini에서 텍스트 메시지를 통해 이미지를 편집하는 기능을 도입합니다. 이제 기존 이미지를 업로드하고 Gemini에서 텍스트 대화를 통해 편집할 수 있습니다. 또한, Gemini를 사용하여 AI 기반 이미지를 만들고 복제하여 이미지를 수정할 수 있습니다. Gemini 이미지 편집 기능은 오늘부터 모든 사용자에게 점진적으로 출시됩니다. 이 새로운 기능은 사용자 경험을 향상시키고 강력한 크리에이티브 도구를 제공합니다.
Google은 AI Studio에서 Gemini 2.0 Flash 모델을 사용하여 네이티브 이미지 편집을 최초로 시연했습니다. 저는 2월에 이 모델을 테스트했는데, 대화형 이미지 편집이 얼마나 쉽게 가능한지 놀라웠습니다. Google의 네이티브 이미지 생성 모델에 대응하여 OpenAI도 ChatGPT에서 네이티브 이미지 편집 및 생성 기능을 선보였습니다.
이로 인해 지브리 열풍이 빠르게 확산되었고 ChatGPT 사용량도 증가했습니다. 이제 구글은 자사의 소비자 앱인 제미니(Gemini)에 이미지 편집 기능을 내장했습니다. 제미니 모바일 앱과 웹 모두에서 이미지를 편집할 수 있다는 점에 주목하세요. 이 기능은 제미니를 생성형 AI 분야에서 강력한 경쟁자로 만들어줍니다.
ChatGPT와 Gemini의 기본 이미지 편집 기능을 비교해 본 결과 , Gemini가 세대 간 캐릭터/장면 일관성 유지 측면에서 훨씬 우수하다는 것을 알 수 있었습니다. ChatGPT는 세대가 바뀔 때마다 전체적인 이미지가 변경되는 반면, Gemini는 놀라울 정도로 일관성을 유지합니다. 하지만 이미지 생성 측면에서는 ChatGPT가 Gemini보다 우수합니다. 이는 사용된 모델 아키텍처의 차이를 반영하는 것입니다.
이제 구글이 여전히 Imagen 3 확산 기반 모델을 사용하여 이미지를 생성하는지, 아니면 Gemini 모델의 기본 이미지 생성 기능을 사용하는지 알아봐야 합니다. 참고로, OpenAI는 GPT-4o AI 모델을 사용하여 이미지를 생성하고 수정합니다. 이러한 발전은 인공지능 분야의 지속적인 경쟁을 보여줍니다.
또한, 구글은 Gemini를 사용하여 생성되거나 수정된 모든 이미지에 보이지 않는 SynthID 디지털 워터마크가 내장되어 있다고 밝혔습니다. 더 나아가, 구글은 Gemini를 사용하여 생성된 모든 이미지에 눈에 보이는 워터마크를 추가할 예정입니다. 이 조치는 인공지능 활용의 투명성과 책임성을 강화하기 위한 것입니다.
댓글이 닫혔습니다.