Skip to main content
Ovis-ImageOvis-U1을 기반으로 구축된 7B 텍스트 기반 이미지 생성 모델로, 특히 고화질 텍스트 렌더링에 최적화되어 있습니다. 이 모델은 훨씬 더 큰 20B급 시스템과 비교해도 뒤지지 않는 텍스트 렌더링 품질을 제공하며, 동시에 널리 보급된 하드웨어에서도 실행 가능한 수준의 경량성을 유지합니다. 모델 주요 특징:
  • 7B 규모에서 강력한 텍스트 렌더링: Qwen-Image와 같은 훨씬 더 큰 20B급 시스템과 비슷한 텍스트 렌더링 품질을 제공하며, 텍스트 중심의 시나리오에서는 GPT4o와 같은 선도적인 클로즈드소스 모델들과 경쟁할 만큼 우수합니다.
  • 텍스트가 많은 프롬프트에서 높은 정밀도: 언어적 내용과 렌더링된 타이포그래피 간의 긴밀한 일치를 요구하는 프롬프트(예: 포스터, 배너, 로고, UI 모크업, 인포그래픽 등)에서 뛰어난 성능을 발휘합니다.
  • 정확한 양국어 텍스트 렌더링: 다양한 폰트, 크기 및 종횡비에서 중국어와 영어 모두에서 읽기 쉽고 맞춤법이 올바르며 의미적으로 일관된 텍스트를 생성합니다.
  • 효율성과 배포 가능성: 중간 정도의 메모리를 가진 고급 GPU 하나에 적합하며, 낮은 지연 시간의 대화형 사용을 지원합니다.
관련 링크:

Ovis-Image 텍스트 기반 이미지 생성 워크플로

Ovis-Image 텍스트 기반 이미지 생성

Ovis-Image는 생성된 이미지에서 고화질 텍스트 렌더링을 위해 특별히 최적화된 7B 텍스트 기반 이미지 생성 모델입니다. 엄격한 계산 제약 조건 하에서 효율적으로 작동하도록 설계되었습니다. Ovis-Image 텍스트 기반 이미지 생성 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로 다운로드

JSON을 다운로드하거나 템플릿 라이브러리에서 “Ovis image” 검색
ComfyUI가 최신 버전으로 업데이트되었는지 확인하세요.이 가이드의 워크플로는 워크플로 템플릿에서 확인할 수 있습니다. 템플릿에서 찾을 수 없다면, 귀하의 ComfyUI가 오래된 버전일 수 있습니다.워크플로를 로드할 때 노드가 누락되는 경우, 가능한 원인:
  1. 최신 ComfyUI 버전(최신 테스트 버전(nightly))을 사용하고 있지 않음
  2. 일부 노드가 시작 시 가져오기에 실패함

모델 링크

text_encoders diffusion_models vae 모델 저장 위치