도구를 뒷받침하는 기반 모델을 소개합니다: 제조사, 모달리티, 그리고 어떤 도구가 사용하는지. 먼저 제조사나 모달리티로 탐색하고, 도구 페이지에서 공식 문서를 확인하세요.
OpenAI
2026년 9월 공개된 OpenAI의 최신 프런티어 모델로, Astra Pro 단계를 포함해 ChatGPT와 Codex에 제공되는 현행 기본 플래그십입니다.
OpenAI
2026년 7월 이후 OpenAI API의 주력 세대로, 능력과 비용에 따라 Sol·Terra·Luna 세 단계로 나뉘며 GPT-5의 추론과 도구 호출을 이어받습니다.
OpenAI
2025년 8월 7일 공개된 OpenAI 모델로, 공개 즉시 GPT-4o를 대신해 ChatGPT 플래그십이 되었고 작업에 따라 추론 강도를 자동 조정합니다.
OpenAI
추론과 글쓰기 품질이 뛰어난 OpenAI의 4세대 모델로, 많은 글쓰기·코딩·지식 도구의 기본 엔진으로 쓰입니다.
OpenAI
2025년 8월 5일 공개된 OpenAI 최초의 오픈 가중치 모델로, 120b와 20b 두 종을 Apache 2.0 라이선스로 내어 자유로운 자기 호스팅과 파인튜닝이 가능합니다.
OpenAI
2026년 9월 8일 공개된 OpenAI의 이미지 모델로, DALL·E 3를 대체해 ChatGPT 내장 생성 엔진이 되었으며 긴 프롬프트 재현과 이미지 내 텍스트가 강화되었습니다.
OpenAI
OpenAI의 3세대 텍스트-투-이미지 모델로, 2026년 5월 12일 API에서 영구 제거되었습니다. ChatGPT 이미지는 GPT Image 2.5로 넘어갔고, 마이크로소프트의 Bing Image Creator도 Image Creator from Designer로 이름이 바뀌었습니다.
OpenAI
이미지 편집과 변형 생성으로 확산 모델 상용화의 기반을 마련한 OpenAI의 2세대 텍스트-투-이미지 모델로, 2026년 5월 12일 DALL·E 3와 함께 종료되었습니다.
OpenAI
DALL·E 2에서 DALL·E 3로 이어진 OpenAI의 텍스트-투-이미지 모델군 총칭으로, 두 SKU 모두 2026년 5월 12일 제거되었고 후속은 GPT Image 2.5입니다.
OpenAI
2025년 9월 30일 공개된 Sora 2 및 Sora 2 Pro는 물리 표현과 음성·영상 동기가 향상됐지만, 소비자 앱은 2026년 4월 26일 종료되었고 API도 2026년 9월 24일부터 폐지 절차에 들어갔습니다.
Anthropic
긴 컨텍스트와 글쓰기·코딩 능력으로 알려진 Anthropic의 모델군으로, 현행 구성은 Claude Opus 5·Sonnet 5와 4.5 단계입니다. 개발자용과 글쓰기 도구에 널리 채택되었습니다.
Anthropic
2026년 7월 24일 공개된 Anthropic의 플래그십으로, 장시간 에이전트와 고난도 추론에서 가장 강하지만 호출 비용과 지연도 가장 큽니다.
Anthropic
2026년 6월 공개된 Claude 5 세대의 주력 단계로, Opus 5에 가까운 능력을 낮은 비용과 지연으로 제공해 코딩·에이전트 작업의 기본값이 됩니다.
Anthropic
2025년 11월의 이전 세대 플래그십으로, 장기 코딩과 다단계 에이전트에서 크게 도약해 Claude 5 세대 이전의 코딩 기준점이 되었습니다.
Anthropic
2025년 9월 공개된 이전 세대 주력 모델로, 추론·글쓰기·코딩의 균형이 좋아 Claude 3.5 Sonnet 으로부터 Cursor 등의 기본 모델을 물려받았습니다.
Anthropic
2025년 10월 15일 공개된 경량 단계로, 거의 즉각적인 응답에 이전 플래그십에 가까운 능력을 가져 고빈도 대화와 위임된 하위 작업에 알맞습니다.
Anthropic
긴 문서 처리와 코드 이해에 뛰어난 Claude 3.5 세대의 총칭으로, 2025년 10월 28일 종료 일정을 기해 세대 전체가 서비스에서 물러났습니다.
Anthropic
시각 이해를 처음 도입해 Haiku·Sonnet·Opus 세 단계를 아우른 Claude 3 세대의 총칭입니다. Sonnet은 2025년 7월 21일 종료되어 세대 전체가 주력에서 벗어났습니다.
Google의 네이티브 멀티모달 모델군으로, 텍스트는 Gemini 3 Pro와 2.5·Omni 단계가 맡고 이미지는 Nano Banana Pro, 영상은 Veo, 음악은 Lyria입니다. 긴 컨텍스트와 검색·오피스 연동이 강점입니다.
2025년 11월 18일 공개된 Google의 플래그십으로 2.5 세대보다 추론과 멀티모달 이해가 한 단계 위이며, 같은 시기 Ultra 단계는 폐지되고 Pro가 플래그십 이름을 맡았습니다.
2026년에 나온 Google의 omni급 고속 단계로, 텍스트·이미지·오디오·입력을 통합해 낮은 지연의 실시간 멀티모달 상호작용을 노립니다.
2025년 3월 25일 공개된 이전 세대 플래그십으로, 사고 예산을 갖춘 긴 컨텍스트 추론 모델이며 지금도 다수 서드파티 도구의 기본 엔진입니다.
2025년 6월부터 보급된 Gemini 2.5의 고속 단계로, 낮은 비용과 지연으로 고동시성 추론과 멀티모달 처리를 담당합니다.
모델 ID gemini-3.1-flash-image 인 Google의 이미지 모델로, Nano Banana라는 이름으로 유명해져 Imagen 4를 대신해 Google 현행 이미지 SKU가 되었으며 다중 이미지 일관성과 대화형 편집에 강합니다.
Google DeepMind
Google 영상 생성의 현행 버전으로, Veo 3의 음성·영상 동시 생성과 카메라 워크 제어를 유지하면서 피사체 일관성과 참조 이미지·시종 프레임 제어가 강화되었습니다.
Google DeepMind
오디오를 함께 생성한 Google DeepMind의 첫 영상 모델로 화질과 일관성이 최상위권이었습니다. veo-3.0은 2026년 6월 30일 종료되었고 현행은 Veo 3.1입니다.
Google DeepMind
Google DeepMind의 음악 생성 모델로, 텍스트 프롬프트로 보컬이 들어간 완성곡을 만들어 Flow·Gemini 앱 같은 제작 도구에서 호출할 수 있습니다.
Meta
가중치가 공개되고 생태계가 거대한 Meta의 모델군으로, 로컬 실행과 자체 호스팅의 사실상 표준 기반입니다. 최신 세대는 Llama 4입니다.
Meta
2025년 4월 5일 공개된 Meta의 오픈 가중치 세대로, Scout와 Maverick은 공개 즉시 다운로드해 셀프 호스팅할 수 있었고 같은 세대의 Behemoth는 학습 중이라 공식 미공개 상태입니다.
xAI
2026년 기준 xAI 공식 문서가 앞세우는 현행 플래그십 세대로, 4계열의 추론과 실시간 정보를 더 끌어올려 Grok와 X 제품선에 연결합니다.
xAI
추론과 실시간 정보 처리를 강화하고 X 데이터와 깊이 통합된 xAI의 4세대 모델이지만, 현행 주력인 Grok 4.6보다 두 단계 뒤입니다.
xAI
실시간 질의응답과 직설적인 응답 스타일을 겨냥한 xAI의 3세대 모델입니다.
xAI
xAI의 이미지·영상·음성 생성 제품 라인으로, 텍스트로 짧은 클립과 내레이션을 빠르게 만들어 쓰는 소비자용 제품입니다.
Mistral
Mistral의 현행 오픈 가중치 플래그십(버전 v25.12)으로, 다국어·추론·함수 호출을 두루 갖추고 가중치 공개로 셀프 호스팅이 가능합니다.
Mistral
Mistral의 플래그십 단계를 가리키는 일반 표기로 유럽 기업 도입이 활발하지만, 지금 이 문자열은 대부분 Mistral Large 3로 해결됩니다.
Mistral
효율이 높고 비용이 낮아 로컬·엣지 배포에 적합한 Mistral의 경량 모델입니다.
Mistral
Mistral의 코드 전용 모델(25.08 릴리스)로, 인라인 완성·저장소 단위 문맥을 다루며 IDE 플러그인의 백엔드로 자리 잡았습니다.
Mistral
Mistral의 오디오 모델로, 음성을 그대로 멀티모달 모델에 넣어 다국어 전사와 음성 질문 응답에 씁니다.
DeepSeek
2025년 12월에 나온 DeepSeek의 오픈소스 주력으로, 긴 컨텍스트 추론과 도구 호출에서 V3.1을 이어받았고 가격은 계속 공격적입니다.
DeepSeek
DeepSeek V4 세대의 공식 SKU(스냅숏 V4-Pro-0813)로, 복잡한 추론과 긴 코드 작업을 담당하며 API에서 deepseek-v4-pro라는 이름으로 호출합니다.
DeepSeek
DeepSeek V4 세대의 고속 단계로 공식 API명은 deepseek-flash, 현행은 V4.1-Flash이며 낮은 비용과 지연으로 고빈도·배치 호출을 처리합니다.
DeepSeek
DeepSeek 오픈소스 모델군의 총칭으로 현행은 V3.1/V3.2 주력과 V4의 두 단계입니다. 참고로 'DeepSeek V4'는 공식 SKU명이 아니므로 deepseek-v4-pro / deepseek-flash를 써야 합니다.
Alibaba
2025년 4월 28일 공개된 Alibaba의 오픈 가중치 Qwen 세대로, 엣지부터 서버 규모까지 크기를 갖춰 중국 셀프 호스팅의 주력 기반입니다.
Alibaba
2025년 9월 24일 발표된 Alibaba의 플래그십으로 1T를 넘는 파라미터를 갖추고 복잡한 추론과 에이전트 작업을 겨냥하며 주로 API로 제공됩니다.
Alibaba
2026년 8월 12일 가중치가 공개된 Qwen의 새 세대로, Alibaba의 오픈 가중치 노선을 이어 셀프 호스팅과 미세 조정이 가능합니다.
Alibaba
Qwen API의 플래그십 단계 이름으로, 중국어 이해와 멀티모달 능력이 뛰어나 기업 상용 배포가 활발하지만 이에 대응하는 최신 오픈 가중치 세대는 Qwen3 계열입니다.
Alibaba
성능과 비용의 균형이 좋아 대부분의 중국어 대화·글쓰기 상황에 적합한 Qwen의 균형형 모델입니다.
Alibaba
저비용 고처리량으로 대규모 텍스트 처리에 적합한 Qwen의 고속 모델입니다.
Alibaba
텍스트-투-비디오와 이미지-투-비디오 품질이 오픈소스 최상위권인 Alibaba의 오픈소스 영상 생성 모델군으로, 중국 창작 커뮤니티에서 널리 쓰입니다.
Zhipu AI
2025년 9월에 나온 Zhipu AI의 이전 세대 플래그십으로 가중치를 공개하고 코딩과 장문에 강해 셀프 호스팅 구성에서 자주 인용됩니다.
Zhipu AI
Zhipu AI의 새 세대 주력으로, GLM-4.6을 대신해 앞세워지는 단계가 되면서 에이전트와 코딩을 강화하고 긴 컨텍스트와 도구 호출을 끌어올렸습니다.
Zhipu AI
Zhipu AI의 현행 상위 버전으로 100만 토큰급 컨텍스트와 오픈 가중치를 함께 제공하며 장문 문서와 저장소 전체 코드 이해를 앞세웁니다.
ByteDance
2025년 9월 9일 공개된 ByteDance의 이미지 생성 모델로, Volcano Engine과 Doubao·Jimeng 진입점을 통해 제공되어 중국산 텍스트-투-이미지의 주류 선택지입니다.
Kuaishou
Kuaishou Kling의 성숙기 주력 버전으로, 1.x보다 인물 일관성·움직임의 폭·중국어 지시 이해가 뚜렷하게 좋아졌고 텍스트-투-비디오와 이미지-투-비디오를 지원합니다.
Kuaishou
2026년에 나온 Kuaishou의 최신 세대로, 한 번에 15초 생성·4K 출력·립싱크를 지원해 중국산 영상 생성의 최상위 후보입니다.
MiniMax
MiniMax 해루오 영상 모델의 총칭으로 현행은 Hailuo-02, 2.3, 오픈 가중치 올모달 H3를 포함합니다. 인물 움직임이 자연스럽고 물리 표현이 사실적이며 중국어 지시 이해가 뛰어납니다.
MiniMax
해루오의 이전 세대 주력 영상 버전으로, 02 세대보다 지시 추종·물리 리얼리즘·캐릭터 일관성이 좋아 SNS 숏폼과 광고 스토리보드에 자주 쓰입니다.
MiniMax
2026년 7월 발표된 MiniMax의 최신 세대로, 오픈 가중치 올모달(omni) 모델로 제공되어 영상 생성과 이해를 한 스택에서 운영할 수 있습니다.
MiniMax
2026년 5월에 나온 MiniMax의 범용 대규모 모델로, 긴 컨텍스트와 에이전트 작업을 앞세워 해루오 시리즈 쪽의 텍스트 주력을 담당합니다.
Moonshot AI
Moonshot AI의 Kimi 모델군 총칭으로, 초기 장문 모델에서 K2·K2.5·2.8T 파라미터의 K3까지 진화했지만 초장문 읽기와 파일 분석은 여전히 간판 능력입니다.
Moonshot AI
2025년 7월 공개된 Moonshot AI의 오픈소스 플래그십으로, 총 1T·활성화 32B MoE 구조에 수정 MIT 라이선스로 가중치를 열었고 에이전트와 코드에 강합니다.
Moonshot AI
2026년 1월에 나온 K2의 개선 버전으로, 멀티모달 이해와 추론 체인을 더 강화하면서 장문 문서 분석 우위는 그대로 유지했습니다.
Moonshot AI
2026년 7월 발표된 Moonshot AI의 최신 플래그십으로 2.8T 파라미터 규모이며 장시간 에이전트와 복잡한 추론 작업을 겨냥합니다.
Stability AI
로컬 배포와 미세 조정 생태계가 매우 큰 Stability AI의 오픈소스 플래그십 텍스트-투-이미지 모델로, Civitai·ComfyUI 같은 커뮤니티의 기반 모델입니다.
Stability AI
모델 크기가 작고 ControlNet 생태계가 성숙해 로컬 배포 입문에 가장 적합한 Stable Diffusion의 고전 버전입니다.
Stability AI
한 단계로 생성하고 지연이 극히 낮아 실시간 캔버스와 인터랙티브 용도에 맞는 Stability AI의 실시간 텍스트-투-이미지 모델입니다.
Stability AI
이미지-투-비디오의 대표 주자로 커뮤니티 미세 조정과 통합이 활발한 Stability AI의 오픈소스 영상 확산 모델입니다.
Stability AI
상업적 이용이 가능한 음악·샘플·효과음을 생성하고 상용 라이선스도 제공하는 Stability AI의 음악·효과음 생성 모델입니다.
Black Forest Labs
화질과 문자 렌더링이 업계를 선도하는 Black Forest Labs의 이미지 생성 모델군으로, 현행은 FLUX.2의 [pro]·[dev]·[klein] 세 단계이고 FLUX.1 계열도 여전히 쓰입니다.
Black Forest Labs
2025년 12월 공개된 Black Forest Labs의 이미지 세대로, [pro]는 API 제공, [dev]는 가중치 공개로 미세 조정 가능, [klein]은 2026년 1월에 오픈 경량·고속 단계로 나왔습니다.
오픈소스 커뮤니티
로컬에서 동작하고 완전 무료인 오픈소스 이미지 초해상도 모델로, Upscayl 같은 확대 도구의 핵심 엔진입니다.
Midjourney
2026년 3월 17일부터 알파로 제공되는 Midjourney의 최신 세대로, 안정화까지 V7과 병행해 고를 수 있습니다.
Midjourney
2025년 4월 4일 공개된 Midjourney 세대로, V6보다 화질과 프롬프트 추종이 나아 한동안 회사의 이미지 제품 주력이었습니다.
Recraft
벡터 생성과 브랜드 스타일 제어가 업계 선두이며 디자이너 워크플로 전용인 Recraft의 3세대 모델입니다. 후속 세대는 이 디렉터리에 실리지 않았으니 도입 시 공식 문서를 확인하세요.
Ideogram
2025년 3월 공개된 Ideogram 세대로, 문자 렌더링과 레이아웃 구성이 한 걸음 더 진보해 포스터와 브랜드 비주얼에 자주 쓰입니다.
Ideogram
문자 렌더링이 정확해 포스터·로고 콘셉트·타이포그래피 이미지 생성이 안정적이던 Ideogram의 2세대 모델로, 2025년 3월 Ideogram 3에 이어졌습니다.
Ideogram
텍스트-투-이미지에서 신뢰할 수 있는 문자 렌더링을 처음 열어젖힌 Ideogram의 1세대 모델입니다.
Leonardo AI
이미지 품질과 프롬프트 준수성이 크게 향상되어 게임·크리에이티브 에셋에 자주 쓰이는 Leonardo AI의 신세대 기반 모델입니다.
Leonardo AI
스타일 템플릿이 풍부하고 커뮤니티 작품이 방대한 Leonardo AI의 초기 확산 모델 시리즈입니다.
Adobe
Photoshop·Illustrator와 깊이 통합되고 상업적 권리 관계가 명확한 Adobe의 3세대 Firefly 모델입니다.
Adobe
생성형 채우기와 문자 효과가 성숙해 디자인 워크플로에 내장된 Adobe의 2세대 Firefly 모델입니다.
Freepik
세부 묘사가 풍부하고 자체 소재 라이브러리·상용 라이선스 체계와 결합된 Freepik의 고충실도 이미지 생성 모델입니다.
Magnific AI
환각적 디테일 재구성으로 유명하며 저해상도 이미지를 고디테일 작품으로 끌어올리는 Magnific의 이미지 확대 모델입니다.
Playground
생성·부분 리페인트·레이어 편집을 하나로 다루는 Playground의 캔버스형 이미지 모델입니다.
Krea
캔버스의 스케치를 즉시 렌더링·확대해 콘셉트 디자인 반복이 매우 빠른 Krea의 실시간 생성 모델입니다.
Runway
2025년 12월 11일 나온 Runway의 상위 버전으로, 물리 리얼리즘과 지시 추종을 더 밀어 올린 회사의 영상 플래그십입니다.
Runway
2025년 4월 1일 공개된 Runway의 영상 모델로, 참조 이미지 기반의 인물·장면 일관성과 카메라 조작을 축으로 Gen-3 Alpha로부터 주력을 넘겨받았습니다.
Runway
2025년 7월 31일 공개된 Runway의 영상 편집 모델. 이미 만든 영상을 편집 대상으로 다뤄 피사체나 카메라 바꿔도 남은 정보는 유지됩니다.
Runway
2025년 8월 20일 공개된 Runway의 연기 전이 모델로, 배우의 움직임과 표정을 대상 캐릭터로 옮기면서 원본 연기의 결을 살립니다.
Pika
효과 템플릿과 캐릭터 일관성 영상에 강해 SNS 숏폼에서 자주 쓰이는 Pika의 2세대 영상 모델입니다.
Pika
가볍고 시작하기 쉬워 SNS 창의 영상에서 인기 있는 Pika의 1세대 영상 모델입니다.
Luma AI
자연스러운 물리 운동과 영화적 카메라워크가 강점이며 키프레임 제어와 루프 영상을 지원하는 Luma AI의 영상 모델입니다.
Luma AI
영상과 사진에서 3D 장면과 가우시안 스플래팅 에셋을 재구성하는 Luma의 캡처·재구성 기술입니다.
Genmo
로컬 배포와 자체 호스팅이 가능한 Genmo의 오픈소스 영상 모델로, 오픈 영상 생성의 중요한 이정표입니다.
LTX Studio
영상 내러티브를 위해 스토리보드, 캐릭터 일관성, 카메라 제어를 통합한 LTX Studio의 영상 모델입니다.
D-ID
얼굴 사진 한 장으로 말하게 하는 D-ID의 사진 구동형 아바타 모델로, API는 고객 상담과 마케팅 연동에 적합합니다.
HeyGen
대본을 한 번에 실사 질감의 발화 영상으로 바꾸고 영상 번역과 립싱크에도 강한 HeyGen의 아바타 모델입니다.
ByteDance
스마트 편집·자동 자막·AI 효과·아바타를 아우르고 중국어권 템플릿이 가장 풍부한 CapCut 내장 AI 모델 모음입니다.
VEED
자동 자막·AI 내레이션·노이즈 제거·아바타를 아우르는 VEED의 온라인 편집 AI 모델 모음입니다.
Suno
2026년 9월 나온 Suno의 현행 버전으로, 음원사 라이선스를 확보한 첫 학습 데이터셋을 앞세워 상업적 투명성이 핵심 키워드가 되었습니다.
Suno
2025년 9월 23일 공개된 Suno의 음악 모델로, 보컬과 편곡의 리얼리즘이 4세대보다 뚜렷하게 좋아져 v6 이전까지 주력이었습니다.
Udio
보컬 곡과 다장르 완성 트랙에 강하고 부분 재생성과 정교한 편집을 지원하는 Udio의 고충실도 음악 모델입니다.
ElevenLabs
사실감과 감정 표현이 업계 기준인 ElevenLabs 음성 합성 모델군의 총칭으로, 현행 주력은 Eleven v3입니다.
ElevenLabs
2025년 6월 공개된 ElevenLabs의 새 세대 음성 모델로, 70개 이상 언어를 덮고 감정·스타일 제어와 긴 연속 생성, 여러 화자 대화를 지원합니다.
Murf
120개 이상의 음성이 20개 이상 언어를 커버하고 기업 교육·설명 영상에 자주 쓰이는 Murf의 내레이션 모델 라이브러리입니다.
LOVO
500개 이상의 음성과 감정 표현을 갖추고 내레이션과 영상 편집을 하나로 묶은 LOVO의 Genny 내레이션 모델입니다.
Play.ht
저지연 스트리밍 출력이 실시간 용도에 맞고 음성 라이브러리가 다국어를 커버하는 Play.ht의 음성 합성 모델입니다.
Speechify
문서·웹페이지·도서를 자연스러운 음성으로 바꾸며 학습과 접근성 상황에 자주 쓰이는 Speechify의 낭독 모델입니다.
Kits.AI
자기 목소리를 복제하거나 허가된 아티스트 음성으로 데모를 만들 수 있는 Kits.AI의 음성 모델 학습 플랫폼입니다.
Adobe
시끄러운 녹음을 한 번에 스튜디오 품질로 바꾸며 무료로 쓸 수 있는 Adobe Podcast의 음성 개선 모델입니다.
Meshy
텍스트-투-3D와 이미지-투-3D 품질이 향상되어 게임·이커머스 에셋에 자주 쓰이는 Meshy의 2세대 3D 생성 모델입니다.
Meshy
텍스트-투-3D의 진입 장벽을 낮춘 Meshy의 1세대 3D 생성 모델입니다.
Tripo AI
이미지-투-3D와 텍스트-투-3D가 빠르고 토폴로지 품질이 계속 개선되는 Tripo AI의 3D 생성 모델입니다.
Deemos
인물과 캐릭터의 포토리얼리스틱 에셋에 집중하며 영상·버추얼 휴먼 프로젝트에 자주 쓰이는 Deemos의 고충실도 3D 생성 모델입니다.
Spline
프롬프트로 장면과 모션을 생성해 웹에 바로 삽입하는 Spline의 브라우저 내 3D 디자인 AI입니다.
Grammarly
문법 교정·어조 조정·표절 검사를 하나로 묶고 브라우저와 모바일 키보드에서 쓸 수 있는 Grammarly의 글쓰기 지원 모델입니다.
Rytr
40개 이상의 사용 사례와 어조 템플릿을 갖추고 가격이 합리적이어서 시작하기 쉬운 Rytr의 경량 글쓰기 모델입니다.
Consensus
동료 심사 논문을 근거로 연구 결론과 인용 품질 지표를 함께 제시하는 Consensus의 학술 Q&A 모델입니다.
Character.AI
커뮤니티가 만든 캐릭터 생태계가 방대하고 동반·엔터테인먼트를 대표하는 Character.AI의 역할극 대화 모델입니다.
Replit
프롬프트에서 동작하는 앱을 구성하고 배포까지 수행하는 Replit의 코딩 모델입니다.
ClickUp
작업 작성·문서 요약·프로젝트 상태 답변을 자동화하는 ClickUp의 프로젝트 관리 AI 모델입니다.
Gamma
개요나 문서에서 보기 좋은 슬라이드와 사이트를 자동 생성하는 Gamma의 프레젠테이션 생성 모델입니다.
Beautiful.ai
내용에 따라 슬라이드를 자동 정렬·재배치하는 Beautiful.ai의 스마트 레이아웃 모델입니다.
Descript
문서를 편집하듯 음성·영상을 편집하게 해 주는 Descript의 편집 모델로, 전사 기반 편집 경험을 처음 열었습니다.
사용자 학습 모델
사용자가 자기 소재로 미세 조정하거나 학습시킨 모델로 Civitai·Tensor.Art 같은 커뮤니티의 LoRA 생태계에서 흔합니다.
여러 벤더
각 사가 자사 제품용으로 독자 개발하고 공개하지 않은 모델의 총칭으로 능력 범위는 각 사 공식 문서를 따릅니다.
Fliki
2000개 이상의 AI 음성이 80개 이상 언어를 커버하며 텍스트-투-비디오 내레이션 전용인 Fliki의 음성 모델 라이브러리입니다.
NovelAI
장편 소설 집필에 특화되어 문체 유지와 캐릭터 일관성이 뛰어난 NovelAI의 이야기 생성 모델입니다.
NovelAI
캐릭터 일관성과 2차 창작 커뮤니티 평판이 좋은 NovelAI의 애니메이션풍 이미지 모델입니다.
모델 디렉터리는 공개된 이름이 있고 이 디렉터리의 도구가 사용을 명시한 모델만 수록합니다. 이름이 공개되지 않은 자체 모델을 쓰는 도구는 해당 모델 문자열을 도구 페이지에 남기고 별도 모델 항목으로 만들지 않습니다. 같은 벤더의 여러 버전은 해당 시리즈 항목으로 묶습니다. 성능·이용 가능성·라이선스 조건은 벤더 공식 문서를 따릅니다.
도구 페이지는 제품의 기능을 설명하고, 모델 페이지는 그 밑의 엔진에 답합니다. 같은 제조사의 버전 간 차이나, 후보 도구가 같은 기반 모델을 쓰는지를 확인하세요. 도구 층의 기능만 비교하기보다 먼저 기반을 확인하는 편이 더 빨리 후보를 좁힐 수 있습니다.