RIDE 플랫폼 탑재 AI 모델 목록
RIDE 한 계정에서 쓰는 생성형 AI 모델 84종입니다. 영상·이미지·글쓰기·음악·목소리·3D 순서로, 모델마다 만들 수 있는 것을 표시했습니다.
영상 만들기
Gemini Omni Flash 1.1
Google글로 적은 장면을 소리와 함께 3~10초 영상으로 만듭니다. 사진 한 장에 움직임을 주거나, 시작·끝 장면을 정해 그 사이를 잇거나, 참고 이미지로 등장인물을 맞출 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지 · 소리 포함
Seedance 2.5
ByteDance최대 30초짜리 긴 장면을 한 번에 만드는 영상 모델입니다. 참고할 사진·영상·목소리를 함께 넣어 분위기와 등장인물을 맞출 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지·영상·음성 · 소리 포함 · 최대 30초
Runway Gen-4.5
Runway런웨이의 영상 생성 모델입니다. 글이나 사진 한 장으로 2~10초 영상을 자연스러운 움직임으로 만들며, 소리는 담기지 않습니다.
텍스트로 영상 · 이미지로 영상 · 2~10초
Kling O3 Standard
KuaishouKling O3 의 기본 등급입니다. 글·사진·참고 이미지로 3~15초 영상을 소리와 함께 만듭니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지 · 소리 포함 · 3~15초
Kling O3 Pro
KuaishouKling O3 의 1080P 등급입니다. Standard 와 같은 방식으로 3~15초 영상을 더 높은 해상도로 만듭니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지 · 소리 포함 · 1080P
Kling O3 4K
Kuaishou메가 회원Kling O3 의 4K 등급입니다. 처음부터 4K 해상도로 3~15초 영상을 만들어, 큰 화면 상영이나 고해상도 편집 원본이 필요할 때 알맞습니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지 · 소리 포함 · 4K
MiniMax H3
MiniMax글이나 사진, 또는 참고 이미지 여러 장으로 5~15초 영상을 만듭니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지
MiniMax H3 Max
MiniMaxH3 를 바탕으로 요청 반영과 화면 완성도를 높인 버전입니다. 참고 이미지·영상·음성을 함께 넣어 5~15초 영상을 만들고, 만든 영상의 인물 교체 · 중간 장면 삽입 · 이어 만들기도 됩니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지·영상·음성 · 영상 편집
MiniMax H3 Max Turbo
MiniMaxH3 Max 와 같은 방식으로 글·사진에서 5~15초 영상을 더 빠르게 만드는 버전입니다. 여러 편을 빨리 뽑아 비교할 때 알맞습니다.
텍스트로 영상 · 이미지로 영상 · 빠른 생성
Happy Horse 1.1
Alibaba말하는 장면에 강한 영상 모델입니다. 여러 언어의 입 모양을 자연스럽게 맞추고 소리도 함께 만들며, 3~15초 길이를 정할 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지 · 소리 포함
Wan 3.0
Alibaba움직임이 부드럽고 장면을 충실하게 그리는 영상 모델입니다. 한 번에 최대 30초까지 만들며 참고 이미지·영상·음성을 함께 넣을 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지·영상·음성 · 소리 포함
Wan 3.0 Prime
AlibabaWan 3.0 을 빠른 생성과 참고 자료 반영에 맞춘 버전입니다. 여러 참고 자료 속 인물·스타일·움직임을 일관되게 따르며 최대 30초까지 만듭니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지·영상·음성 · 소리 포함 · 빠른 생성
FLUX.3
Black Forest Labs최대 20초 영상을 소리와 함께 만듭니다. 장면 사진을 원하는 시점에 최대 10장까지 꽂아 흐름을 정하고, 시작·끝 장면을 잇거나 이미 만든 영상의 마지막 장면에서 이어 갈 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 장면 사진 순서 지정 · 이어 만들기 · 소리 포함 · 최대 20초
Pika 2.2
Pika5초·10초의 짧은 영상을 만듭니다. 여러 사진을 한 장면에 합치거나, 사진 2~5장을 차례로 이어 움직임을 만들 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 여러 사진 합성 · 장면 사진 순서 지정
PixVerse C1
PixVerse글·사진으로 소리가 있는 영상을 만들고, 두 장면을 잇는 전환 영상도 만듭니다. 등장인물과 배경을 사진으로 따로 지정할 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 장면 전환 · 참고 이미지 · 소리 포함
PixVerse VibeMV
PixVerse음원 하나로 뮤직비디오를 만듭니다. 캐릭터 사진과 스타일을 고르고, 가사를 자막으로 넣을 수 있습니다.
음악으로 영상 · 뮤직비디오 · 가사 자막
Luma Ray 3.2
Luma글·사진으로 5초·10초 영상을 만들고, 만든 영상을 다시 다듬거나 원본은 그대로 둔 채 다른 화면 비율로 넓힐 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 영상 편집 · 비율 변경
Grok Imagine 1.5 Video
xAI글이나 사진 한 장, 참고 이미지(최대 7장)로 소리가 있는 1~15초 영상을 만듭니다. 6초 기준 60 RIDE입니다.
텍스트로 영상 · 이미지로 영상 · 참고 이미지 · 소리 포함 · 1~15초
Grok Imagine 1.5 Lite Video
xAIGrok Imagine 1.5 의 가벼운 판입니다. 글이나 사진 한 장으로 1~15초 영상을 만들며, 6초 기준 15 RIDE입니다.
텍스트로 영상 · 이미지로 영상 · 1~15초
Kandinsky 6.0 Pro
Kandinsky Lab글이나 첫 장면 사진 한 장으로 영화 같은 질감의 5초 영상을 만듭니다. 장면에 맞는 소리도 함께 만들어 줍니다.
텍스트로 영상 · 이미지로 영상 · 소리 포함
Kandinsky 6.0 Lite
Kandinsky Lab가볍고 빠른 영상 모델입니다. 글이나 사진 한 장으로 소리가 담긴 5초 영상을 저렴하게 만들어 움직임 시안을 빠르게 확인할 수 있습니다.
텍스트로 영상 · 이미지로 영상 · 소리 포함
영상 고치기
Runway Aleph 2.0
Runway런웨이의 영상 편집 모델입니다. 30초 이하 영상을 넣고 말로 지시하면 장면을 바꾸며, 첫 장면 이미지 한 장으로 방향을 잡을 수 있습니다.
영상 편집 · 첫 장면 지정
Gemini Omni Flash (편집)
Google내 영상을 한 문장으로 고칩니다. 대화하듯 이어서 여러 번 수정할 수도 있습니다.
영상 편집 · 대화형 편집
Kling O3 (편집·참조)
Kuaishou영상 속 배경·소품·인물을 참고 이미지로 바꾸거나, 원본의 카메라 움직임을 본떠 새 장면을 만듭니다. Standard·Pro·4K 등급이 있습니다.
영상 편집 · 참고 이미지 · 소리 유지
VEED Lipsync v2
VEED영상 속 인물의 입 모양을 새 음성에 맞춰 다시 만듭니다. 상업적 이용이 허용된 모델입니다.
립싱크
HeyGen v3 Lipsync
HeyGen얼굴 표정까지 자연스럽게 맞추는 정밀 립싱크 모델입니다. 영상 속 인물의 입 모양을 새 음성에 맞춥니다.
립싱크
sync-3 (립싱크)
Sync Labs영상 속 인물의 입 모양을 새 음성에 맞추고, 영상과 음성 길이가 다를 때의 처리 방식을 고를 수 있습니다. 사진 한 장과 음성만으로 말하는 영상도 만듭니다.
립싱크 · 사진 립싱크
Topaz (화질 보정)
Topaz Labs영상의 해상도를 키우고(업스케일), 슬로모션·프레임 보간, 노이즈·모션 블러 제거, 흑백 컬러화, HDR 변환까지 합니다. 사진도 선명하게 다듬고, AI로 만든 이미지는 새 디테일을 더해 크게 키웁니다.
업스케일 · 슬로모션 · 복원·컬러화 · HDR 변환
FLUX 영상 업스케일
Black Forest Labs20초 이하 영상을 1080p·2K·4K 로 키웁니다. 원본에 충실한 정밀 방식과 세부를 보강하는 창작 방식 중 고를 수 있습니다.
업스케일 · 4K
Kandinsky 6.0 VSR
Kandinsky Lab5초 이하 영상을 2·2.25·4배로 키웁니다. 세부를 선명하게 살리면서 프레임 사이 깜박임 없이 안정적으로 확대하며, 480p 영상을 1080p 로 올리기에 알맞습니다. 더 빠르게 처리하는 경량 Lite 도 고를 수 있습니다.
업스케일 · 1080p · Lite
Runway Ruby (SDR → HDR)
Runway일반(SDR) 영상을 HDR10·HLG 규격의 HDR 영상으로 바꿉니다. 원본의 화면과 소리는 그대로 두고 밝기와 색의 폭만 넓히며, 30초 이하 영상을 받습니다.
HDR 변환
Magnific 영상 업스케일
Magnific30초 이하 영상을 최대 4K 까지 키우면서 세부 묘사를 새로 보강합니다. 보강 정도·선명도·질감·색감을 조절할 수 있습니다.
업스케일 · 4K · 디테일 보강
Runway 프레임레이트 변환
Runway영상의 길이는 그대로 두고 초당 프레임 수를 24~120fps 로 바꿔 움직임을 더 부드럽게 만듭니다.
프레임 보간
이미지 만들기
Nano Banana Pro
Google구글의 상위 이미지 모델입니다. 화면 속 글자를 정확하게 그리고, 참고 이미지를 넣어 고쳐 그릴 수 있습니다.
텍스트로 이미지 · 이미지 편집 · 참고 이미지 · 글자 표현
Nano Banana 2.1
Google같은 캐릭터를 여러 장면에서 일관되게 그리고 이미지 속 글자도 또렷하게 그리는 이미지 모델입니다. 참고 이미지를 넣어 고쳐 그릴 수도 있습니다.
텍스트로 이미지 · 이미지 편집 · 캐릭터 일관성
GPT Image 2
OpenAI글자가 들어간 포스터·슬라이드 같은 그림에 강합니다. 배경 없는(투명) 이미지와 3단계 품질 선택이 됩니다.
텍스트로 이미지 · 이미지 편집 · 글자 표현 · 투명 배경
GPT Image 2.5 Sunburst
OpenAIOpenAI 의 최상급 이미지 모델이며 이미지 생성의 기본 엔진입니다. 고쳐 그릴 때 인물과 제품의 모양을 정확히 지키고, 배경 없는(투명) 이미지와 5단계 품질 선택이 됩니다.
텍스트로 이미지 · 이미지 편집 · 정밀 편집 · 투명 배경
GPT Image 2.5 Flare
OpenAIOpenAI 의 가장 빠른 이미지 모델입니다. GPT Image 2 와 같은 화질을 더 빨리 만들고, 편집·투명 배경·5단계 품질 선택이 됩니다.
텍스트로 이미지 · 이미지 편집 · 빠른 생성 · 투명 배경
Recraft V4.1
Recraft디자인·브랜드 작업용 이미지 모델입니다. 스타일과 색을 세밀하게 정할 수 있고 로고·아이콘용 벡터(SVG)도 만듭니다. 빠른 시안용 Flash 와 Utility·Pro 등급이 있습니다.
텍스트로 이미지 · 벡터(SVG) · 스타일·색 지정 · 빠른 생성
Ideogram V4.5
Ideogram글자를 정확하고 보기 좋게 넣는 데 특화된 이미지 모델입니다. 포스터·로고·디자인에 알맞고, 품질을 세 단계로 고를 수 있으며 원본에 참고 이미지를 더해 고칠 수도 있습니다.
텍스트로 이미지 · 이미지 편집 · 참고 이미지 · 글자 표현
FLUX.3 Image Edit
Black Forest Labs사진에서 고칠 부분만 바꾸고 나머지는 그대로 둡니다. 참고 이미지를 최대 10장까지 합쳐 자연스러운 한 장면으로 만들 수 있습니다.
이미지 편집 · 참고 이미지
MAI-Image 2.5
Microsoft사진 같은 실사와 글자 표현이 강점입니다. Pro 등급은 구도·글자·인물을 지키며 고쳐 그리는 편집까지 됩니다.
텍스트로 이미지 · 이미지 편집 · 글자 표현 · 실사
Muse Image
Meta요청을 충실히 따르며 글자·도표·QR 코드 같은 세부까지 정확하게 그리는 이미지 모델입니다. 참고 이미지를 10장까지 넣어 필요한 부분만 고칠 수 있습니다.
텍스트로 이미지 · 이미지 편집 · 글자 표현
Grok Imagine 2.0
xAI짧게 적어도 알아서 풍성하게 그려 주는 이미지 모델입니다. 참고 이미지를 5장까지 넣어 고칠 수 있으며, 생성·편집 모두 장당 5 RIDE입니다.
텍스트로 이미지 · 이미지 편집
Luma Uni-1 Max
Luma글로 새 이미지를 만들고, 원본의 구조를 강하게 지키며 고칩니다. 고친 결과는 원본 비율을 따르며, 참고 이미지로 편집 방향을 잡습니다.
텍스트로 이미지 · 이미지 편집
Luma Uni-1
LumaUni-1 Max 의 표준 등급입니다. 같은 방식으로 만들고 고치며 차감이 더 적습니다.
텍스트로 이미지 · 이미지 편집
SAM 3.1
Meta단어 하나로 사진·영상 속 객체를 찾아 픽셀 단위 마스크를 만들고 영상에서는 프레임을 넘어 따라갑니다.
세그멘테이션 · 마스크 · 영상 추적
글쓰기·대화
Claude Fable 5.1
Anthropic앤트로픽의 가장 똑똑한 모델입니다. 긴 문서 작업과 코딩, 복잡한 기획을 끝까지 해냅니다.
글쓰기·대화 · 코딩 · 최상급
Claude Opus 5.5
Anthropic어려운 추론과 여러 단계에 걸친 작업에 강한 상위 모델입니다. 긴 코딩·문서 작업을 끝까지 이어 갑니다.
글쓰기·대화 · 코딩
Claude Sonnet 5.5
Anthropic속도와 지능의 균형이 가장 좋은 범용 모델입니다. 일상적인 글쓰기·요약부터 긴 문서 작업까지 빠르게 처리합니다.
글쓰기·대화 · 균형
Claude Haiku 5.5
Anthropic가장 빠르고 저렴한 Claude입니다. 분류·요약·추출처럼 많은 양을 빠르게 처리하는 작업에 알맞습니다.
글쓰기·대화 · 빠른 응답
GPT-6 Astra
OpenAI오픈AI의 가장 유능한 모델입니다. 복잡한 추론·코딩·조사·문서 작성처럼 여러 단계를 끝까지 이어 가는 어려운 작업에 맞습니다. 응답을 더 빠르게 받는 초고속 모드도 제공합니다.
글쓰기·대화 · 코딩 · 최상급 · 초고속 모드
GPT-6.1 Sol
OpenAI복잡한 코딩과 전문 업무에 맞춘 모델입니다. 최상위 모델보다 저렴하게 여러 단계에 걸친 작업을 처리합니다.
글쓰기·대화 · 코딩
GPT-5.6 Terra
OpenAI성능과 비용의 균형을 잡은 GPT-5.6 중간 등급입니다.
글쓰기·대화 · 균형
GPT-6 Luna
OpenAI가장 효율적인 GPT-6입니다. 요약·추출처럼 할 일이 분명한 대량 작업에 알맞습니다.
글쓰기·대화 · 빠른 응답
Gemini 3.1 Pro
Google구글의 Pro 등급 모델(미리보기)입니다. 긴 자료를 읽고 어려운 문제를 푸는 데 강합니다.
글쓰기·대화 · 긴 자료 읽기
Gemini 3.8 Flash
Google구글의 가장 똑똑한 Flash 모델입니다. 빠르면서도 긴 작업을 스스로 이어 가고, 문서·이미지·영상·음성까지 읽습니다.
글쓰기·대화 · 코딩 · 이미지·영상 읽기
Gemini 3.5 Flash-Lite
Google가장 빠르고 저렴한 Gemini입니다. 많은 양을 처리할 때 좋습니다.
글쓰기·대화 · 빠른 응답
Muse Spark 1.3
MetaMeta 의 최신 범용 모델입니다. 100만 토큰 컨텍스트와 이미지 입력을 지원하며 에이전트형 다단계 작업과 코딩에 맞춰져 있습니다.
글쓰기·대화 · 1M 컨텍스트 · 이미지 입력
Grok 4.7
xAI글과 이미지를 이해하는 xAI의 추론 모델입니다. 대화·문서 작업·이미지 분석과 퀴즈 출제에 사용할 수 있습니다.
글쓰기·대화 · 이미지 입력 · 추론
음악·목소리
ElevenLabs Music 2.5
ElevenLabs분위기나 가사를 적으면 곡을 만듭니다. 30초 클립이나 3분 안팎의 완곡으로 만들 수 있고, 상업적으로 쓸 수 있는 음악입니다.
음악 · 노래·가사 · 상업 이용
Lyria 3.5
Google구글의 음악 모델입니다. 절·후렴·브리지가 있는 몇 분 길이의 완곡을 만들고, 가사와 구간별 구성을 직접 적어 넣을 수 있습니다. 한국어 가사도 됩니다.
음악 · 노래·가사 · 한국어 · 완곡
Lyria 3 Clip
Google30초 클립 전용 음악 모델입니다. 반복 재생용 배경음악이나 미리듣기에 알맞습니다.
음악 · 30초 클립
Sonilo v1.1
Sonilo글로 음악과 효과음을 만듭니다. 영상(최대 10분)을 넣으면 장면 흐름에 맞춘 배경음악이나 동작에 맞는 효과음을 입혀 줍니다.
음악 · 효과음 · 영상에 음악 입히기 · 영상에 효과음 입히기
ElevenLabs Sound Effects
ElevenLabs글로 적은 소리를 효과음으로 만듭니다. 최대 30초까지 길이를 정하거나 반복 재생용으로 만들 수 있습니다.
효과음 · 최대 30초
VEED Clean Audio
VEED녹음에서 배경 소음을 걷어 내고 음량을 고르게 맞춥니다. 조용하고 먼 목소리도 살리며, 영상 파일을 올리면 음성 트랙을 정리합니다.
잡음 제거 · 음량 정규화 · 최대 30분
ElevenLabs Voice Isolator
ElevenLabs녹음에서 목소리만 남기고 배경 소음을 지웁니다. 영화·팟캐스트·인터뷰 후반 작업용으로, 최대 1시간 길이까지 받습니다.
잡음 제거 · 목소리 분리 · 최대 1시간
MiniMax Music 3
MiniMax최대 5분 완곡을 만듭니다. 가사를 직접 쓰거나 자동으로 만들고, 반주만 만들 수도 있습니다.
음악 · 노래·가사 · 연주곡
Mureka 9.5
Mureka글로 묘사한 분위기·장르·악기에 맞춰 보컬이 담긴 완곡을 만듭니다. 연주곡 스위치를 켜면 보컬 없는 반주곡으로 만듭니다.
음악 · 노래·보컬 · 연주곡 · 완곡
ElevenLabs v4
ElevenLabsElevenLabs 의 최신 목소리 모델입니다. 감정 표현이 풍부하고 90개 이상 언어를 지원하며, 여러 사람이 주고받는 대화도 만듭니다.
목소리(TTS) · 다국어 · 감정 표현 · 대화
ElevenLabs v4 Turbo
ElevenLabsv4 의 표현력을 실시간으로 쓰는 목소리 모델입니다. 약 0.1초 만에 읽기 시작해, 글을 넣으면 거의 기다림 없이 바로 들을 수 있습니다. 90개 이상 언어를 지원합니다.
목소리(TTS) · 다국어 · 바로 재생
ElevenLabs v3
ElevenLabs감정과 표현이 풍부한 목소리를 만듭니다. 70개 이상 언어를 지원하고 대괄호 태그로 말투를 연출합니다.
목소리(TTS) · 다국어 · 감정 표현
Gemini 3.8 Flash TTS
Google스튜디오 수준의 음질과 감정 연기를 제공하는 Google 의 상위 음성 모델이며, 음성 합성의 기본 엔진입니다. 긴 낭독에서도 목소리가 흔들리지 않고, 130개 언어를 자동으로 알아들으며, 말투를 따로 지시하고 웃음·한숨·짧은 쉼을 넣을 수 있습니다.
목소리(TTS) · 한국어 · 130개 언어 · 감정 표현 · 긴 낭독
Gemini 3.8 Flash-Lite TTS
Google빠르고 저렴한 Google 음성 모델입니다. 30가지 목소리와 한국어를 포함한 101개 언어를 지원하며, 동시 통역의 한국어·영어 음성을 맡습니다.
목소리(TTS) · 한국어 · 101개 언어 · 빠른 생성
MiniMax Speech 2.8 HD
MiniMax음질이 또렷한 음성 합성입니다. 문장 사이 쉼 길이를 정하고 웃음·한숨 같은 감탄사를 넣을 수 있으며 한국어를 지원합니다.
목소리(TTS) · 한국어 · 감정 표현
Qwen Audio 3.0 TTS
Alibaba빠른 다국어 음성 합성입니다. 중국어·일본어·영어·한국어 등 10개 언어를 지정해 읽을 수 있고 45가지 목소리가 있습니다. 동시 통역의 중국어·일본어 음성을 맡습니다.
목소리(TTS) · 다국어 · 빠른 생성
ElevenLabs Scribe v2
ElevenLabs90개 이상 언어를 알아듣는 음성 인식 모델입니다. 말한 사람을 구분해 회의록을 전사하며, 실시간 판은 동시 통역의 ElevenLabs 엔진에서 씁니다.
음성 인식 · 다국어 · 화자 구분
3D 오브젝트
Meshy 7.1
Meshy글이나 사진(한 장·여러 장)으로 3D 모델을 만듭니다. 질감·재질까지 입히고, 지오메트리 해상도를 2K·4K 로 올리면 표면 디테일을 훨씬 촘촘하게 만듭니다.
텍스트로 3D · 이미지로 3D · 질감·재질 · 4K 고디테일
Tripo H3.1
Tripo세밀한 디테일이 강점입니다. 주인공급 3D 애셋을 글·사진·여러 장의 사진으로 만듭니다.
텍스트로 3D · 이미지로 3D · 고디테일
Tripo P2
Tripo글이나 사진 한 장으로 3D 형태와 PBR 재질을 함께 만듭니다.
텍스트로 3D · 이미지로 3D · 질감·재질
Hi3D V3.0
HItem3D사진(앞·뒤·좌·우)에서 고해상도 3D 형태를 뽑아냅니다.
이미지로 3D · 고해상도
회의록·번역
Clova Speech
Naver회의·강의 녹음을 글로 옮겨 회의록을 만듭니다. 한국어 음성 인식에 강하고, 옮긴 글은 요약과 할 일 정리로 이어집니다.
회의록 · 음성을 글로
Papago
Naver글과 회의록을 여러 언어로 번역합니다. 높임말 같은 한국어 표현을 자연스럽게 옮깁니다.
번역 · 다국어
Gemini 3.5 Live Translate
Google말하는 동안 바로 상대 언어 음성으로 바꿔 주는 실시간 통역 모델입니다. 동시 통역의 Google 엔진에서 헤드셋 두 대로 70개 이상 언어를 오갑니다.
실시간 통역 · 음성을 음성으로 · 다국어