4초, 6초 또는 8초
클립별로 선택 가능한 생성 길이.
Google DeepMind의 Veo 3.1은 동기화된 48kHz 오디오가 포함된 짧은 클립을 생성하고, 마지막 프레임을 이어받아 더 긴 시퀀스로 확장합니다.
데스크톱 브라우저에서 이 페이지를 열어 창작을 시작하세요.
Veo 3.1은 Google DeepMind의 동영상 모델이며, 지속 시간에 대해 이 분야의 대부분과는 다른 접근 방식을 취합니다.
하나의 생성 결과를 길게 늘리는 대신, 4초, 6초 또는 8초 길이의 클립을 만든 다음 이를 확장합니다. 한 클립의 마지막 프레임이 다음 클립의 시작 부분이 되므로, 각 연결 지점마다 연속성이 이어지며 시퀀스가 샷 단위로 확장됩니다. 이러한 구조는 긴 한 번의 도박 같은 생성 대신 모든 세그먼트 사이에 의사결정 지점을 제공하며, 이는 동영상 작품을 만드는 데 있어 의미 있게 다른 방식입니다.
완성물이 단일 샷보다 길 때 Veo 3.1을 사용하세요. 내러티브 시퀀스, 캠페인 영상, 워크스루, 그리고 후반부가 전반부의 결과에 따라 달라지는 모든 작품을 구성할 수 있습니다.

Veo 3.1은 Google DeepMind가 개발한 AI 동영상 생성 모델로, Virse에서 Veo 3.1 Fast라는 더 저렴한 변형 모델과 함께 제공됩니다. 두 모델 모두 첫 프레임, 마지막 프레임, 또는 둘 다를 서면 브리프와 함께 입력으로 받을 수 있습니다.
이 모델은 세 가지 주요 강점을 중심으로 구축되었습니다:
생성 결과는 16:9 및 세로형 9:16 형식으로 4초, 6초 또는 8초 길이로 실행됩니다. 두 항목은 입력으로 받는 내용이 아니라 비용과 렌더링 품질에서 차이가 있으므로, 한쪽을 위해 작성한 브리프는 다른 쪽에서도 변경 없이 실행됩니다.

클립별로 선택 가능한 생성 길이.
한 클립의 마지막 프레임이 다음 클립의 시작이 됩니다.
1080p 및 720p 옵션을 포함한 진정한 3840×2160 출력.
영상과 함께 생성되는 대사, 음향 효과, 주변 소음.
동일한 작성 브리프로 가로형과 세로형 생성.
동일한 입력을 받는 Veo 3.1 및 Veo 3.1 Fast.
장면 확장은 길이를 한 번의 확정이 아니라 일련의 결정으로 바꿉니다. 세 번째 세그먼트에 문제가 생기면 전체 작품이 아니라 세 번째 세그먼트만 다시 생성하면 됩니다.
확장은 이전 클립의 마지막 프레임에서 시작되므로, 피사체, 조명, 설정이 설명에서 다시 도출되는 대신 컷을 넘어 그대로 유지됩니다.
48kHz 스테레오에서 사운드는 방송으로 내보내기 전에 교체할 필요 없이 실제 편집을 견딜 수 있는 사양입니다.
4초, 6초, 8초는 실질적인 선택지이며, 페이싱은 브리프의 그 어떤 요소보다도 길이에 의해 결정되기 때문에 중요합니다.
프로젝션하거나, 크롭하거나, 원본 크기로 납품할 작업을 위해 3840×2160으로 직접 렌더링됩니다.
Veo 3.1 Fast는 동일한 입력을 허용하므로, 탐색 패스와 납품 패스는 서로 다른 항목에서 같은 프롬프트를 사용합니다.
연결된 시퀀스는 그 연결 구조를 볼 수 있을 때만 관리할 수 있습니다. 네 번째 세그먼트는 세 번째 세그먼트를 기반으로 만들어지며, 세 번째 세그먼트가 교체되면 이후의 모든 부분을 다시 확인해야 합니다. Virse는 전체 작업 흐름을 하나의 캔버스에 순서대로 펼쳐 보여줍니다. 각 확장은 기반이 된 클립 뒤에 배치되므로, 시퀀스의 구조가 파일명 규칙 속에 묻히지 않고 계속 눈에 보입니다.
모든 세그먼트는 자신이 확장하는 세그먼트 옆에 배치되어, 끊어진 연결을 한눈에 명확히 확인할 수 있습니다.
전체 작품을 다시 시작하는 대신 체인의 링크 하나를 교체하고 그 지점부터 앞으로 다시 빌드하세요.
캔버스를 벗어나거나 브리프를 다시 작성하지 않고 Veo 3.1과 30개 이상의 다른 이미지 및 비디오 모델 간에 이동하세요.
같은 워크스페이스에서 이미지 모델로 시작 프레임을 생성하고, 그 프레임에서 체인을 시작하세요.
연결부 전반의 연속성을 유지하며 샷 단위로 조립된 다중 세그먼트 작품.
단일 생성으로는 도달할 수 없는 길이로 제작된 브랜드 비디오.
제품을 세그먼트에서 세그먼트로 일관되게 이어가는 확장 데모.
영상만큼이나 분위기가 중요한 로케이션 푸티지.
가로 버전과 동일한 브리프에서 피드용 9:16 출력.
스토리보드를 움직이는 레퍼런스로 전환하고, 전체 시퀀스로 확장합니다.
탐색에는 빠르고, 제공에는 표준 진입점입니다. 원하는 페이싱에 따라 4초, 6초 또는 8초를 선택하세요.
시퀀스가 시작되는 구도를 업로드하고, 샷이 특정 지점에 도달해야 한다면 종료 구도도 업로드하세요.
움직임, 카메라의 동작, 믹스를 명시하고, 세그먼트가 어떻게 끝나는지 구체적으로 설명하세요.
종료 프레임을 사용해 다음 샷을 생성하고, 계속하기 전에 각 연결부를 검토하세요.
유용한 Veo 3.1 프롬프트에는 일반적으로 다섯 가지 요소가 포함됩니다:
이렇게 쓰는 대신
파도가 바위를 때리는 드라마틱한 장면, 영화 같은 느낌, 웅장한 음악 포함.
이렇게 쓰세요
흐린 빛 아래 검은 화산암에 회색 파도가 부서지는 와이드 숏. 각각의 너울은 느긋한 속도로 솟아올랐다가 무너지고, 물보라는 바람을 타고 오른쪽으로 날린다. 카메라는 수면보다 약간 높은 위치에서 삼각대에 고정되어 있다. 오디오는 물소리와 바람 소리만 있으며, 음악은 없다. 파도가 물러가고 바위가 반짝이는 상태로 남는 장면으로 끝난다.
Image 1의 구도로 시작: 해질 무렵의 시골 주유소, 캐노피 조명 하나만 켜져 있고, 차도 사람도 없음. 곤충들이 캐노피 조명 빛줄기 사이를 움직인다. 그 외 모든 것은 정지해 있다. 카메라는 일정한 속도로 천천히 오른쪽으로 트래킹하며, 캐노피를 내내 프레임 안에 유지한다. 매미 소리, 조명의 전기적 윙윙거림, 화면에 나타나지 않고 멀리서 지나가는 차량 한 대. 음악 없음. 캐노피가 왼쪽 가장자리에 있고 오른쪽은 탁 트인 도로로 채워진 상태로 끝난다.
어두운 월넛 표면 위에 닫힌 상태로 놓인 오버이어 헤드폰 한 쌍으로 시작하며, 위쪽과 뒤쪽의 단일 광원으로 조명된다. 이어컵은 처음 2초 동안 천천히 고르게 열리며, 카메라는 짧은 거리만큼 밀고 들어간 뒤 멈춘다. 낮은 실내 배경음과 컵이 열린 위치에 도달할 때 나는 부드러운 기계적 클릭음 한 번. 음악 없음. 헤드폰이 완전히 열린 상태로, 프레임의 하단 절반을 채우며 끝난다.
캔버스 재킷을 입은 남자가 철물점 통로에 서서 페인트 통을 들고 라벨을 읽고 있다. 그는 카메라 밖의 누군가를 향해 고개를 들고 "이게 무광 맞죠?"라고 말한다. 카메라는 통로 끝에서 미디엄 숏으로 고정되어 있으며 움직임은 없다. 형광등의 웅웅거림, 멀리서 들리는 선반 소음, 대화하는 정도의 그의 목소리, 음악 없음. 그가 다시 페인트 통을 내려다보는 장면으로 끝난다.
| 비교 항목 | Veo 3.1 Fast | Veo 3.1 |
|---|---|---|
| 적합한 용도 | 탐색 및 타이밍 | 제공 |
| 입력 | 표준 버전과 동일 | Fast와 동일 |
| 클립 길이 | 4초, 6초 또는 8초 | 4초, 6초 또는 8초 |
| 장면 확장 | 예 | 예 |
| 오디오 | 선택 사항, 48kHz 스테레오 | 선택 사항, 48kHz 스테레오 |
| 출력 범위 | 720p~4K | 720p~4K |
마지막 상태가 다음 세그먼트의 시작이 됩니다. 느슨한 엔딩은 그 이후에 만드는 모든 것에 전파됩니다.
다음 세그먼트를 생성하기 전에 세그먼트 간 전환을 확인하세요. 오류는 체인을 따라 누적됩니다.
"음악 없음, 룸톤과 발소리만"은 지시할 수 있습니다. "웅장한 스코어"는 모델이 추측해야 하는 느낌입니다.
4초에서 8초는 하나의 일이 벌어지는 데 적합합니다. 이벤트를 겹쳐 쌓는 일은 세그먼트화가 피하기 위해 존재하는 것입니다.