AI 직원 둘에게 유튜브 영상 한 편 맡기기 — 관리자 AI·실행 AI 분업법과 장면 지시서·글자 모션 프롬프트·완성본 점검표

AI 둘이 분업 / 영상 하나 완성

"AI로 영상 만들어 줘" 한 줄로 쓸 만한 영상이 나오면 좋겠지만, 실제로 해 보면 원고는 채팅창에, 그림은 다운로드 폴더에, 영상은 또 다른 사이트에 흩어져서 결국 사람이 하나하나 옮겨 붙이게 됩니다.

이번에는 AI를 두 명의 직원처럼 나눠 쓰는 방법을 알려드리겠습니다. 한 AI는 원고를 쓰고 일을 나누고 결과를 검수하는 관리자, 다른 AI는 브라우저에서 사이트를 직접 조작해 결과물을 만드는 실행자입니다. 그리고 사람은 무엇을 보여 줄지, 결과가 괜찮은지만 판단합니다. 여기에 바로 쓰는 장면 나누기 프롬프트, 글자 모션 프롬프트, 완성본 점검표까지 정리했습니다.

실습 정보
관리자 AIHermes Agent(오픈소스 AI 에이전트) — Claude Code·ChatGPT 등 다른 에이전트로도 대신할 수 있습니다
실행 AIAside(AI 에이전트 브라우저) — 브라우저 안에서 화면을 보고 입력·클릭
그 밖에목소리(TTS) 사이트, 이미지·영상 생성 사이트, 공유 폴더 1개
누가 보면 좋을까유튜브·홍보 영상을 꾸준히 만들어야 하는 개인, 교육·기관 담당자

한눈에 보기 — 관리자 AI · 실행 AI · 나의 역할 분담

영상 한 편을 나눠 맡기는 8단계 — 누가 무엇을1 역할 나누기관리자·실행·나나2 공유 폴더영상 1편 = 폴더 1개관리자 AI3 원고만 먼저"다른 일은 하지 마"관리자 AI4 모션 기준참고 영상 4가지 분석관리자 AI5 장면표K·P·S, 3.5~12초관리자 AI6 대표 장면1~2개로 결과 확인실행 AI7 검수·수정"무엇이 문제인지"관리자 AI실행 AI8 목소리·자막조립 후 점검표실행 AI나🙋 끝까지 사람 몫: 무엇을 보여 줄지 · 최종 판단 · 로그인 · 결제 · 업로드 · 공개
관리자 AI가 쓰고 나누고 검수하면, 실행 AI는 사이트에서 만들고 저장합니다. 사람은 방향과 승인만 쥡니다.

1. 왜 AI를 두 명으로 나누나요

브라우저를 직접 조작하는 AI가 있으면 "그냥 다 맡기면 되지 않나?" 싶습니다. 그런데 영상 한 편은 생성 버튼을 누르는 것으로 끝나지 않습니다. 어떤 순서로 만들지, 앞 단계 결과를 다음 단계에 써도 되는지, 완성된 장면이 원고와 맞는지를 계속 판단해야 하죠. 실행한 AI가 "다 했습니다"라고 보고하는 것과, 그 결과가 기준을 통과했는지는 별개의 문제입니다.

그래서 실행하는 AI와 검토하고 다음 단계를 정하는 AI를 따로 둡니다. 내가 중간중간 하던 "이건 틀렸어, 다시 해"를 관리자 AI가 대신하게 만드는 겁니다.

누가맡는 일맡기지 않는 일
관리자 AI원고 작성, 장면 지시서 작성, 작업 분배, 결과 검수와 반려사이트 로그인, 결제
실행 AI사이트 열기, 프롬프트·참고 자료 입력, 생성, 결과 파일 저장원고 수정, 다음 단계 판단
나무엇을 보여 줄지 결정, 최종 결과 판단, 로그인·결제·업로드·공개하나하나 옆에서 지시하기
🪽Hermes Agent (관리자 역할)Nous Research가 공개한 오픈소스 AI 에이전트. 내 컴퓨터나 서버에서 돌아가고, 작업 기억이 이어집니다.https://github.com/NousResearch/hermes-agent바로가기 ↗ 🧭Aside (실행 역할)AI 에이전트가 들어 있는 브라우저. 로그인된 사이트에서 화면을 보고 직접 입력·클릭해 결과물을 가져옵니다.https://aside.com바로가기 ↗

두 도구가 없어도 괜찮습니다. 원리는 같으니 관리자 역할은 Claude Code나 ChatGPT, 실행 역할은 브라우저 에이전트(Claude in Chrome 등)로 바꿔서 그대로 따라 하실 수 있습니다.

2. 작업 공간부터 — 공유 폴더 하나

AI와 일하다 보면 가장 먼저 막히는 곳이 "그 파일 어디 있지?"입니다. 두 AI가 같이 보는 공유 폴더 안에 영상 한 편당 폴더 하나를 만들고, 모든 결과물을 그곳에 모읍니다. 실행 AI가 기억에 의존해 내용을 다시 만드는 게 아니라, 같은 지시서 파일을 보고 작업하게 하는 것이 핵심입니다.

두 AI는 기억이 아니라 "같은 폴더의 같은 파일"을 보고 일합니다🗂️ 관리자 AI원고 작성장면 지시서 작성작업 분배결과 검수·반려🖱️ 실행 AI사이트 열기지시서대로 입력생성 버튼 누르기결과 파일 저장📁 2026-10_영상제목README.md (지금 단계·최신 파일)01_원고 · 02_장면지시서03_참고자료04_목소리 · 05_이미지06_영상장면07_완성본99_이전버전 (_v1, _v2 …)쓰기검수읽기저장고친 파일은 덮어쓰지 않고 새 이름으로 · 사이트 로그인과 보안 인증은 🙋 내가 직접
관리자 AI는 원고·지시서를 쓰고 결과를 검수하며, 실행 AI는 지시서를 읽고 결과물을 정해진 폴더에 저장합니다.

작업 폴더 만들기 (관리자 AI에게)

프롬프트
공유 폴더 안에 이번 영상용 작업 폴더를 만들어 줘. 폴더 이름은 [2026-10_영상제목]으로 해 줘.

안에는 아래 하위 폴더를 만들어 줘.
01_원고 / 02_장면지시서 / 03_참고자료 / 04_목소리 / 05_이미지 / 06_영상장면 / 07_완성본 / 99_이전버전

규칙
- 파일을 고칠 때는 덮어쓰지 말고 _v2, _v3처럼 새 이름으로 저장하고, 이전 파일은 99_이전버전으로 옮겨.
- 폴더 맨 위에 README.md를 만들어 지금 어느 단계인지, 최신 파일이 무엇인지 한 줄씩 적어 둬.
- 아직 어떤 사이트에서도 생성 작업은 시작하지 마.

3. 원고만 먼저 — "어디까지"를 정해 주기

원고를 부탁할 때 가장 중요한 건 마지막 한 문장입니다. 원고만 부탁했는데 AI가 영상 생성까지 시작해 버리면, 내가 아직 확인하지 않은 내용으로 일이 진행됩니다. 무엇을 할지뿐 아니라 어디서 멈출지도 정해 주세요.

간단하게

프롬프트
[주제]에 대한 유튜브 영상 원고를 써 줘. 처음 보는 사람도 따라올 수 있게 준비부터 완성까지 순서대로 설명해 줘.
지금은 원고만 쓰고, 다른 작업은 하지 마.

조금 더 구체적으로

프롬프트
[채널명] 채널에 올릴 [주제] 영상의 낭독 원고를 써 줘.

- 시청자: [처음 시작하는 직장인]
- 길이: 낭독 기준 약 [8]분
- 말투: 친근하지만 과장 없는 존댓말
- "완전 자동", "클릭 한 번이면 끝" 같은 과장 표현은 쓰지 말고, AI에게 맡길 수 있는 부분과 사람이 직접 해야 하는 부분을 구분해서 말해 줘.
- "두 AI가 협업합니다"처럼 추상적으로 말하지 말고, 누가 무엇을 만들어 어디에 저장하는지 과정이 보이게 써 줘.
- 원고를 01_원고 폴더에 원고_v1.md로 저장해 줘.

지금은 원고만 작성하고, 목소리·이미지·영상 작업은 시작하지 마.

원고가 나오면 어려운 표현, 같은 말 반복, 화면으로 보여 주면 될 걸 말로 길게 푸는 부분을 체크합니다. 원고는 이후 목소리와 화면의 기준이라, 여기서 흔들리면 뒤 작업이 전부 흔들립니다.

4. 모션 방향 잡기 — 키네틱 타이포그래피

"세련된 모션 그래픽으로 만들어 줘"라고만 하면, '세련됨'의 뜻을 AI가 알아서 정합니다. 원하는 것과 다르게 나오는 게 당연하죠. 그래서 참고 영상을 보여 주고, 색·글자 배치·움직임·장면 전환을 나눠서 분석하게 합니다. 남의 문구나 그림을 베끼는 게 아니라 연출 원리만 배워 내 내용으로 새로 만드는 것입니다.

1움직임 = 말뜻

"여러 일이 하나로 정리된다" → 흩어진 요소가 한곳으로 모이는 움직임

원칙
2한 장면, 한 메시지

말소리·자막·큰 글자·캐릭터가 각자 다른 말을 하면 시선이 흩어집니다

원칙
3효과는 통일

장면마다 유행 효과를 바꾸면 한 영상 같은 느낌이 사라집니다

원칙
4모션은 필요한 곳에만

눈에 안 보이는 관계·순서·핵심을 설명할 때만. 실제 작업은 실제 화면으로

원칙

참고 영상 분석시키기

프롬프트
첨부한 참고 영상을 보고 우리 영상에 쓸 연출 기준을 정리해 줘. 문구나 그림을 따라 하려는 게 아니라 연출 원리만 배우려는 거야.

아래 네 가지를 나눠서 분석해 줘.
1. 색: 배경색, 포인트색, 밝고 어두운 장면의 비율
2. 글자 배치: 크기 차이, 위치(가운데/좌우/목록), 한 화면의 글자 수
3. 움직임: 글자가 어디서 어떻게 나타나고 사라지는지, 속도
4. 장면 전환: 어떤 방식으로 다음 장면에 이어지는지

그다음 우리 원고(01_원고/원고_v1.md)에 적용할 디자인 기준을 한 장으로 정리해서 02_장면지시서/디자인기준.md로 저장해 줘.
마지막에 "참고 영상에서 가져오지 말아야 할 것"도 따로 적어 줘.

5. 원고를 장면으로 나누기

원고가 정해졌다고 모든 문장을 모션 그래픽으로 만들 필요는 없습니다. 장면마다 글자 연출 / 인물·캐릭터 / 실제 작업 화면 중 하나를 고르고, 길이와 핵심 낱말을 정해 표로 받는 것이 장면 지시서의 시작입니다.

장면표의 규칙을 한 줄로 — 원고가 장면으로 나뉘는 모양K 글자 연출P 인물·캐릭터S 실제 작업 화면※ 길이는 비율이 아닌 예시KPKSKPSKSPKSKPS구독·안내 자리인사첫 90초: 3.5~6.5초로 짧게그다음: 한 장면 3.5~12초 (12초 넘으면 둘로, 3.5초 안 되면 합치기)✂️ 자르는 곳문장 끝·문단 끝에서만🔁 반복 피하기같은 화면 종류 3번 넘게 연속 금지🔤 핵심 낱말1~3개, 낭독 문장 안에서만
장면표를 받으면 이 그림처럼 초반이 촘촘한지, 같은 화면 종류가 줄줄이 이어지지 않는지, 끝에 안내 자리가 있는지 확인합니다.

원고 → 장면표 만들기

프롬프트
너는 영상 편집 기획자야. 아래 원고를 장면 단위로 나눠 표로 정리해 줘.

[원고]
(원고 전체를 붙여 넣기)

[문장별 낭독 시각]
(있으면 붙여 넣기, 없으면 "없음")

[나누는 기준]
1. 문단 끝이나 문장 끝에서만 나눠. 문장 중간에서는 자르지 마.
2. 한 장면은 3.5~12초. 12초가 넘으면 쉬는 곳에서 둘로 나누고, 3.5초보다 짧으면 앞뒤 장면과 합쳐.
3. 영상 첫 90초는 장면을 짧게(3.5~6.5초) 가져가서 초반 이탈을 막아.
4. 장면마다 화면 종류를 하나 정해: K(글자 연출) / P(인물·캐릭터) / S(실제 작업 화면). 사용할 수 있는 종류: [K, P, S]
5. 같은 화면 종류가 3번 넘게 이어지지 않게 하고, 같은 배치(가운데·좌우·목록·흐름도)도 연속으로 쓰지 마.
6. 장면마다 크게 보여 줄 핵심 낱말 1~3개를 낭독 문장 안에서만 골라.
7. 도구 이름이나 로고가 처음 나오는 장면은 그 말을 읽는 시각에 맞춰.
8. 마지막 인사 바로 앞에 구독·안내용 자리를 하나 비워 둬.

[출력]
| 번호 | 시작(초) | 끝(초) | 길이 | 화면 종류 | 낭독 문장 | 핵심 낱말 | 화면 설명 한 줄 |

[표 아래에 점검 결과]
- 가장 짧은 장면과 가장 긴 장면의 길이
- 같은 화면 종류가 3번 넘게 이어진 곳 (없으면 "없음")
- 장면 길이의 합과 전체 낭독 길이가 맞는지
- 확인하지 못한 것

6. 글자 모션 장면 만들기 프롬프트

장면표에서 K(글자 연출)로 정한 장면은 아래 프롬프트로 만듭니다. 처음엔 짧은 버전으로 감을 잡고, 결과가 마음에 안 들면 자세한 버전으로 넘어가세요. [ ] 안만 바꾸면 됩니다.

간단하게

프롬프트
1920x1080, 30fps, 소리 없는 [6]초짜리 키네틱 타이포그래피 장면을 만들어 줘.
낭독 문장: "[낭독 문장]"
핵심 낱말 [핵심 낱말]이 읽히는 순간 가장 크게 튀어나오게 해 줘.
배경은 [짙은 남색], 포인트색은 [노랑], 굵은 고딕 한글만 쓰고, 화면 아래 1/5은 자막 자리로 비워 줘.

제대로 맡기기

프롬프트
너는 모션그래픽 디자이너야. [채널명] 채널의 [주제] 영상에 들어갈 글자 중심 장면 하나를 만들어 줘.

[규격]
- 1920x1080, 초당 30프레임, 소리 없음
- 화면 아래쪽(세로 880px 아래)은 자막 자리이니 비워 둘 것
- 길이는 정확히 [장면 길이]초

[이 장면의 낭독]
"[낭독 문장]"
핵심 낱말: [핵심 낱말]

[연출]
1. 글자는 해당 말이 읽히는 순간에 등장하고, 핵심 낱말은 읽히는 순간 가장 크게 보이게 해.
2. 가장 큰 글자와 가장 작은 글자의 크기 차이를 7배 이상으로 크게 줘.
3. 동그라미·네모 안에 글자만 넣지 말고, 말이 가리키는 물건(문서, 폴더, 체크표, 말풍선, 모니터 등)을 도형으로 직접 그려.
4. 아래 움직임 중 2~3개만 골라 쓰고, 장면마다 조합을 바꿔.
   타자기+깜빡이는 커서(제목 한 곳만) / 아래에서 마스크를 따라 올라오는 글자 / 살짝 크게 시작해 제자리로 튀는 등장 / 글자 뒤를 따라오는 흐린 잔상 / 외곽선 글자가 왼쪽부터 채워지기 / 두 요소를 잇는 선 그리기 / 카드가 쌓이거나 체크가 하나씩 켜지기
5. 화면이 1초 이상 완전히 멈추지 않게, 배경이나 작은 요소라도 계속 살짝 움직여.
6. 앞 장면과 배경 밝기(어두움/밝음)와 배치를 바꿔.

[색과 글자]
- 배경 [배경색], 포인트색 [포인트색], 굵은 고딕
- 화면 글자는 낭독에 나온 낱말만. 제목 14자, 작은 칩 8자 이내
- 낭독에 없는 영어·숫자는 넣지 말 것

[하지 말 것]
- 화면을 가로지르는 빛 띠, 쓸어내기, 밀어내기, 확대 흐림 같은 빠른 전환
- 장면 끝의 어두워지는 페이드 아웃 (마지막 프레임까지 선명하게)
- 화면 밖으로 잘리거나 겹치는 글자
- 다른 채널·회사의 로고

[결과물]
- 장면 영상 1개 + 시간 순서로 12장을 뽑은 프레임 시트 1장
- 시트를 직접 보고 잘림·겹침·멈춤이 있으면 고쳐서 다시 만들기(최대 2번)
- 마지막에 "눈으로 확인한 것"과 "확인하지 못한 것"을 나눠서 적기
같은 프롬프트라도 결과는 달라요
영상 생성 모델마다 결과가 다릅니다. 처음부터 본편 전체를 만들지 말고 대표 장면 1~2개로 원하는 글자 표현과 움직임이 나오는지 먼저 확인하세요. 같은 인물·형태를 유지해야 한다면 기준 이미지를 프롬프트 만들 때와 영상 생성할 때 모두 넣어 주세요.

7. 결과 검수 — "더 멋있게" 대신 구체적으로

생성이 끝나면 글자 → 움직임 → 일관성 순서로 봅니다. "글자를 정확히 써라"라고 프롬프트에 적었다고 검사가 끝난 게 아닙니다. 필요한 건 지시를 잘 적었다는 증거가 아니라 화면에 정확한 글자가 나온 결과입니다.

볼 것확인 질문이렇게 고쳐 달라고 하기
글자한글 오타·띄어쓰기, 읽기 전에 사라지지 않나"2초에 나오는 제목이 0.8초 만에 사라져. 최소 2초는 머물게 해 줘"
움직임말뜻과 움직임이 맞나, 끝까지 자연스러운가"'하나로 모인다'는 장면인데 글자가 흩어져. 바깥에서 가운데로 모이게 바꿔 줘"
크기중요한 요소가 너무 작지 않나"핵심 낱말이 화면 폭의 1/4도 안 돼. 절반 이상으로 키워 줘"
전환전환 효과가 설명을 끊지 않나"장면 끝 빛 띠 전환은 빼고, 마지막 프레임을 그대로 유지해 줘"
일관성색·인물 형태가 갑자기 바뀌지 않나"3번 장면부터 포인트색이 주황으로 바뀌었어. 노랑으로 통일해 줘"

수정 요청 (관리자 AI → 실행 AI)

프롬프트
06_영상장면 폴더의 [장면 번호] 결과를 검수했어. 잘된 부분은 그대로 두고, 아래 문제만 고쳐서 다시 만들어 줘.

[유지할 것]
- [배경색과 글자 등장 방식]

[고칠 것]
1. [문제] → [원하는 결과]
2. [문제] → [원하는 결과]

결과는 덮어쓰지 말고 _v2로 저장하고, 처음 결과와 수정 결과에서 프레임을 4장씩 뽑아 나란히 비교한 이미지를 함께 남겨 줘.
어떤 지시가 실제로 차이를 만들었는지 한 줄로 정리해 줘.
검수 → 수정 루프 — "다 했습니다"와 "통과"는 다릅니다🖱️ 실행 AI장면 생성🗂️ 관리자 AI 검수글자움직임크기·전환일관성확인 순서: 글자 → 움직임 → 일관성통과?예✅ 다음 단계목소리·자막아니오✍️ 수정 요청 (관리자 → 실행)[유지할 것] + [고칠 것: 문제 → 원하는 결과]💾 _v2로 새로 저장처음·수정본 프레임 4장씩 나란히 비교✗ "더 멋있게 해 줘"✓ "핵심 낱말이 화면 폭의 1/4도 안 돼. 절반 이상으로 키워 줘"
통과하지 못한 장면은 "무엇이 문제이고 어떻게 바뀌어야 하는지"를 적어 돌려보내고, 고친 결과는 새 이름으로 남깁니다.

8. 목소리 · 자막 · 소리로 한 편 완성

화면 방향이 정해지면 원고로 목소리를 만듭니다. 제목·구간 표시처럼 읽지 않을 부분은 빼고, 문장을 필요 이상으로 잘게 쪼개지 않습니다. 목소리가 나오면 앞뒤가 잘리지 않았는지, 숫자·제품명 발음이 맞는지 확인하세요.

그다음 목소리 흐름에 맞춰 화면을 붙이고, 자막은 말의 흐름을 따라가게, 효과음은 움직임 타이밍에 맞춥니다. 배경음악은 분위기를 만들되 설명을 가리면 안 됩니다. 기다리는 시간을 편집으로 줄였다면 "시간을 줄인 장면"이라고 알려 주는 것도 시청자에 대한 예의입니다.

9. 완성본 점검표

AI가 "완성했습니다"라고 해도 업로드 전에 꼭 직접 확인하세요. 파일 대조처럼 숫자로 확인할 수 있는 건 관리자 AI에게, 보고 듣고 판단할 것은 사람이 맡습니다.

구분확인할 것
내용원고의 모든 문단이 들어갔나 · 낭독에 없는 말이 화면·자막에 나오지 않나 · 이어 붙인 곳에서 같은 말이 반복되지 않나 · 약속한 것(선물·링크·예고)이 실제로 있나
화면1초 이상 멈춘 곳이 없나 · 글자가 잘리거나 겹치지 않나 · 깨진 글자·엉뚱한 영어·관련 없는 로고가 없나 · 같은 배치가 계속 반복되지 않나 · 어색한 전환 효과가 없나
자막말보다 앞서거나 늦지 않나 · 다른 글자를 가리지 않나 · 두 줄을 넘지 않나
소리무음 구간이 없나 · 앞뒤 음량이 비슷한가 · 배경음이 낭독을 가리지 않나 · 끊기거나 겹치는 말이 없나
파일계획한 길이와 맞나 · 끝까지 재생되나 · 해상도·프레임이 맞나(예: 1920x1080, 30fps)
마무리소리를 켜고 처음부터 끝까지 직접 봤나 · 제목·설명·썸네일이 내용과 맞나 · 개인정보·계정 정보가 화면에 보이지 않나

자동 점검 맡기기 (관리자 AI에게)

프롬프트
07_완성본의 최종 영상을 점검해 줘. 숫자와 파일로 확인할 수 있는 것만 검사하고, 사람이 봐야 하는 항목은 따로 목록으로 남겨 줘.

[검사할 것]
1. 원고(01_원고 최신 버전)의 문단이 모두 자막에 들어 있는지 대조
2. 자막에 원고에 없는 문장이 있는지
3. 1초 이상 화면 변화가 거의 없는 구간 (시각 목록)
4. 무음 구간과 음량이 크게 튀는 구간 (시각 목록)
5. 영상 길이, 해상도, 초당 프레임
6. 수정했던 장면(_v2 이상)이 최종본에 실제로 들어갔는지

[보고 형식]
- 통과 / 문제 있음 / 확인 못 함 으로 나눠서 표로
- 문제 있음은 시각과 함께 어떻게 고칠지 제안
- 업로드나 공개 설정은 절대 하지 마

10. AI에게 넘기지 않을 것

🔐로그인·보안 인증

사이트 로그인과 2단계 인증은 내가 직접 합니다.

사람
💳결제·크레딧

어떤 모델을 쓸지는 기능과 비용을 확인한 뒤 내가 정합니다.

사람
📤업로드·공개

영상 제작과 업로드는 별개의 일. 검토용 완성 파일까지만 맡깁니다.

사람
🕵️개인정보

실제 작업 화면을 썼다면 계정·메일·결제 정보가 보이지 않는지 직접 확인합니다.

사람

정리하면, 중요한 건 "어떤 AI가 제일 똑똑한가"보다 원고 먼저 → 기준 보여 주기 → 장면 지시서 → 결과 확인하며 고치기의 순서입니다. 한 편 만들고 끝내지 말고, 아쉬웠던 점을 다음 제작 전에 지시서와 기준에 반영해 두면 회차가 쌓일수록 손이 덜 가게 됩니다.

함께 보면 좋은 글

댓글

댓글 쓰기

이 블로그의 인기 게시물

📄 [제미나이 활용법 3편] PDF 보고서를 1분 안에 요약하는 방법

📄 [업무 자동화] 생성형 AI로 10초 만에 회의록 완성하는 법

[제미나이 활용법 2편] 복잡한 뉴스 기사, 5분 만에 회의 자료로 바꾸는 법