AI 영상 제작 / 편집
https://github.com/calesthio/OpenMontage AI 코딩 어시스턴트(Claude Code, Cursor 등)를 에이전트형 영상 제작 스튜디오로 바꿔주는 오픈소스 시스템. 12개 제작 파이프라인, 100+ 도구, 700+ 스킬 파일로 스크립트부터 에셋 생성·편집·렌더링까지 자연어 명령만으로 수행.
https://github.com/echris6/motion-video-kit AI 생성 영상 + HTML/GSAP/Three.js 모션으로 "런칭용 비즈니스 광고 영상"을 만드는 Claude Code 스킬 팩. 독립 비평가가 렌더물을 검증하는 품질 루프(Gauntlet loop)와 모션 문법 6원칙 포함.
https://lucianlabs.dev/opensources/promptfilm 텍스트만 넣으면 Claude Code가 리서치→스토리보드→3D HTML 콘텐츠→MP4 내보내기까지 해주는 플러그인. 로컬 Studio 도구에서 편집·검토 후 MP4/SRT 자막 출력.
https://github.com/harry0703/MoneyPrinterTurbo 키워드 하나로 LLM 대본→영상 소스 수집→TTS→자막·배경음악까지 자동 처리해 HD 쇼트폼 영상을 완성하는 올인원 도구. 틱톡·유튜브 쇼츠 자동 업로드까지 지원.
https://github.com/OpenCut-app/OpenCut CapCut의 오픈소스 대안을 지향하는 무료 비디오 편집기(웹·데스크톱·모바일 목표). 현재 Rust 코어 기반 전면 재작성 중이며 에디터 API·플러그인·MCP 서버 계획.
🤖 AI 에이전트 / MCP / 개발 도구
https://github.com/mobile-next/mobile-mcp iOS/Android 기기를 AI 에이전트가 자동 조작하게 해주는 MCP 서버. 접근성 트리 기반으로 탭·스와이프·앱 설치·화면 녹화 등 30+ 도구를 제공해 자연어로 모바일 앱 테스트/데이터 추출 가능.
https://github.com/miuuyy/codex-chatgpt-web ChatGPT 웹 UI(Pro 모델 포함)를 브라우저 자동화로 Codex의 네이티브 모델처럼 쓰게 하는 비공식 도구. Codex 할당량 대신 ChatGPT 웹 한도를 사용, 스트리밍·이미지·MCP "Full harness" 모드 지원.
https://github.com/Chris-Chai-Minjae/side-work-memory macOS 메뉴바 앱으로 브라우저 탭·앱 창에서 본 내용을 로컬에 기록해 검색·복기. 온디바이스 OCR, 활동 요약, MCP 연동(Claude Code가 히스토리 검색 가능) 지원.
https://platform.experientiallabs.ai/models Claude·GPT·Gemini·GLM·DeepSeek 등 1,000여 개 LLM을 가격·성능·모달리티별로 비교하고 통합 API로 호출하는 모델 카탈로그/게이트웨이. "LLM 비교 쇼핑몰 + API 허브".
https://github.com/Neet-Nestor/Telegram-Media-Downloader Telegram 웹에서 차단된 이미지·GIF·오디오·영상을 다운로드하게 해주는 유저스크립트. Tampermonkey 등에 설치, WebK/WebZ 모두 지원.
🧠 로컬 LLM / 모델 경량화
https://github.com/Niko1221/Strata 125B MoE 모델 Qwen3.8-Flash-Next를 일반 게이밍 PC(12GB+ VRAM, 32GB+ RAM)에서 원클릭으로 구동하는 추론 엔진. 전문가를 GPU/RAM에 분산 배치하고 OpenAI/Anthropic 호환 로컬 API·MCP 제공.
https://github.com/tencent/AngelSlim 텐센트의 LLM·VLM·diffusion·음성 모델 경량화 툴킷. FP8/INT8/INT4/극저비트 양자화, 추측 디코딩, 증류 등을 지원하고 vLLM/SGLang 배포 스크립트·벤치마크 포함.
https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/diffusion_models/minimax_h3_fl2va_pruned_w6a8.safetensors ComfyUI용 MiniMax-H3 비디오 생성 diffusion 모델 체크포인트(약 16GB). pruned + w6a8 양자화 적용으로 저사양 VRAM 환경에서 추론 가능.

 

🎨 이미지 생성 / 캐릭터 파츠 / 프롬프트
https://github.com/upscayl/upscayl 무료 오픈소스 AI 이미지 업스케일러(일렉트론 앱). Real-ESRGAN 계열 모델 + Vulkan GPU로 저해상도 이미지를 무손실 확대, 배치 처리·CLI 지원(약 5만 스타).
https://github.com/FizzEat/reverse-prompt-builder AI 이미지 프롬프트를 4대 시스템·17계층 구조로 체계적으로 조립하는 단일 HTML 온라인 도구. 난이도별 입력칸을 채우면 Midjourney·GPT Image용 프롬프트가 실시간 완성.
https://modelscope.ai/models/jinaai/jina-ocr-v1/summary Jina AI의 OCR 모델 — 이미지/문서에서 텍스트 추출용. (페이지 본문 로드 실패로 원문 확인은 제한적)
https://x.com/paperwiz0/status/2104484103622160777 AI 이미지 생성 시 캐릭터 얼굴이 매번 달라지는 "Identity Drift" 방지 실전 팁. 마스터 정체성 레퍼런스 구축, 참조 이미지 역할 분리, 편집 우선 등 해법 정리.
https://x.com/nanyuan0412/status/2104779172434546744 의상 참조 사진 하나로 전신 착용샷 + 의상 부품별 자산 보드를 생성하는 "의상 추출 Skill" 소개. 씬 간 의상 일관성 유지 목적, MIT 라이선스 공개.
https://x.com/sep_is_heim/status/2104318775629865328 MiniMax H3로 16비트 픽셀아트 LoRA를 테스트한 레트로 게임 스타일 영상 제작 검증 글(note.com 기사 링크).


🧩 3D / 아바타 / Live2D
https://github.com/Kirakun0328/text-to-vrma 텍스트 프롬프트(한/영/일)를 VRM 아바타 모션(.vrma) 파일로 변환하는 도구. LLM 키프레임 생성 + 로컬 엔진 두 방식, 발 미끄러짐 보정·표정 자동 생성·영상 내보내기 지원.
https://start-aituber-with-ai-agent.aituberonair.com/ AI 코딩 에이전트에 프롬프트를 붙여넣어 AITuber 스트리밍 환경을 자동 구축하는 안내 사이트. PNGTuber·VRM·Live2D 등 7종 아바타 템플릿과 LLM 채팅·TTS·실시간 댓글 연동 제공.
https://soramameto-order.booth.pm/items/8923859 Live2D PSD 레이어 구조를 유지한 채 메모·수정 지시서(PDF/TXT)를 만드는 무료 HTML 도구(일러스트레이터 수정 지시·검수용). ※ 현재 비공개 상태로 접근 불가.

 

🖌️ UI/디자인 (코딩 에이전트 플러그인)
https://github.com/0xdesign/design-plugin Claude Code 플러그인 — 컴포넌트/페이지 UI 변형 5개를 생성해 브라우저에서 나란히 비교·피드백하며 빠르게 디자인 결정. 기존 디자인 시스템 토큰(Tailwind 등)을 추론해 활용.
https://github.com/gnurio/refactoring-ui-plugin 《Refactoring UI》 책의 원칙을 AI 스킬 10개+메타 스킬로 패키징한 비공식 프로젝트. 시각적 위계·타이포·색상·간격 항목별로 UI를 평가·개선하는 구조화 리뷰 제공.
https://github.com/wy51ai/floorplan-3d 단일 HTML로 동작하는 2D 평면도 + Three.js 3D 인테리어 디자인 도구. 가구 배치·벽 스냅·면적 계산, 3D 조명·1인칭 워크스루, PNG/JSON 입출력 지원.
📖 만화 번역 / 리서치 글
https://github.com/dmMaze/BallonsTranslator 딥러닝 기반 만화·웹툰 자동 번역 도구. 텍스트 검출→OCR→지우기→번역→원본 스타일 조판을 원클릭 처리, LLM 번역기·WYSIWYG 편집기·CLI 지원.
https://note.com/sepiablue/n/n365a9c441c32 inclusionAI 오픈소스 6B 이미지 생성 모델 Ming-Image를 RTX 4070 12GB + ComfyUI에서 검증한 리뷰. 문자 포함 디자인(포스터·표지) 재현력은 우수하나 일본어 표기는 부정확.

 

 

https://dvdprime.com/g2/bbs/board.php?bo_table=comm&wr_id=31093109&sca=&sfl=wr_subject&stx=%EC%98%81%EC%83%81+%EC%97%85%EA%B3%84&sop=and&scrap_mode=

 

큐리오님 폐업소식을 보며... AI 때문에 영상업계도 풍비박산입니다 -.- - DVDPrime 프라임차한잔 게

어제 큐리오 님이 폐업신고 글을 올리셨더군요. 요즘 AI 때문에 광고/영상업계 쪽이 난리입니다. -.- 말 그대로 풍비박산... 지난 주 DP분들과 골프 치면서도 이 주제로 한참 이야기를 나눴어요. 그

dvdprime.com

 

 

최근에 위의 글을 읽고  “광고업계 힘들겠다…” “디자인 쪽은 진짜 타격 크겠네…”

딱 그 정도.

 

근데 가만히 보니까 구조가 너무 익숙하다.

비용 ↓   시간 ↓   인력 ↓

 

그리고 결과물은 생각보다 괜찮다.

이거…
바이브 코딩이니 뭐니하는 개발이랑 똑같은 방향 아닌가?


예전에는 웹사이트 하나 만들려면

기획자, 디자이너, 퍼블리셔, 프론트엔드, 백엔드

이렇게 팀이 붙었다.

 

지금은? 혼자서 한다.

 

아니, 정확히는 AI랑 둘이 한다.

 

UI는 Claude Degin
코드는 Codex, Claude Code
백엔드는 Supabase 같은 BaaB 서비스
배포도 자동화

 

남는 건 “조립 + 판단” 정도.


문제는
이게 효율의 문제가 아니라는 거다.

 

예전에는 개발자가 부족해서 값이 올랐다.

지금은 개발자가 필요 없어서 값이 떨어진다.


영상업계 글을 보면서 소름 돋았던 부분이 있다.

“모든 업체의 일이 동시에 사라진다.”

 

이거 남 얘기 아니다.

웹 개발업계도 이미 시작됐다.


간단한 서비스?  AI가 만든다.

랜딩페이지?     몇 분이면 나온다.

CRUD?           설명만 하면 끝이다.

개발문서?        소스 직접 찾아서 MD파일로 만들어.


그럼 개발자는 뭐 하냐고?

 

예전엔 “만드는 사람”이었는데

이제는 “검수하는 사람”이 되어가고 있다.


더 무서운 건 속도다.

 

느리게 무너지는 게 아니라 한 번에 구조가 바뀐다.


나도 모르게
강 건너 불구경하듯 보고 있었다.

“AI 좋네ㅋㅋ 생산성 올라가네”

근데 문득 깨닫는다.


아.
이거 우리 집이었네.

개발자의 바이브 코딩 도전기: "~해줘"의 달콤한 유혹과 현실의 벽

들어가며

요즘 AI가 코딩까지 해준다고 하니, 개발자로서 궁금하지 않을 수 없었다. ChatGPT, Claude, Cursor AI 등 온갖 도구들을 써보면서 '바이브 코딩'이라는 신세계를 경험해봤다. 결론부터 말하면... 생각보다 쉽지 않더라.


그동안 뭘 만들어봤나?

일단 내가 AI와 함께 만들어본 것들을 나열해보자:

  • MCP 기반 챗봇 (Node.js)
  • 머신러닝 기반 추천 시스템 (Python)
  • 네이버카페 크롤링 (Python)
  • 일러스트레이터 자동화 스크립트 (Adobe Script)
  • 회사 Vue3 프레임워크 컴포넌트
  • 카메라 촬영 앱 (Flutter)
  • 기타 학교 과제들...

보기엔 그럴듯하지? 하지만.....


나만의 바이브 코딩 노하우

1. 프롬프트 엔지니어링의 기술

그냥 "~해줘"라고 하면 100% 실패한다. 내가 터득한 방법들:

- 입력과 결과를 미리 보여주기

입력: 사용자 데이터 JSON
출력: 추천 결과 배열
예시: [{"userId": 1, "items": ["A", "B"]}]

- 구조화된 질문하기

요구사항

  • 기능: 실시간 카메라 촬영
  • 플랫폼: Android
  • 언어: Flutter

제약사항

  • 백그라운드 실행 필수
  • 플로팅 버튼으로 촬영

금지사항

  • 절대 deprecated된 플러그인 사용하지 마
  • Android 12 이상 권한 정책 준수할 것

- 디테일한 지시

진짜 "이렇게까지 해야 하나" 싶을 정도로 자세하게 설명해야 한다. 그리고 영어로 하면 더 잘 알아듣더라.


2. 내가 사용하는 절차

  1. 한글로 대충 요구사항 정리 – 머릿속 아이디어를 텍스트로
  2. 스킬트리 정의 – 필요한 기술들을 체계화
  3. AI에게 시스템 프롬프트 작성 요청 – MD 파일로 명세서 생성
  4. 해당 문서를 붙여넣고 코딩 시작 – AI가 열심히 일한다

바이브 코딩의 장점들

1. 접근성 혁신

"전혀 모르는 언어"로도 웹/앱을 만들 수 있다. 또한 개발자는 "디자인"을, 디자이너는 "개발"을 둘 다 아닌 사람은 "둘 다" AI에게 시킬 수 있다.

2. 문제 해결사

코드에 문제가 생기면 다양한 패턴의 해결방법을 제시해준다. 구글링할 필요가 없어졌다. (라떼는 이것도 능력이였는데..)

3. 자동화의 신

단순 반복 작업은 정말 편하게 처리해준다. 코드의 주석이나 문서화도 순식간에 완성.


하지만 현실은...

만드는 시간 < 버그 잡는 시간

이게 제일 큰 문제다. 코드는 금방 만들어주는데, 실제로 돌려보면 온갖 에러가 쏟아진다. 그리고 AI에게 버그를 고쳐달라고 하면... 토큰이 순식간에 증발한다. 💸

무한 버그 지옥

AI: "1 Case 같이 고쳐보세요!"
나: "안 되는데? 로그는 이렇게 나와~"
AI: "그럼 2 Case 같이!"
나: "또 안 되는데? 로그는 이렇게 나와~"
AI: "그럼 3 Case 같이!"
나: "로그는 이렇게 나와~"
AI: "정말 원인을 파악했습니다. 1 Case 같이 하시면 됩니다."
나: "........"

---- 시스템을 종료 하였습니다. ----

이렇게 이 코딩 바보 둘이서 시간 낭비하는 경우가 비일 비재하다.


실패 사례: 카메라 앱의 비극

가장 기억에 남는 실패작이 Flutter로 만든 카메라 앱이다. 기능은 정말 단순했다:

  • 백그라운드에서 카메라 실행
  • 플로팅 아이콘 생성
  • 클릭하면 사진 촬영
  • 길게 누르면 앱 종료

"이 정도야 요구사항도 정확하고 코드도 복잝하지도 않을꺼고 정말 딸깍 이겠군아!" 라고 생각했는데, 현실은 달랐다.

문제들의 향연

1. 기술 스택 지정의 중요성

그냥 "Flutter, Android"라고 하면 안 된다. 버전까지 정확히 명시해야 한다.

2. 권한 문제

카메라, 저장소, 앱 위에 그리기 권한... Android 버전별로 다 다르다. AI가 지 학습했을 때의 버전으로 알려주니 당연히 에러.

3. 플러그인 지옥

Flutter 플러그인이 워낙 많다 보니, AI가 추천하는 플러그인이 실제로는 작동하지 않는 경우가 부지기수. 없는 메소드를 당당하게 제시하기도 한다.

4. 버전 갭

AI가 학습한 시점과 현재 기술 스택 사이의 갭이 생각보다 크다. Context7 MCP까지 동원했지만... 결국 실패.


깨달음

결국 시키는 사람이 잘 시켜야 한다는 것이다. 내가 잘 모르는 상태에서 AI도 헤매면, 둘 다 어리버리하면서 시간과 돈만 날린다.

 

시간은 금이라네 친구, 넌 둘 다 없겠지만.


결론: 2025년 7월의 바이브 코딩

현재 상황

  • 언어를 전혀 모르는 상태에서도 코딩이 가능한 획기적인 방법
  • 하지만 고품질 결과물을 내기는 여전히 어려움
  • 시키는 사람의 이해도가 높을수록 효과 극대화

미래 전망

AI가 정신나간 속도로 발전하고 있으니, 조만간 정말로 "~해줘"만 해도 완벽한 코드를 만들어주는 시대가 올 것이다.

그때까지는...

  • AI와 대화할 수 있을 정도의 코딩 지식은 필요하다
  • 완전 초보 상태로는 AI가 삽질할 때 같이 멍하니 보고 있을 수밖에 없다

한 가지 의외의 수확

AI가 에러로 삽질하는 과정을 지켜보는 것만으로도 해당 언어 공부가 된다.

물론 나는 "날먹 딸깍"하려고 하는건데 공부가 가당키나 하나?!?!?! ㅋㅋㅋ

+ Recent posts