AI 영상 제작 / 편집
https://github.com/calesthio/OpenMontage AI 코딩 어시스턴트(Claude Code, Cursor 등)를 에이전트형 영상 제작 스튜디오로 바꿔주는 오픈소스 시스템. 12개 제작 파이프라인, 100+ 도구, 700+ 스킬 파일로 스크립트부터 에셋 생성·편집·렌더링까지 자연어 명령만으로 수행.
https://github.com/echris6/motion-video-kit AI 생성 영상 + HTML/GSAP/Three.js 모션으로 "런칭용 비즈니스 광고 영상"을 만드는 Claude Code 스킬 팩. 독립 비평가가 렌더물을 검증하는 품질 루프(Gauntlet loop)와 모션 문법 6원칙 포함.
https://lucianlabs.dev/opensources/promptfilm 텍스트만 넣으면 Claude Code가 리서치→스토리보드→3D HTML 콘텐츠→MP4 내보내기까지 해주는 플러그인. 로컬 Studio 도구에서 편집·검토 후 MP4/SRT 자막 출력.
https://github.com/harry0703/MoneyPrinterTurbo 키워드 하나로 LLM 대본→영상 소스 수집→TTS→자막·배경음악까지 자동 처리해 HD 쇼트폼 영상을 완성하는 올인원 도구. 틱톡·유튜브 쇼츠 자동 업로드까지 지원.
https://github.com/OpenCut-app/OpenCut CapCut의 오픈소스 대안을 지향하는 무료 비디오 편집기(웹·데스크톱·모바일 목표). 현재 Rust 코어 기반 전면 재작성 중이며 에디터 API·플러그인·MCP 서버 계획.
🤖 AI 에이전트 / MCP / 개발 도구
https://github.com/mobile-next/mobile-mcp iOS/Android 기기를 AI 에이전트가 자동 조작하게 해주는 MCP 서버. 접근성 트리 기반으로 탭·스와이프·앱 설치·화면 녹화 등 30+ 도구를 제공해 자연어로 모바일 앱 테스트/데이터 추출 가능.
https://github.com/miuuyy/codex-chatgpt-web ChatGPT 웹 UI(Pro 모델 포함)를 브라우저 자동화로 Codex의 네이티브 모델처럼 쓰게 하는 비공식 도구. Codex 할당량 대신 ChatGPT 웹 한도를 사용, 스트리밍·이미지·MCP "Full harness" 모드 지원.
https://github.com/Chris-Chai-Minjae/side-work-memory macOS 메뉴바 앱으로 브라우저 탭·앱 창에서 본 내용을 로컬에 기록해 검색·복기. 온디바이스 OCR, 활동 요약, MCP 연동(Claude Code가 히스토리 검색 가능) 지원.
https://platform.experientiallabs.ai/models Claude·GPT·Gemini·GLM·DeepSeek 등 1,000여 개 LLM을 가격·성능·모달리티별로 비교하고 통합 API로 호출하는 모델 카탈로그/게이트웨이. "LLM 비교 쇼핑몰 + API 허브".
https://github.com/Neet-Nestor/Telegram-Media-Downloader Telegram 웹에서 차단된 이미지·GIF·오디오·영상을 다운로드하게 해주는 유저스크립트. Tampermonkey 등에 설치, WebK/WebZ 모두 지원.
🧠 로컬 LLM / 모델 경량화
https://github.com/Niko1221/Strata 125B MoE 모델 Qwen3.8-Flash-Next를 일반 게이밍 PC(12GB+ VRAM, 32GB+ RAM)에서 원클릭으로 구동하는 추론 엔진. 전문가를 GPU/RAM에 분산 배치하고 OpenAI/Anthropic 호환 로컬 API·MCP 제공.
https://github.com/tencent/AngelSlim 텐센트의 LLM·VLM·diffusion·음성 모델 경량화 툴킷. FP8/INT8/INT4/극저비트 양자화, 추측 디코딩, 증류 등을 지원하고 vLLM/SGLang 배포 스크립트·벤치마크 포함.
https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/diffusion_models/minimax_h3_fl2va_pruned_w6a8.safetensors ComfyUI용 MiniMax-H3 비디오 생성 diffusion 모델 체크포인트(약 16GB). pruned + w6a8 양자화 적용으로 저사양 VRAM 환경에서 추론 가능.
🎨 이미지 생성 / 캐릭터 파츠 / 프롬프트
https://github.com/upscayl/upscayl 무료 오픈소스 AI 이미지 업스케일러(일렉트론 앱). Real-ESRGAN 계열 모델 + Vulkan GPU로 저해상도 이미지를 무손실 확대, 배치 처리·CLI 지원(약 5만 스타).
https://github.com/FizzEat/reverse-prompt-builder AI 이미지 프롬프트를 4대 시스템·17계층 구조로 체계적으로 조립하는 단일 HTML 온라인 도구. 난이도별 입력칸을 채우면 Midjourney·GPT Image용 프롬프트가 실시간 완성.
https://modelscope.ai/models/jinaai/jina-ocr-v1/summary Jina AI의 OCR 모델 — 이미지/문서에서 텍스트 추출용. (페이지 본문 로드 실패로 원문 확인은 제한적)
https://x.com/paperwiz0/status/2104484103622160777 AI 이미지 생성 시 캐릭터 얼굴이 매번 달라지는 "Identity Drift" 방지 실전 팁. 마스터 정체성 레퍼런스 구축, 참조 이미지 역할 분리, 편집 우선 등 해법 정리.
https://x.com/nanyuan0412/status/2104779172434546744 의상 참조 사진 하나로 전신 착용샷 + 의상 부품별 자산 보드를 생성하는 "의상 추출 Skill" 소개. 씬 간 의상 일관성 유지 목적, MIT 라이선스 공개.
https://x.com/sep_is_heim/status/2104318775629865328 MiniMax H3로 16비트 픽셀아트 LoRA를 테스트한 레트로 게임 스타일 영상 제작 검증 글(note.com 기사 링크).
🧩 3D / 아바타 / Live2D
https://github.com/Kirakun0328/text-to-vrma 텍스트 프롬프트(한/영/일)를 VRM 아바타 모션(.vrma) 파일로 변환하는 도구. LLM 키프레임 생성 + 로컬 엔진 두 방식, 발 미끄러짐 보정·표정 자동 생성·영상 내보내기 지원.
https://start-aituber-with-ai-agent.aituberonair.com/ AI 코딩 에이전트에 프롬프트를 붙여넣어 AITuber 스트리밍 환경을 자동 구축하는 안내 사이트. PNGTuber·VRM·Live2D 등 7종 아바타 템플릿과 LLM 채팅·TTS·실시간 댓글 연동 제공.
https://soramameto-order.booth.pm/items/8923859 Live2D PSD 레이어 구조를 유지한 채 메모·수정 지시서(PDF/TXT)를 만드는 무료 HTML 도구(일러스트레이터 수정 지시·검수용). ※ 현재 비공개 상태로 접근 불가.
🖌️ UI/디자인 (코딩 에이전트 플러그인)
https://github.com/0xdesign/design-plugin Claude Code 플러그인 — 컴포넌트/페이지 UI 변형 5개를 생성해 브라우저에서 나란히 비교·피드백하며 빠르게 디자인 결정. 기존 디자인 시스템 토큰(Tailwind 등)을 추론해 활용.
https://github.com/gnurio/refactoring-ui-plugin 《Refactoring UI》 책의 원칙을 AI 스킬 10개+메타 스킬로 패키징한 비공식 프로젝트. 시각적 위계·타이포·색상·간격 항목별로 UI를 평가·개선하는 구조화 리뷰 제공.
https://github.com/wy51ai/floorplan-3d 단일 HTML로 동작하는 2D 평면도 + Three.js 3D 인테리어 디자인 도구. 가구 배치·벽 스냅·면적 계산, 3D 조명·1인칭 워크스루, PNG/JSON 입출력 지원.
📖 만화 번역 / 리서치 글
https://github.com/dmMaze/BallonsTranslator 딥러닝 기반 만화·웹툰 자동 번역 도구. 텍스트 검출→OCR→지우기→번역→원본 스타일 조판을 원클릭 처리, LLM 번역기·WYSIWYG 편집기·CLI 지원.
https://note.com/sepiablue/n/n365a9c441c32 inclusionAI 오픈소스 6B 이미지 생성 모델 Ming-Image를 RTX 4070 12GB + ComfyUI에서 검증한 리뷰. 문자 포함 디자인(포스터·표지) 재현력은 우수하나 일본어 표기는 부정확.
'그것 관심사↗' 카테고리의 다른 글
| AWS 도커 및 컴포즈 설치 (0) | 2025.07.05 |
|---|---|
| [크롤링 실전기 마지막편] 결국 PyAutoGUI를 탔다 (feat. 진짜 눈물) (1) | 2025.05.20 |
| [크롤링 실전기 2편] 크롤링 도구별 강점과 약점 – 삽질도 도구가... (0) | 2025.05.19 |
| [크롤링 실전기 1편] 결국 내가 직접 만들기로 한 이유 (Octoparse → 직접 개발까지) (1) | 2025.05.19 |
| APM 어플리케이션 - 스카우터 (0) | 2024.11.25 |
| SSH Public 키 접속 (2) | 2024.06.07 |
| 네이버 AD 광고 API 개발기 (1) | 2024.04.17 |
| 아이맥 모니터 개조기 - 실전편 (3) | 2024.04.07 |

