Skip to content

modu-ai/moai-media

v3.3.16Apache-2.0

미디어 생성 전담 AI 코워커 — ChatGPT Work 기본 이미지 생성, Higgsfield 이미지·영상·제품 촬영·캐릭터 일관성(Soul/Element), ElevenLabs TTS/보이스클로닝, GPT Image 2.5·Gemini 3·Midjourney v8 프롬프트 빌더와 NotebookLM 연동. Higgsfield 3D·설명 영상 완성은 현재 연결에 제출·조립 도구가 있을 때만 진행합니다. ChatGPT Images 2.5는 기본 이미지 도구를 사용하고 Flare·Sunburst API 모델 ID 지정은 별도 경로를 확인합니다.

media-asset-production

(구명칭 호환 스텁) 콘텐츠 캘린더는 moai-marketer:content-editorial-calendar, 유튜브·팟캐스트 기획은 moai-marketer:marketing-youtube-podcast-planner로 분리됨. 직접 호출하지 않는다.

media-audio-gen

통합 오디오 생성 스킬. 현재 연결된 ElevenLabs MCP 도구를 확인하고 TTS, 보이스 클로닝, 다국어 더빙, 효과음 생성 중 사용 가능한 기능을 실행. "목소리 생성", "TTS", "음성 합성", "보이스 클로닝", "더빙", "나레이션", "효과음", "AI 음성" 요청 시 사용.

media-brand-audit

생성된 이미지·영상·오디오 또는 생성 프롬프트의 브랜드 정합성과 권리·비용 표시를 증거로 검수합니다. 사용자가 미디어 검수나 배포 전 확인을 요청했거나 브랜드 핵심 산출물의 추가 검수가 필요할 때 사용합니다. 생성 작업을 실행하지 않습니다.

media-codex-image

ChatGPT Work에서 현재 대화의 기본 이미지 도구로 이미지를 직접 만듭니다. OpenAI는 ChatGPT Images 2.5를 데스크톱에도 배포한다고 안내합니다. Flare·Sunburst API 모델 ID를 정확히 지정한 요청은 moai-mcp-openai 도구로 생성합니다. 기존 스킬 이름과의 호환을 위해 media-codex-image 이름을 유지합니다. Higgsfield 계정의 모델로 생성하라는 요청은 media-higgsfield-image에 맡깁니다. 다음 요청에 사용하세요: - "ChatGPT로 이미지 만들어줘", "GPT Image 2.5로 이미지 생성해줘" - "이미지를 직접 만들어줘", "이 사진을 ChatGPT에서 편집해줘" - "codex 이미지 생성" (기존 호출 호환)

media-gemini-3-image-prompt

Google Gemini 3 Pro Image (a.k.a. Nano Banana Pro) 전용 이미지 프롬프트 빌더. 사용자 자연어 한 줄과 현재 런타임의 질문 채널로 프리셋·미세조정 정보를 수집해 Google 공식 가이드의 장면·구도·조명 원칙을 참고한 5-component 내부 템플릿([Subject+Adj] doing [Action] in [Location]. [Composition]. [Lighting]. [Style]. [Constraint/Text])으로 변환합니다. Google AI Studio · Vertex AI · Gemini 앱에 복붙 가능한 프롬프트를 만들고 GPT Image 2.5·Midjourney 프롬프트도 비교용으로 출력합니다. 다음과 같은 요청 시 반드시 이 스킬을 사용하세요: - "Gemini 이미지 프롬프트 만들어줘", "나노바나나 프롬프트" - "Nano Banana Pro 프롬프트", "Gemini 3 Pro Image 프롬프트" - "Google AI Studio 이미지 프롬프트", "Vertex AI 이미지 프롬프트" - "/media-gemini-3-image-prompt" (직접 호출) 본 스킬은 프롬프트 텍스트 산출 전용입니다. Gemini 이미지 자체 생성은 현재 앱에 Gemini 모델을 실행하는 연결이 확인될 때만 진행하고, 연결이 없으면 완성된 프롬프트를 제공합니다. 사용자가 Higgsfield를 지정했을 때만 해당 연결을 사용합니다.

media-gpt-image-prompt

OpenAI GPT Image 2.5(Flare·Sunburst) 전용 이미지 프롬프트 텍스트 빌더. 사용자 자연어 요청에서 필요한 맥락을 수집하고, OpenAI 공식 이미지 프롬프팅 가이드의 8가지 원칙에 맞춰 ChatGPT·OpenAI API·Higgsfield에서 쓸 프롬프트를 출력합니다. 모델·품질·크기·배경 파라미터는 API나 Higgsfield에서 지정할 때만 별도로 표시합니다. 같은 입력으로 Gemini 3 Pro Image · Midjourney V8 프롬프트도 만들 수 있습니다. 다음과 같은 요청 시 반드시 이 스킬을 사용하세요: - "GPT 이미지 프롬프트 만들어줘", "ChatGPT 이미지 프롬프트" - "GPT Image 2.5 프롬프트", "gpt-image-2.5 프롬프트 작성", "Flare·Sunburst용 프롬프트" - "GPT-image-2 프롬프트"(사용자가 지목한 모델을 유지하고 2.5 이전은 선택지로 안내) - "OpenAI 이미지 프롬프트", "GPT용 이미지 편집 프롬프트" - "/media-gpt-image-prompt" (직접 호출) 이미지 자동 생성은 페어 스킬 media-higgsfield-image(Higgsfield) 또는 media-codex-image(ChatGPT 기본 이미지 도구)를 사용하세요. 본 스킬은 프롬프트 텍스트 산출 전용입니다.

media-higgsfield-assets

현재 Higgsfield 연결에서 제공하는 이미지·영상 이외의 생성과 후처리를 다룹니다. 3D 메시(GLB) 생성·리깅·애니메이션, 오디오(효과음·앰비언스·음악·TTS), 완성 영상의 바이럴 점수 분석, 그리고 업스케일·리프레임·아웃페인팅· 배경 제거 같은 기존 에셋 후처리가 범위입니다. 다음과 같은 요청 시 사용하세요: - "이 사진을 3D 모델로 만들어줘", "GLB로 뽑아줘", "캐릭터 리깅해줘" - "효과음 만들어줘", "배경음악 깔아줘", "이 대본 한국어로 읽어줘" - "이 광고 영상 훅이 괜찮은지 점수 내줘", "바이럴 가능성 분석" - "이 이미지 4K로 키워줘", "세로 영상으로 리프레임", "배경 지워줘", "캔버스 넓혀줘" 모델 id·파라미터는 하드코딩하지 않고 현재 연결의 모델 상세 도구로 라이브 조회합니다. 새 이미지·영상을 처음부터 만드는 요청은 media-higgsfield-image / media-higgsfield-video를 사용하세요.

media-higgsfield-core

Higgsfield MCP 이미지·영상 생성의 공유 코어. media-higgsfield-image / media-higgsfield-video가 로드하는 SSOT(single source of truth)로, 호출 스키마·라이브 카탈로그 조회 프로토콜·공통 크래프트 규칙(R1–R5)·인터뷰 슬롯·잡 수명주기를 정의합니다. Claude의 MCP 연결과 ChatGPT의 공식 Higgsfield 플러그인에서 다른 도구 이름을 런타임에 구분합니다. 다음과 같은 상황에서 로드됩니다: - media-higgsfield-image 또는 media-higgsfield-video가 호출 계약을 참조할 때 - Higgsfield 모델의 파라미터를 하드코딩하지 않고 런타임 조회해야 할 때 - 현재 앱의 Higgsfield 도구 이름과 입력 스키마를 런타임에 확인해야 할 때 이 스킬은 단독 실행 스킬이 아니라 두 소비 스킬이 참조하는 공유 코어입니다.

media-higgsfield-explainer

Higgsfield 연결의 조립 도구가 제공될 때 내레이션이 깔린 비실사 설명 영상을 만듭니다. 10초 블록 단위로 내레이션 한 줄과 영상 한 컷을 짝지어 만든 뒤, 서버에서 순서대로 조립해 완성 MP4를 반환합니다. 다음과 같은 요청 시 사용하세요: - "이 주제로 설명 영상 만들어줘" - "이 문서를 나레이션 영상으로" - "얼굴 안 나오는 내레이션 영상" - "마스코트가 설명하는 영상" - "이 이야기를 애니메이션으로 풀어줘" 1~10분(블록 = 분×6)을 지원하고, 스타일 프리셋 라이브 카탈로그·마스코트/무인물 모드·16:9와 9:16· 선택적 자막을 다룹니다. 실사 영상, 광고·UGC, 토킹헤드, 팟캐스트, 단발 클립은 범위 밖이며 media-higgsfield-video를 사용하세요.

media-higgsfield-identity

Higgsfield 연결에서 재사용 가능한 인물·사물 일관성 참조를 만듭니다. Soul Character(학습형 identity 모델)와 Reference Element(즉시 생성형 참조) 중 어느 쪽을 써야 하는지 판정하고, 선택된 경로로 생성·조회합니다. 다음과 같은 요청 시 사용하세요: - "내 얼굴로 Soul 만들어줘", "디지털 트윈 학습시켜줘" - "이 캐릭터 계속 똑같이 나오게 해줘" - "나랑 친구 둘 다 나오는 이미지" - "이 제품을 여러 컷에 일관되게 넣어줘" - "학습해둔 캐릭터 목록 보여줘" Soul ID의 직접 전달은 한 생성에 1개만·soul 계열 모델 전용이고, Element는 즉시 만들어지며 한 프롬프트에 여러 개를 배치할 수 있고 사람이 아닌 대상도 됩니다. 학습된 Soul은 연결에 따라 Elements에서 재사용될 수 있습니다. 이 분기를 잘못 고르면 되돌릴 수 없는 학습 비용이 발생하므로, 경로가 불명확하면 생성하지 않고 blocker를 반환합니다.

media-higgsfield-image

Higgsfield 계정의 이미지 모델로 이미지를 생성합니다. Claude의 MCP 연결과 ChatGPT의 공식 Higgsfield 플러그인에서 현재 노출된 모델·견적·생성 도구를 확인해 호출합니다. 다음과 같은 요청 시 사용하세요: - "Higgsfield로 이미지 만들어 줘" - "Soul로 인물 이미지" - "Nano Banana Pro로 카드뉴스 이미지" - "시네마틱 키 비주얼 만들어줘" - "캐릭터 일관성 있는 시리즈 이미지" - "DTC 광고 이미지(Marketing Studio)" Soul·Nano Banana·GPT Image·Seedream·FLUX·Recraft·Marketing Studio 등 계열의 프롬프트 크래프트는 references/prompt-craft/*.md에 출처와 함께 큐레이션돼 있고, 실제 파라미터(모델 id·해상도·비율·비용)는 런타임에 라이브 조회합니다. 프롬프트만 필요하면 media-gpt-image-prompt 등 해당 모델의 프롬프트 스킬을 사용하세요.

media-higgsfield-product

Higgsfield로 브랜드·제품 비주얼을 만들라는 요청을 촬영 모드로 판정하고, 그 모드에 맞는 프롬프트 구조를 조립해 Claude의 MCP 또는 ChatGPT의 공식 Higgsfield 플러그인으로 생성합니다. 스튜디오 컷·라이프스타일·핀터레스트 핀·히어로 배너·캐러셀· 광고 크리에이티브 팩·가상 피팅·컨셉추얼·리스타일이 범위입니다. 다음과 같은 요청 시 사용하세요: - "Higgsfield로 제품 사진 만들어줘", "Higgsfield 스튜디오 컷" - "Higgsfield에서 이 제품이 카페에 놓인 장면" - "Higgsfield 핀터레스트 핀", "Higgsfield 웹사이트 히어로 배너" 주의: 공식 product-photoshoot 전용 강화기와 일반 이미지 모델의 직접 생성은 서로 다른 경로입니다. 현재 연결에 전용 기능이 없으면 한계를 밝히고 모드별 프롬프트를 직접 조립합니다.

media-higgsfield-video

Higgsfield 계정의 영상 모델로 영상을 생성합니다. Claude의 MCP 연결과 ChatGPT의 공식 Higgsfield 플러그인에서 현재 노출된 모델·견적·생성 도구를 확인해 호출합니다. 다음과 같은 요청 시 사용하세요: - "Higgsfield 영상 만들어줘" - "Veo로 영상" - "Kling으로 영상" - "Seedance로 다이내믹 영상" - "Cinema Studio로 시네마틱 영상" - "Marketing Studio UGC 광고 영상" Veo·Kling·Seedance·Cinema Studio·Marketing Studio·Wan·Gemini Omni·Grok 등 계열의 프롬프트 크래프트는 references/prompt-craft/*.md에 출처와 함께 큐레이션돼 있고(계열마다 규칙이 다름 — 범용 공식 없음), 실제 파라미터(모델 id·해상도·비율·길이·비용)는 런타임에 라이브 조회합니다.

media-midjourney-v8-prompt

Midjourney V8 이미지 프롬프트 빌더. 현재 기본 V8.2를 기준으로 짧은 이미지 설명과 지원되는 파라미터를 만들고, 사용자가 V8.1을 지정하면 그 버전을 유지합니다. 참조 이미지는 Edit Model, 스타일 참조는 --sref를 안내합니다. GPT Image 2.5·Gemini 이미지 프롬프트도 함께 출력합니다. 다음과 같은 요청 시 반드시 이 스킬을 사용하세요: - "미드저니 프롬프트 만들어줘", "MJ 프롬프트" - "Midjourney 프롬프트", "/imagine 프롬프트 작성" - "Midjourney v8 프롬프트", "미드저니 8.1 프롬프트", "미드저니 8.2 프롬프트" - "--sref 프롬프트", "--oref 프롬프트", "스타일 코드 프롬프트" - "/media-midjourney-v8-prompt" (직접 호출) 본 스킬은 프롬프트 텍스트만 산출합니다. 실제 생성은 사용자가 Midjourney 웹 또는 Discord에서 실행합니다.

media-notebooklm-slide-prompt

강연·강의·세미나 본문 마크다운을 입력받아 (1) NotebookLM Studio에 그대로 붙여 넣을 슬라이드 데크 생성 프롬프트와 (2) 슬라이드별 나노바나나(Gemini 3 Pro Image, a.k.a. Nano Banana Pro) 5-Component 이미지 프롬프트를 동시 산출하는 prompt-builder 스킬. NotebookLM Studio의 공식 4축(Format/Length/Output language/Prompt)을 정확히 매핑하고, 슬라이드별 시각 자료는 Google DeepMind 공식 가이드의 5-Component 구조(Style·Subject·Setting·Action·Composition)에 따라 작성한다. 다음과 같은 요청 시 반드시 이 스킬을 사용하세요: - "NotebookLM 슬라이드 프롬프트", "NotebookLM 프롬프트", "NotebookLM 데크" - "강의 슬라이드 프롬프트", "강연 슬라이드 자료", "세션 슬라이드 프롬프트" - "Detailed Deck", "Presenter Slides", "프레젠터 슬라이드", "디테일드 데크" - "슬라이드 이미지 프롬프트", "나노바나나 슬라이드", "Nano Banana 슬라이드" - "본문 MD를 NotebookLM 프롬프트로 변환", "강연용 슬라이드 자료 만들어줘" - "PPT 발표 자료 프롬프트", "발표 슬라이드 통째로 생성"

media-production

이미지·영상·오디오 제작 요청의 산출물과 제공자를 확인하고 해당 moai-media 스킬로 이어갑니다. 단일 이미지도 사용자가 지정한 제공자를 먼저 확인합니다. ChatGPT 이미지는 media-codex-image, Higgsfield는 media-higgsfield-image, Gemini·Midjourney는 해당 생성 연결이 있을 때만 사용하고 없으면 프롬프트를 제공합니다. 연결된 ElevenLabs 오디오도 라우팅합니다.