Começar

Referências de pose para vídeo anime com IA: como usar fotos no lugar de descrições

Uma foto por pose, vinculada como referência, combinada com o seu character asset. A pose transfere; o visual do clipe fica para trás.

Criar gratuitamente
Referências de pose para vídeo anime com IA: como usar fotos no lugar de descrições

MiniMax H3 Max

游戏宣传PV,整体为纯二维日系赛璐璐动画与抽象MG合成。【美术风格】整体采用清透冷蓝视觉风格,以高明度的浅天蓝、澄净的湖蓝、偏冷的青蓝、少量深海蓝、纯白和少量黑色构成高反差画面。蓝色关系应呈现出一种夏日晴空、浅水反光与冷感印刷海报结合的气质:主画面以轻盈通透的浅蓝和白色为底,局部用更深一点的钴蓝和深蓝建立层次,但整体绝不厚重,也不过度阴郁。颜色数量严格克制,全片保持少色系统,不使用复杂综合色彩。 亮黄色作为全片唯一高识别强调色,色相接近阳光下饱和而明净的金黄色,明亮、清脆、略带温度,但不偏橙,不脏、不灰,只在极少数关键元素中出现,用来制造视觉焦点与节奏冲击。人物使用极简硬边赛璐璐与大面积纯色剪影,阴影只有一至两层。城市被高度平面化,只保留窗框、电线、楼梯、栏杆、建筑轮廓和少量城市结构,以白色

Modelo
MiniMax H3 Max
Duração
15s
Proporção
16:9
Resolução
768p

Introdução

Você quer uma pose específica: peso no pé de trás, braço direito cruzado sobre o peito, queixo baixo, olhos para cima. Você escreve exatamente isso, e a geração entrega um personagem em pé normalmente com um braço levemente levantado. Você acrescenta mais palavras. Agora o braço está certo e o peso está errado. Linguagem corporal tem articulações demais para uma frase fixar, e cada frase que você adiciona dá ao modelo mais uma coisa a interpretar.

Uma foto não é interpretada. É copiada. Qualquer clipe que tenha a pose que você quer — um vídeo de dança, uma cena de luta, um ciclo de caminhada, alguém dando de ombros em uma entrevista — é uma fonte de referências de pose assim que você extrai os frames certos. Este guia mostra como usar referências de pose para vídeo anime com IA: quais frames capturar, como vinculá-los para que forneçam só a pose, e como escrever o shot para que o character asset forneça todo o resto.

O que transfere de um clipe e o que não transfere

Extraia uma foto de um clipe, vincule a um shot, e o modelo pode tirar dela:

  • A pose em si. Ângulos das articulações, peso, onde estão as mãos.
  • O espaçamento. Onde o corpo está no frame, quanto espaço ele ocupa.
  • O timing, se você pegar vários stills. Pose inicial, pose de pico, pose final mostram ao modelo o arco de um movimento.
  • A altura e distância da câmera. Uma foto tirada do chão dá um ângulo baixo.

O que o modelo vai tentar pegar, e o que você precisa bloquear:

  • O visual. Uma foto puxa a geração para o fotorrealismo; um manequim cinza puxa para o cinza. Mantenha uma referência de estilo ativa.
  • A identidade. A pessoa no clipe não é o seu personagem. Referencie seu personagem com @ e nunca descreva o rosto dele no texto.
  • A roupa. As roupas do still vazam. Vincule o figurino ao character asset.

A regra é uma referência, uma função: a foto fornece a pose, o asset fornece a identidade, a referência de estilo fornece o visual. O guia de seleção de referências aborda esse princípio para todos os tipos de referência.

Regras para escolher fotos de pose

  • Pegue o extremo, não a transição. O topo do chute, a extensão total do soco, o ponto mais fundo da reverência. Transições são borradas e ambíguas.
  • Uma foto, uma pose. Se um frame mostra duas coisas acontecendo — uma virada e um alcance — pegue dois frames.
  • Corpo totalmente visível. Membros cortados são inventados.
  • Combine o ângulo da câmera com o shot. Uma foto de pose de lado não ajuda um shot frontal. Capture do ângulo que você vai usar, ou encontre um clipe que o tenha.
  • Prefira fontes neutras. Clipes de manequim 3D sem textura são ideais porque não carregam nada além da pose; o guia de dança com manequim explica como fazer isso.

Como montar e usar um conjunto de referências de pose, passo a passo

  1. Encontre o clipe com o movimento. Qualquer fonte com o corpo totalmente visível e câmera estável.
  2. Avance até os extremos e exporte as fotos. Três por movimento geralmente são suficientes: antes, pico, depois. Nomeie pelo movimento: "encolhimento-01, encolhimento-02, encolhimento-03".
  3. Faça o upload das fotos para a Library e vincule-as como um Visual reference asset nomeado pelo movimento ou pela cena. Assim o Agent pode reutilizar o conjunto.
  4. Certifique-se de que o personagem é um asset com uma Main image e, se o movimento precisar, uma referência de figurino. A identidade nunca vai no texto do shot.
  5. Escreva o shot card: câmera, @personagem, a foto de pose, e o que muda. "Siga a pose still encolhimento-02; ela mantém por um instante, depois deixa os ombros caírem."
  6. Gere a imagem e compare com a foto. Articulação por articulação: peso, mãos, cabeça. Se a pose saiu errada, a foto era ambígua — escolha um frame mais claro, não adicione palavras.
  7. Gere o vídeo só a partir de uma foto que correspondeu. Para um movimento com três stills, a descrição do shot os nomeia em ordem: "de encolhimento-01 passando por encolhimento-02 até encolhimento-03 em dois segundos."
  8. Reutilize o conjunto. O mesmo encolhimento funciona para todos os personagens do elenco; só o @ muda.

Exemplo 1: Uma pose sustentada

Medium shot, camera at chest height, static, plain rehearsal room. @Yuki stands at center matching pose still guard-02: weight on the back foot, left arm across the chest, right hand open at hip height, chin down, eyes up at camera. She holds the pose for the whole shot, breathing visibly, hair settling. Soft overhead light. No camera move, no added movement.

Exemplo 2: Um movimento em três stills

Medium-wide shot, camera at chest height, static, same rehearsal room. @Yuki moves from pose still shrug-01 (arms at her sides, shoulders neutral) through shrug-02 (shoulders up, palms turned out) to shrug-03 (shoulders dropped, small exhale) over about two seconds. Face stays toward camera the whole time. One clean motion, no repeat, no bounce at the end, hands relaxed. Same light and framing as Shot 1.

Exemplo 3: A mesma pose em um personagem diferente

Medium shot, camera at chest height, static, on the bridge of @Riverside Market. @Hana matches pose still guard-02 exactly: weight back, left arm across the chest, right hand open at hip height, chin down, eyes up. Same pose as Yuki's Shot 1, different character, different place. Outfit from Hana's asset. She holds for the shot; a breeze moves her hair. Late afternoon light from the left.

As formas mais comuns de referências de pose falharem

  • Vazamento fotográfico. A geração ficou realista porque a foto era uma fotografia. Adicione ou reforce a referência de estilo; mantenha a foto apenas para a pose.
  • A pessoa do clipe aparece. Um rosto ou penteado da fonte. O personagem foi descrito em texto em vez de referenciado com @. Corrija a referência.
  • Ângulo errado. Um still de lado para um shot frontal; o modelo encontrou um meio-termo. Capture do ângulo certo.
  • Frame de transição. A pose saiu imprecisa porque o still estava no meio do movimento. Pegue o extremo.
  • Stills demais em um shot. Seis referências e o modelo fez uma média delas. Máximo de três por movimento.

Perguntas frequentes

Posso usar um still do meu próprio vídeo gerado como referência de pose? Sim, e é a fonte mais limpa: mesmo estilo, mesmo personagem. Exporte o frame, vincule-o, reutilize.

Referências de pose funcionam para mãos? Para a posição da mão, sim. Para detalhes dos dedos, nem tanto; um still de mão ajuda na pose, mas o guia de mãos e pose explica o que fazer quando os dedos saem errados.

Qual a diferença entre uma referência de pose e uma Reference image no character asset? Uma Reference image no asset mostra como o personagem aparece de outro ângulo ou com outro figurino. Um still de pose mostra o que o corpo está fazendo em um shot específico. Mantenha-os separados para que uma pose nunca se torne parte da identidade do personagem.

E o próprio clipe? Mantenha-o na Library para revisão e para escolher os frames. Os shots usam os stills.

Próximo passo

Escolha um movimento que você tem tentado descrever sem sucesso. Encontre um clipe que o tenha, exporte o frame de pico, vincule-o como Visual reference, e escreva um shot com @ para o seu personagem, o still nomeado, e nada sobre o corpo além de "siga o still". Abra o projeto no ArcLoop, gere a imagem, e compare articulação por articulação antes de gerar o vídeo.

Compartilhar

Mostre a pose, nomeie o personagem, escreva o resto

Vincule suas fotos de pose-chave como Visual references, referencie seu personagem com @, e descreva só a câmera e o que muda. O ArcLoop mantém pose, identidade e estilo em referências separadas para que nenhuma delas bata de frente com as outras.

Criar agora

Descubra mais

Duração máxima, resolução e limites do MiniMax H3: todos os tiers em uma tabela

Duração máxima, resolução e limites do MiniMax H3: todos os tiers em uma tabela

Criando personagens não humanos que ainda funcionam como elenco

Criando personagens não humanos que ainda funcionam como elenco

Criando um curta completo, do início ao fim

Criando um curta completo, do início ao fim

Por que o controle de custos vem antes da qualidade

Por que o controle de custos vem antes da qualidade