Como transformar vídeos horizontais em verticais com IA
Você gravou em 16:9 porque a câmera, o OBS e o YouTube pedem assim — e agora o mesmo material precisa virar Shorts, Reels e TikTok. Transformar vídeo horizontal em vertical com IA é o jeito de fazer isso sem passar a tarde arrastando o quadro clipe por clipe, mas "com IA" esconde uma pergunta que decide se o resultado presta: a IA sabe onde está o assunto do seu vídeo?
Este guia explica o que o reenquadramento automático faz de fato, em que tipo de cena ele acerta, em qual ele erra e o que você faz quando o rosto não é o que importa na tela. Sem isso, a automação só produz clipes ruins mais rápido.
Por que "cortar as laterais" não é uma conversão
A aritmética é mais brutal do que parece. Um vídeo em 1920×1080 tem 1920 pixels de largura; um recorte vertical de mesma altura tem 607. Ou seja: ao passar de 16:9 para 9:16 sem redimensionar, você fica com 32% da largura e joga fora 68%. Não é uma margem — é dois terços da imagem.
Num vlog de uma pessoa só, centralizada, isso passa despercebido. Num podcast com dois convidados, um de cada lado da mesa, o centro do quadro é a parede entre eles. Numa aula com slide, o centro é o meio da frase. É por isso que o corte fixo no centro, que é o que a maioria dos apps chama de "converter para vertical", devolve tanto clipe apontado para o nada.
Esticar a imagem para preencher é a única saída que não existe: rosto alargado é percebido em meio segundo e o espectador sai antes de a primeira frase terminar. As opções reais são três — barras, recorte ou reenquadramento — e o guia de 9:16, 1:1 e 16:9 compara as três. Aqui o foco é a terceira, porque é a que resolve o caso difícil.
Como transformar vídeo horizontal em vertical com IA: o que o reenquadramento faz de verdade
Vale abrir a caixa, porque "a IA acompanha quem fala" é uma frase que promete mais do que qualquer ferramenta cumpre. O reenquadramento de rostos do cut67 trabalha assim:
- Primeiro ele encontra as trocas de cena — os pontos em que a imagem muda de repente, que num podcast são as trocas de câmera e num vlog são os cortes da edição.
- Em cada trecho entre duas trocas, ele amostra alguns quadros e procura o maior rosto visível. O maior, e não qualquer um: em plano fechado o maior rosto é quem está em destaque, que é justamente quem a edição quis mostrar.
- Com a posição desse rosto, o recorte vertical é deslocado para aquele trecho. Na próxima troca de cena, o processo recomeça.
- Quando um trecho não tem rosto nenhum (uma tela compartilhada, um plano do cenário), o recorte não pula para o centro: fica na posição mais frequente do vídeo inteiro, para não dar um tranco a cada corte da edição.
O resultado é um quadro que muda junto com a edição, não que desliza atrás do rosto o tempo todo. Isso é uma escolha: recorte que persegue o rosto quadro a quadro balança, e balanço em tela de celular é o que mais cansa. Para podcast com câmera alternando entre os participantes, é exatamente o comportamento que se quer — cada vez que a direção corta para quem fala, o vertical corta junto.
Uma ressalva que a própria home do cut67 faz e que vale repetir: o reenquadramento de rostos é recurso dos planos Intermediário e Pró. Corte de silêncio, vícios de fala e legenda estão em todos os planos, inclusive no teste grátis; o reenquadramento não. Se você vai testar com 5 créditos, teste o resto e saiba que o quadro vai sair centralizado.
Onde a IA erra, e como saber antes de publicar
Um detector de rosto é bom em rosto. Tudo que não é rosto vira caso de borda, e é melhor conhecer a lista antes de gerar quarenta clipes.
| Tipo de cena | O que o reenquadramento faz | Resultado |
|---|---|---|
| Uma pessoa, câmera fixa | Centraliza no rosto | Acerta sempre |
| Podcast com troca de câmera | Segue cada plano fechado | Acerta, e é o melhor caso |
| Duas pessoas no mesmo plano aberto | Escolhe o maior rosto | Deixa a outra fora do quadro |
| Aula com slide ou tela compartilhada | Acha o rosto no canto, ignora o slide | Recorta o professor e perde o conteúdo |
| Gameplay com webcam pequena | Acha a webcam | Recorta o jogador e perde o jogo |
| B-roll, produto, paisagem | Não acha rosto | Mantém a posição dominante do vídeo |
As três linhas do meio têm algo em comum: o assunto do vídeo não é o rosto. Nenhum ajuste de detector resolve isso, porque a decisão é editorial — no gameplay o que importa é o jogo, no slide é a frase. É onde a automação para e você entra.
A boa notícia é que dá para saber em qual linha seu vídeo cai antes de gastar um crédito: basta olhar a gravação. Se a maior parte do tempo tem uma pessoa em plano fechado, ligue o reenquadramento e siga. Se é tela, jogo ou mesa com várias pessoas, vá para a seção seguinte.
Quando o rosto não é o assunto: preencher, mostrar tudo ou arrastar
Para esses casos o editor do cut67 tem três controles, e nenhum deles precisa de IA:
- Preencher: o vídeo ocupa o quadro vertical inteiro e as sobras são cortadas. É o padrão, e é o modo em que o reenquadramento age.
- Mostrar tudo: o vídeo inteiro cabe no quadro, com barras acima e abaixo. Perde metade da tela, mas não perde a frase do slide nem o segundo convidado. É o modo certo para aula e para mesa cheia.
- Arrastar à mão: no preview, o primeiro toque no vídeo solta o encaixe automático. Você posiciona e redimensiona o quadro onde quiser — o jogo em cima, a webcam embaixo, o slide à esquerda — e o que você vê no preview é o que sai no arquivo, porque toda a geometria é medida em porcentagem do quadro e o render lê os mesmos números.
O terceiro é o que substitui a tarde de edição manual, com uma diferença: você arrasta uma vez por clipe, num preview que já tem a legenda posicionada, em vez de reconstruir a composição num editor de mesa a cada corte. Na página de cortar vídeo com IA dá para ver o fluxo inteiro, do envio ao download.
O passo a passo no cut67
- Envie o arquivo. É a entrada padrão e a de melhor qualidade. Link funciona para TikTok, X, Vimeo, Twitch e Dailymotion.
- Marque o trecho que vai ser processado. O consumo é por minuto analisado (1 crédito = 1 minuto), então uma gravação de duas horas não custa duas horas — custa os minutos que você escolheu.
- Escolha 9:16 entre os formatos. O mesmo corte pode sair também em 1:1 e 16:9 depois, sem processar de novo.
- Ligue "Reenquadrar rostos", se seu plano tiver e se o vídeo for de gente falando. Ele vem desligado de propósito: mexer no enquadramento de quem não pediu é o tipo de surpresa que ninguém quer descobrir depois de baixar.
- Confira o preview antes de gerar. Se o quadro está no lugar errado, arraste. Se falta o slide, troque para "mostrar tudo".
- Gere o corte. Legenda, corte de silêncio e vícios de fala saem no mesmo passe.
Regra de bolso: reenquadramento automático para vídeo de gente, "mostrar tudo" para vídeo de tela, arraste à mão para vídeo de jogo. Decida pelo assunto, não pela ferramenta.
O que muda na legenda quando o quadro fica em pé
Converter o vídeo é metade do trabalho. Um quadro vertical tem menos largura para texto e uma área grande no rodapé coberta pela interface das plataformas — botão de curtir, descrição, nome do áudio. Legenda que era discreta no 16:9 vira um bloco de quatro linhas no 9:16, ou some atrás do ícone de compartilhar.
No cut67 a legenda é posicionada no mesmo preview do vídeo, e quando você troca de formato ela se reposiciona sozinha, porque é medida em porcentagem do quadro e não em pixels. Ainda assim vale conferir a altura: quanto texto cabe num vídeo vertical tem as medidas das zonas seguras de cada rede.
E se você está reaproveitando um vídeo longo, cada trecho marcado vira um clipe próprio com o mesmo enquadramento e a mesma legenda — o roteiro para isso está em como transformar um vídeo longo em Reels.
Antes de gerar, decida em qual caso você está
Transformar vídeo horizontal em vertical com IA funciona quando o vídeo é de gente falando: o reenquadramento segue as trocas de câmera e mantém o rosto no quadro sem você tocar em nada. Quando o assunto é tela, jogo ou uma mesa cheia, a decisão volta a ser sua — e o que a ferramenta tem de oferecer nesses casos é um preview fiel e um arraste que resolve o clipe em segundos, não em minutos. Saber em qual dos dois casos você está, antes de gerar, é o que separa quarenta clipes bons de quarenta clipes centralizados na parede.
Converta o primeiro vídeo agora
Envie um vídeo horizontal, marque o trecho e veja o quadro vertical no preview antes de gerar. Conta nova ganha 5 créditos, sem cartão.
Testar grátis →