Store Listing Experiments do Google Play: teste A/B das suas capturas de tela (2026)
No Google Play, você não precisa adivinhar se uma nova primeira captura de tela converte melhor que a antiga — dá para testar isso com tráfego real do Play Store. Os Store Listing Experiments vêm embutidos no Play Console em Test and release → Store listing experiments (o Google já mudou o local desse menu mais de uma vez; guias mais antigos chamam de "Grow → Store listing experiments"). São gratuitos, rodam na sua ficha ao vivo e cuidam da divisão de tráfego e da estatística por você.
Se você lança nas duas lojas, esse é o equivalente à configuração da Apple. Cobrimos o lado iOS em Teste A/B de capturas de tela com Product Page Experiments — mesma ideia, mecânica diferente. Este post é o complemento do lado Play.
Como funcionam os Store Listing Experiments
Você cria um experimento, escolhe qual ativo testar (ícone do app, capturas de tela, feature graphic, vídeo de demonstração, descrição curta ou descrição longa) e envia até 3 variantes junto com sua ficha atual — que funciona como controle. O Google então exibe as variantes para uma fatia dos usuários que chegam à sua página na loja e mede qual delas gera mais instalações.
Duas métricas importam nos resultados:
- Aquisição (conversão da ficha na loja). A fatia de visitantes que instala depois de ver determinada variante. É o número principal para testes de captura de tela.
- Retenção de novos instaladores (retenção de 1 dia). Se as pessoas atraídas por uma variante realmente continuam usando o app um dia depois. Uma variante que puxa mais instalações mas com retenção pior pode ter prometido demais.
O Google calcula um intervalo de confiança por variante e, quando uma variante ultrapassa o limite de confiança escolhido, a declara vencedora. Você pode ativar um alerta por e-mail para não precisar ficar vigiando o painel. Aplicar um vencedor é um clique — mas geralmente ainda vale a pena levar o ativo vencedor pelo seu fluxo normal de lançamento/revisão para manter o resto da ficha consistente.
Gráficos padrão vs experimentos localizados
É a parte em que as pessoas tropeçam, e ela muda quantos testes você consegue rodar em paralelo.
- Experimento de gráficos padrão. Testa os ativos na sua ficha padrão da loja — a ficha exibida para quem não recebe uma versão localizada. Usuários que recebem ativos localizados ficam fora do público desse experimento. Você só pode rodar um experimento de gráficos padrão por vez.
- Experimento de ficha da loja localizada. Testa ativos (e/ou texto) para um idioma específico. Você pode rodar até 5 experimentos localizados simultaneamente — por exemplo, um para alemão, um para japonês, um para português brasileiro, e assim por diante, todos ao mesmo tempo.
Na prática: se sua base de instalações está concentrada em alguns mercados, os experimentos localizados permitem testar esses mercados em paralelo em vez de ficar na fila atrás de um único teste global. E não presuma que um idioma equivale a um país: selecionar "Inglês (Estados Unidos)" não restringe o público aos EUA; ele atinge todo mundo que recebe aquela ficha localizada, onde quer que esteja.
Configurando um teste A/B de capturas de tela
- Abra Store listing experiments e crie um. Escolha a ficha padrão ou uma ficha localizada específica, e dê a ele um nome que você ainda vai entender daqui a três semanas ("Captura de tela principal — legenda focada em benefício v2").
- Escolha o ativo. Selecione capturas de tela. Teste um elemento por experimento — não mude o ícone e as capturas de tela no mesmo teste, ou você não vai saber o que fez diferença.
- Envie até 3 variantes. Sua ficha ao vivo é o controle. Cada variante é um conjunto completo de capturas de tela, nas dimensões corretas do Play — veja o guia de tamanhos de captura de tela do Google Play para as especificações exatas.
- Defina o público, a confiança e o MDE. Distribua o tráfego entre as variantes (o comum é uniforme — 50/50 para uma variante contra o controle, ou aproximadamente um terço para cada uma entre três). Escolha um nível de confiança (90%, 95%, 98% ou 99%) e um efeito mínimo detectável — a menor melhoria que vale a pena detectar, configurável entre aproximadamente 0,5% e 6%. O Play Console mostra as condições de conclusão para você ver a que está se comprometendo antes de começar.
- Inicie e não mexa mais. Resista à tentação de espiar e interromper cedo assim que uma variante parecer estar na frente. Deixe rodar até as condições que você definiu.
Tamanho de amostra, duração e como atingir significância
A resposta honesta para "por quanto tempo devo rodar isso?" é: até atingir as condições de significância que você definiu — não um número fixo de dias. Mas existem pisos e tetos do mundo real.
- Rode por pelo menos 7 dias. O comportamento de instalação varia entre dias úteis e fins de semana. Qualquer período menor que uma semana completa embute um viés de dia da semana no seu resultado. Duas semanas (14 dias) é um padrão comum e mais seguro, e apps de baixo tráfego costumam precisar de 28 dias.
- Instalações suficientes por variante para importar. A significância depende do seu volume de instalações, do número de variantes, do seu nível de confiança e do seu MDE. Como meta prática aproximada, mire na ordem de 1.000+ instalações por variante antes de confiar no resultado — mais se você definir um nível de confiança alto ou um MDE pequeno.
- Configurações mais rígidas custam tráfego. Um nível de confiança de 99% ou um MDE de 0,5% exige muito mais instaladores do que 90% / 3%. Se seu app tem baixo volume, uma configuração exigente pode nunca atingir significância — afrouxe o MDE ou aceite 90%.
Um teste que termina "inconclusivo" é um resultado real, não um fracasso. Geralmente significa que as variantes eram parecidas demais para se separar no seu nível de tráfego, ou que você não rodou por tempo suficiente. Ambos são corrigíveis — torne as variantes mais distintas ou dê mais tempo ao teste.
O limite de variantes e o que ele implica
Três variantes contra o controle é o teto rígido por experimento. Isso é uma característica, não uma restrição para brigar contra: cada variante extra divide seu tráfego em fatias mais finas e empurra a significância mais para longe. Com três desafiantes você já divide seu tráfego da loja em quatro (controle + 3). Para a maioria dos apps, testar um único desafiante ousado e claramente diferente contra o controle chega a uma conclusão mais rápido do que quatro variações vagas jamais chegariam.
Use os espaços disponíveis para hipóteses genuinamente diferentes — um benefício principal diferente, um estilo visual diferente, retrato vs um layout multi-painel largo — não para variações de tom da mesma ideia.
Armadilhas a evitar
- Mudar mais de uma variável. Novas capturas de tela e uma nova descrição curta no mesmo teste = um resultado impossível de interpretar. Isole a variável.
- Parar cedo diante de um "vencedor". Vantagens iniciais regridem. Encerrar no dia 3 porque uma variante está 8% à frente é como você lança uma ficha pior com toda a confiança.
- Rodar por menos de 7 dias. Você vai capturar uma parte do ciclo semanal e perder o resto.
- Estatística exigente demais em um app de baixo tráfego. Pedir 99% / MDE de 0,5% com instalações modestas garante um teste inconclusivo e caro em tempo.
- Ignorar a retenção de 1 dia. Uma captura de tela que promete demais pode elevar instalações e afundar a retenção. Acompanhe os dois números.
- Esquecer a divisão entre padrão e localizado. Um experimento de gráficos padrão não afeta usuários em fichas localizadas — se seu público é majoritariamente localizado, teste ali.
- Só testar a última captura de tela. Os primeiros 2 a 3 painéis fazem a maior parte do convencimento no Play Store. Teste esses primeiro. (Mais sobre como o Play difere da Apple aqui: Diferenças entre capturas de tela do Play Store e do App Store.)
Onde o Mokbi se encaixa
O Mokbi não roda o teste A/B — quem faz isso é o Play Console, e é de graça. O que atrasa a maioria das equipes é produzir as variantes em primeiro lugar: um desafiante crível significa um conjunto completo de capturas de tela, nas dimensões corretas do Play, com a legenda e o layout realmente alterados. No Mokbi você projeta um conjunto no navegador, depois duplica e troca a legenda principal, o layout ou o fundo para criar a variante B — e traduz as legendas com um clique se estiver rodando experimentos localizados em vários mercados. O design é gratuito com visualização com marca d'água; a exportação ilimitada sem marca d'água e a publicação vêm com uma assinatura — Solo a €29.99/mo (1 app) ou Studio a €49.99/mo (até 5 apps), sem compra única. Ele monta os concorrentes rápido; o Play Console decide qual vence.