CRO

Sellos de Confianza en Test A/B: cuándo ayudan de verdad

Sellos de confianza en test A/B: dónde ponerlos en el checkout y en SaaS, qué medir, por qué varía el efecto y cómo no confundir sello famoso con ganancia.

Ilustración plana de un escudo verde oscuro con un candado, junto a una cesta de compras, una roseta de sello y una balanza, sobre fondo verde menta

Los sellos de confianza son marcas visuales que le dicen al visitante que un tercero verificó algo: el certificado del sitio, el medio de pago, la política de devolución, la reputación de la tienda o, en SaaS, los controles de seguridad de la empresa. Ayudan cuando responden a una duda real en el punto en que aparece, y casi siempre con un efecto pequeño, que pide muestra grande y la métrica correcta. En el ejemplo trabajado de esta guía, un sello reconocido cerca del campo de tarjeta aumenta los pedidos completados en 3,1 por ciento con valor-p de 0,0006, y un candado genérico con texto verdadero, en el mismo lugar, llega a 2,7 por ciento: la diferencia entre los dos no es significativa. Esta guía forma parte de nuestra guía completa de optimización de conversión (CRO) y cubre los tipos de sello, dónde ponerlos, qué muestra la investigación, qué medir, los riesgos de un sello desconocido o falso y dos ejemplos calculados, uno de ecommerce y uno de SaaS.

Qué son los sellos de confianza y por qué el efecto es tan variable

Un sello de confianza es una promesa tercerizada. En vez de que la tienda diga “somos seguros”, una marca externa aparece diciendo, en teoría, que lo revisó. El problema es el “en teoría”: el visitante rara vez sabe qué verifica cada sello, y Baymard Institute lo resume en una observación que atraviesa años de tests de usabilidad: el usuario medio juzga la seguridad de un sitio por instinto, guiado por la confianza en la marca y por la apariencia de solidez de la página, y no por la seguridad técnica real.

De ahí viene la primera regla de esta guía: el sello actúa sobre la percepción, así que el efecto depende de cuánta duda existe y de quién está mirando. Una tienda conocida tiene poca duda que reducir. Según Baymard, en tests con sitios de marcas grandes los participantes muestran pocas preocupaciones de seguridad incluso con poco refuerzo visual, mientras que en sitios más nuevos o de nicho la preocupación aparece con facilidad cuando no hay ninguna pista visual.

Los cinco tipos de sello y qué prueba cada uno

tipo ejemplos qué verifica de hecho qué suele entender el visitante riesgo principal
Certificado del sitio (SSL/TLS) sello de la autoridad certificadora que la conexión está cifrada y, según el certificado, quién es la organización “el sitio es seguro” casi todo sitio ya tiene HTTPS; el sello no dice nada sobre la honestidad de la tienda
Pago marcas de tarjeta, billeteras digitales, intermediario que ese medio se acepta “mi dinero está protegido” marca que no se acepta de verdad en ese flujo
Garantía y devolución “devolución gratis en 30 días”, “satisfacción garantizada” una política de la propia tienda “no corro riesgo” condición escondida; promesa que la atención no cumple
Reputación y reseñas puntuación en plataforma de reseñas, entidad de reclamos la opinión agregada de terceros “otras personas confiaron” puntuación que no se actualiza o sello de plataforma que el visitante no conoce
Cumplimiento B2B SOC 2, ISO/IEC 27001, protección de datos controles auditados por terceros, en un alcance y período definidos “mis datos quedan protegidos” logo sin informe o certificado vigente; alcance menor que el producto

La columna del medio y la del costado casi nunca coinciden, y en esa distancia vive el test A/B. Un sello de certificado prueba muy poco para el consumidor común; un sello de garantía prueba solo lo que la tienda se compromete a cumplir; un sello de cumplimiento prueba mucho, pero solo para quien sabe leerlo.

Qué verifica el sello contra qué entiende el visitanteMatriz con dos ejes. Eje horizontal: cuánto verifica el sello de hecho, de poco a mucho. Eje vertical: cuánto reconoce el sello el consumidor común, de poco a mucho. El sello de marca conocida de seguridad queda arriba y al centro. La marca de pago queda arriba y a la izquierda. El ícono de candado de la propia tienda queda al medio y a la izquierda. El sello de certificado de marca poco conocida queda abajo y al centro. SOC 2 e ISO 27001 quedan abajo y a la derecha para el consumidor común, y suben para el comprador de TI.el sello más reconocido no siempre es el que más verificacuánto verifica el sello de hechopocomuchorecono-cimientomarca de pagodice solo que se aceptamarca de seguridad famosacertificado + marcacandado de la propia tiendaningún tercero verificócertificado de marcapoco conocidaSOC 2, ISO 27001consumidor comúnSOC 2, ISO 27001comprador de TI
Posiciones cualitativas, para orientar hipótesis. El mismo sello de cumplimiento que no le dice nada al consumidor común es decisivo para quien conduce la evaluación de seguridad de un proveedor, y por eso el efecto de un sello cambia tanto de público a público.

Qué muestra la evidencia sobre sellos de confianza (y qué no)

Casi toda la evidencia pública sobre sellos es de percepción declarada, no de conversión medida en un experimento. Eso no la vuelve inútil: dice dónde está la duda y qué marcas reconoce el público. Pero no dice cuánto va a subir tu conversión.

Baymard: la duda aparece en el campo de tarjeta

En el artículo sobre percepción de seguridad en el checkout, Baymard reúne cuatro observaciones que valen como punto de partida de cualquier hipótesis:

Qué sello dice la gente que confía: la marca pesa más que la función

Baymard preguntó, en encuestas de 2013 a 2023, “¿qué sello te da la mayor sensación de confianza al pagar en línea?”. En la ronda de 2013, con 2.510 respuestas de adultos de Estados Unidos, el 49 por ciento eligió “no sé o no tengo preferencia”. Entre quienes eligieron un sello, Norton se quedó con cerca del 36 por ciento y McAfee con cerca del 23 por ciento, las dos de marcas de antivirus. El sello de Norton era un sello de certificado (SSL), pero los demás sellos de certificado de la lista, que también tienen función técnica real, quedaron bastante por debajo.

La actualización de 2023 cuenta, según el propio Baymard, la misma historia: Norton lidera, seguida de tres sellos de confianza de empresa, con varios sellos de certificado bastante por debajo. Y está el hallazgo más útil para quien testea: desde 2016 las encuestas incluyen un sello inventado por los investigadores, sin ningún significado, y le fue significativamente mejor que a los sellos de certificado de proveedores establecidos, con excepción de Norton. La conclusión de Baymard es que, fuera de la fuerza de una marca muy reconocida, importa menos cuál sello y más que exista algún refuerzo visual cerca de la tarjeta.

Una investigación de CXL Institute de 2016, con 2.100 personas de Estados Unidos, encontró el mismo patrón (cuanto más familiar la marca, mayor la seguridad percibida) y agregó diferencias por público: las personas de 20 a 30 años eligieron el sello de Google más que el promedio (19 contra 15 por ciento), y solo el 3 por ciento de los mayores de 50 hizo lo mismo. Los propios autores advierten que lo que la gente dice en un cuestionario no es lo que hace en una compra.

fuente diseño qué se transfiere a tu test qué no se transfiere
Baymard, percepción de seguridad en el checkout tests de usabilidad y encuesta de abandono dónde aparece la duda (tarjeta) y cómo reforzar (destaque + 1 o 2 íconos) ningún número de ganancia de conversión
Baymard, encuesta de sellos 2013 a 2023 elección declarada entre sellos, adultos de EE. UU. la marca reconocida pesa; un ícono genérico ya ayuda el ranking vale para ese público y esas marcas
CXL Institute, 2016 cuestionario con 2.100 personas de EE. UU. el sello que convence cambia con la edad y el género familiaridad declarada no es conversión
estudios de caso de proveedores tests publicados por quien vende sellos o herramientas ideas de hipótesis el tamaño del efecto, por sesgo de publicación

Sobre la última fila: los casos publicados de “el sello aumentó la conversión en X por ciento” son, en general, los tests que salieron bien, contados por quien tiene interés en el resultado. Los que no movieron nada no vieron un artículo. Úsalos como fuente de hipótesis, nunca como estimación de efecto. El propio Baymard recomienda testear sellos y refuerzos visuales con tu público y leer casos ajenos con cautela.

El candado del navegador cambió, y el sello de certificado también

Dos cambios de 2023 envejecieron mucho de lo que se escribía sobre sellos de seguridad:

Línea de tiempo del candado y del sello de certificadoLínea de tiempo con cuatro hitos. 2013: solo el 14 por ciento del millón de sitios más visitados soportaba HTTPS, según Google. 2021: solo el 11 por ciento de los participantes de una encuesta de Chrome entendía el significado preciso del candado. Mayo de 2023: Chrome anuncia el cambio del candado por un ícono de ajustes, con más del 95 por ciento de las cargas de página en Windows ya en HTTPS; el cambio se programa para Chrome 117, previsto para septiembre de 2023. 17 de octubre de 2023: DigiCert sustituye automáticamente la imagen del sello de Norton por la del sello DigiCert.HTTPS se volvió estándar, y el símbolo de seguridad perdió su sentido de destaque20132021mayo a sep. 202317 oct. 202314% del top 1 millónsoportaba HTTPS11% entendía elsignificado del candadomás de 95% en HTTPS;Chrome 117 cambia elcandado por un ícono neutroel sello DigiCert sustituyela imagen del sello Nortonlos tres primeros hitos vienen del blog de Chromium; el último, del registro de cambios de Akamai sobre DigiCert
El sello que lideraba las encuestas de confianza dejó de exhibirse como tal, por ejemplo en los sitios con certificados OV y EV de DigiCert gestionados por Akamai. Cualquier ranking antiguo de “sello más confiable” necesita releerse a la luz de esto.

La consecuencia práctica: “el sitio tiene HTTPS” dejó de ser un diferencial. Un sello de certificado comunica, como mucho, que la tienda se tomó el trabajo de exhibir uno. Eso no lo vuelve inútil (el refuerzo visual cerca de la tarjeta sigue ayudando a la percepción, según Baymard), pero cambia la hipótesis: testeas refuerzo visual y reconocimiento de marca, no “seguridad”.

Dónde poner los sellos de confianza: checkout, formulario y página de precios

La regla que atraviesa todos los contextos es la de la proximidad: el sello va donde aparece la duda, y la duda aparece donde el visitante entrega algo (tarjeta, datos personales, datos de la empresa, un compromiso de suscripción). Un sello en el pie de página es decoración; el mismo sello al lado del campo de tarjeta es una hipótesis.

Dónde trabaja el sello: checkout de ecommerce y página de precios SaaSDos bocetos lado a lado. A la izquierda, una etapa de pago de checkout: campos de nombre y dirección sin destaque, y el área de la tarjeta con fondo destacado, un ícono de candado y un sello dentro de ella, junto al botón finalizar pedido. Una etiqueta indica que la duda aparece aquí. A la derecha, una página de precios SaaS con tres planes; en el plan Enterprise, cerca del botón pedir demo, una línea con los sellos SOC 2 e ISO 27001 y un enlace al centro de confianza.el sello trabaja donde el visitante entrega algocheckout: etapa de pagonombre completodirección de entreganúmero de tarjetavencimientocódigopago cifrado✓finalizar pedidoSaaS: página de preciosBásicoProEnterprisepedir demoSOC 2 Tipo II · ISO/IEC 27001:2022ver informe en el centro de confianza
A la izquierda, lo que describe Baymard: destaque exclusivo del área de la tarjeta, con uno o dos íconos dentro de ella. A la derecha, el equivalente B2B: la prueba de cumplimiento cerca de la acción que dispara la evaluación de seguridad, con camino al documento que la sostiene.
contexto dónde testear el sello duda que responde métrica primaria lectura siguiente
Checkout de ecommerce dentro del área de la tarjeta, junto al botón de finalizar “¿puedo confiarle mi tarjeta a este sitio?” pedido completado entre quien inició el checkout pedido pagado (no rechazado), contracargo
Página de producto cerca del precio y del botón de compra (garantía, devolución, medios de pago) “¿y si no me sirve? ¿puedo pagar como quiero?” agregar al carrito y pedido devolución en 30 días
Carrito junto al total y al botón de ir al checkout “¿el precio final y el cambio son claros?” inicio de checkout pedido completado
Formulario de demo SaaS junto a los campos de correo corporativo y empresa “¿qué hacen con mis datos?” envío del formulario reunión calificada
Página de precios SaaS en el plan Enterprise y cerca de la solicitud de demo o prueba “¿pasa la evaluación de seguridad de mi empresa?” solicitud de demo o inicio de prueba oportunidad calificada, ciclo de venta
Registro self-serve cerca del botón de crear cuenta y del campo de tarjeta, cuando lo haya “¿me van a cobrar sin querer?” cuenta creada activación, cuenta pagada

Dos notas sobre la tabla. Primero, la garantía de devolución es el sello que más mueve la lectura siguiente: puede aumentar pedidos y aumentar devoluciones junto con ellos, así que la guarda de 30 días es obligatoria. Segundo, en Brasil el derecho de arrepentimiento en una compra fuera del establecimiento ya es de 7 días por el artículo 49 del CDC; un sello “7 días para desistir” describe la ley, no un diferencial, y así debe presentarse. Las guías de optimización de checkout, página de producto, carrito abandonado, formulario de demo SaaS y página de precios SaaS detallan el resto de cada etapa.

Qué medir en un test de sello

El sello es un elemento pequeño, y los elementos pequeños tienen efectos pequeños. Tres decisiones de medición separan un test útil de un test que “gana” por casualidad.

1. Conclusión de la etapa, no clic en el sello

Casi nadie hace clic en un sello. El clic es diagnóstico (confirma que el elemento se vio y si alguien quiso verificar lo que dice), nunca métrica primaria: un sello puede tener pocos clics y aun así cambiar la decisión, y un sello puede tener muchos clics porque parece un botón y distraer del pedido. La primaria es la conclusión de la etapa que el sello quiere destrabar: pedido completado, formulario enviado, demo solicitada.

2. Medir entre quien llegó a la etapa (y no en todo el sitio)

Si el sello solo aparece en la etapa de pago, solo quien llega a ella puede verse afectado. Medir la conversión sobre todos los visitantes del sitio mezcla a miles de personas que nunca vieron el sello y diluye el efecto en el ruido. La diferencia de muestra es enorme, como muestra la cuenta con el motor de las calculadoras del blog, para 3 por ciento de efecto relativo, 95 por ciento de confianza y 80 por ciento de poder:

dónde se mide tasa base visitantes por variación por qué cambia
conclusión entre quien inició el checkout 45% 21.371 solo entra quien puede ver el sello
pedido sobre todos los visitantes del sitio 2,7% 637.718 el mismo efecto relativo, diluido en una tasa base casi 17 veces menor

El escenario es el mismo en las dos filas (el 6 por ciento de los visitantes inicia el checkout y el 45 por ciento de ellos lo concluye, lo que da 2,7 por ciento). Para que la exposición funcione así, el sorteo o el conteo tienen que empezar en la etapa en que aparece el sello, o el análisis tiene que filtrar a quien llegó ahí con la misma regla en los dos brazos.

3. Una variable por vez, y un brazo para separar marca de forma

“El sello ganó” puede querer decir cuatro cosas: ganó el destaque visual, ganó el ícono, ganó la marca del sello o ganó la promesa escrita. Un test de dos brazos (sin sello contra sello famoso) no distingue ninguna de ellas. Si la pregunta es “¿vale la pena pagar por un sello de marca?”, el diseño necesita un tercer brazo con un refuerzo neutro en el mismo lugar y del mismo tamaño. El primer ejemplo trabajado hace exactamente eso.

Diseño de tres brazos para separar refuerzo visual de marca del selloTres cajas. A, control: área de la tarjeta sin destaque y sin ícono. B, refuerzo neutro: área destacada con candado genérico y texto pago cifrado. C, sello reconocido: la misma área destacada con el sello de una marca conocida en el mismo lugar y tamaño. Las flechas indican las comparaciones: B contra A mide el efecto del refuerzo; C contra A mide el efecto del sello; C contra B mide lo que agrega la marca.solo el brazo C contra B responde “¿importa la marca del sello?”A · controlárea de la tarjeta iguala los demás campos,sin íconoB · refuerzo neutroárea destacada,candado genérico ytexto verdaderoC · sello reconocidomismo destaque,sello de marca conocidaen el mismo lugar y tamañoB contra A: efecto del refuerzoC contra A: efecto del sello con marcaC contra B: lo que agrega la marca
Con tres brazos y dos comparaciones contra el control, el nivel de significancia de cada comparación baja a 2,5 por ciento (corrección de Bonferroni), y la muestra por brazo sube. Es el precio de una pregunta más precisa.

El riesgo del sello desconocido y del sello falso

Hay dos riesgos distintos, y solo uno de ellos aparece en el panel del test.

Sello desconocido: puede no hacer nada, o estorbar. Un sello que el público no reconoce es, en la práctica, una imagen más cerca del botón. Baymard registró sellos de certificado de proveedores establecidos por debajo de un sello inventado; CXL registró que la confianza declarada en cada sello cambia con la edad. Un sello con aspecto amateur, o que rompe el layout en el celular, puede tener el efecto contrario: Baymard observó participantes que sospechaban de un hackeo ante fallas de layout en la etapa de pago. Ese riesgo lo mide el test.

Sello falso o vencido: el test no lo ve, la ley sí. Un sello que afirma una verificación que no ocurrió puede “ganar” el test, porque el panel mide comportamiento, no veracidad.

jurisdicción regla o caso qué dice, en resumen qué cambia en un test
Estados Unidos FTC, guía de endosos y testimonios (16 CFR 255), revisada el 29/06/2023 el nombre o el sello de una organización puede ser un endoso; el endoso de una organización tiene que venir de un proceso que refleje su juicio colectivo y, si se presenta como experta, de expertos o estándares adecuados un sello sin verificación real no es una variación testeable
Estados Unidos FTC contra ControlScan, 2010 según la FTC, los sellos que indicaban verificación se otorgaban con “poca o ninguna verificación” y exhibían la fecha actual, aunque ningún sitio se revisaba diariamente (algunos semanalmente, otros sin revisión continua); en el acuerdo, el fundador renunció a 102 mil dólares y la empresa tuvo que pedir a los sitios el retiro de los sellos un sello “verificado hoy” necesita verificación de hoy
Estados Unidos FTC contra TRUSTe, 2014 según la denuncia de la FTC, de 2006 a enero de 2013 la recertificación anual prometida no se hizo en más de mil casos; el acuerdo incluyó un pago de 200 mil dólares un sello sin la revisión periódica que promete puede engañar
Estados Unidos FTC, guía de garantías (16 CFR 239.3) “garantía de satisfacción” o “dinero de vuelta” solo si el precio total se devuelve a pedido del comprador, con las limitaciones relevantes divulgadas de forma clara la variación de garantía necesita las condiciones visibles, en los dos brazos que las citan
Brasil CDC, arts. 37, 38 y 67 prohíbe la publicidad total o parcialmente falsa, incluso por omisión; la carga de la prueba es de quien patrocina; hacer publicidad que se sabe o se debería saber engañosa prevé detención de tres meses a un año y multa el sello, la garantía y la certificación exhibidos tienen que ser comprobables

Para SaaS, la regla es la misma con nombres técnicos. El AICPA mantiene logos de SOC para organizaciones que recibieron al menos un informe SOC 1, SOC 2 o SOC 3 emitido por un CPA licenciado e independiente. El informe SOC 2 tiene, en general, uso restringido, mientras que el SOC 3 es de distribución libre, y el Tipo 2 evalúa la eficacia de los controles a lo largo de un período, no solo el diseño en una fecha. Para ISO/IEC 27001, la ISO orienta buscar al organismo que emitió el certificado antes de usar un logo y citar la norma completa, como “certificada en ISO/IEC 27001:2022”. Un sello “SOC 2” sin informe, o “ISO 27001” sin certificado vigente para el alcance del producto, es el equivalente B2B del sello falso. Esto es contexto, no una opinión jurídica.

Ejemplo trabajado 1: sello en el checkout, con un brazo para separar la marca

Escenario (ilustrativo). Una tienda de moda de marca poco conocida recibe 30.000 inicios de checkout por semana, y el 45 por ciento de ellos se convierte en pedido. La etapa de pago hoy trata los campos de la tarjeta como cualquier otro campo. La hipótesis viene de Baymard: destacar el área de la tarjeta y poner un refuerzo dentro de ella aumenta la conclusión. La pregunta de negocio es doble: ¿funciona el refuerzo? ¿Y vale la pena pagar por un sello de marca reconocida, o basta con un candado genérico con texto verdadero?

Diseño. Tres brazos con el mismo tráfico: A (control), B (área destacada, candado genérico y el texto “pago cifrado”, que es verdadero), C (la misma área, con el sello del certificado que la tienda de hecho tiene, en el mismo lugar y tamaño). Unidad: visitante que inicia el checkout. Primaria: pedido completado. Diagnóstico: interacción con el sello. Guarda: tasa de pedido rechazado por el antifraude. Segmento declarado antes: cliente nuevo y recurrente. Comparaciones planificadas: B contra A y C contra A, cada una a 2,5 por ciento (Bonferroni); C contra B como lectura descriptiva.

Muestra. El equipo quiere ver 3 por ciento relativo. En la calculadora de abajo, escribe: tasa de conversión actual 45; efecto mínimo detectable 3, relativo; confianza 95; poder 80; visitantes por semana 30000; test bilateral.

Calculadora de tamaño de muestra
-Visitantes por variación
-Total (2 variaciones)
-Duración estimada

Cálculo por aproximación normal de dos proporciones, 2 variaciones (50/50). Cambia los campos y mira el impacto en vivo.

La pantalla muestra 21.371 visitantes por variación, 42.742 en total y 10 días. Esos 10 días suponen dos variaciones; con tres brazos, los mismos 21.371 por brazo llevan 15 días. Y la calculadora trabaja al 95 por ciento: con la corrección para dos comparaciones (2,5 por ciento cada una), la cuenta de esta guía, con la misma fórmula, pide 25.881 por brazo, 19 días con tres brazos. El equipo corre tres semanas completas, 21 días, lo que da 30.000 inicios de checkout por brazo y cerca de 86 por ciento de poder para 3 por ciento de efecto en cada comparación.

La sensibilidad al efecto mínimo muestra por qué un sello es un test de mucho tráfico (dos variaciones, 95 por ciento, 80 por ciento de poder, 30.000 por semana):

efecto relativo que quieres detectar visitantes por variación total días
1% 192.031 384.062 90
2% 48.048 96.096 23
3% 21.371 42.742 10
5% 7.705 15.410 4

La mirada de la primera semana. Con 10.000 por brazo, C tenía 4.680 pedidos contra 4.500 del control: más 4,0 por ciento, valor-p de 0,0106. Parecía una ganancia mayor que la planificada. En las semanas 2 y 3, con 20.000 por brazo, el marcador de C contra A fue de 9.240 contra 9.000, más 2,7 por ciento. La primera semana más fuerte no autoriza una decisión, y el costo de parar ahí está en el problema del peeking.

El resultado en 21 días.

brazo inicios de checkout pedidos conclusión pedidos de más que A
A, control 30.000 13.500 45,00%
B, refuerzo neutro 30.000 13.860 46,20% 360
C, sello reconocido 30.000 13.920 46,40% 420

La división está limpia (30.000 en cada brazo no enciende el verificador de SRM). Ahora pega en la calculadora de significancia la primera comparación: control con 30000 visitantes y 13500 conversiones; variación con 30000 y 13920; confianza 95.

Calculadora de significancia estadística
Control (A)
Variación (B)
Control (A) · Tasa-
Variación (B) · Tasa-
Mejora relativa-
valor-p-
IC 95% de la diferencia-

Test z bilateral de dos proporciones. "Sin significancia" casi siempre significa que falta muestra, no que las versiones sean iguales.

La pantalla muestra 45,00% contra 46,40%, mejora relativa de +3,1%, valor-p de 0,0006, intervalo de 95 por ciento de la diferencia de +0,6% … +2,2% (pp) y Ganadora con significancia · B gana (la calculadora llama B a cualquier variación escrita en la segunda columna, aquí el brazo C). Con más decimales, la mejora es de 3,11 por ciento, el valor-p es 0,000577 y el intervalo va de más 0,60 a más 2,20 puntos porcentuales, cerca de más 1,3 a más 4,9 por ciento relativos. El valor-p está por debajo de 0,025, así que C pasa también por la regla corregida.

Cambia la variación al brazo B (30000 y 13860): la pantalla muestra 46,20%, mejora de +2,7%, valor-p de 0,0032, intervalo de +0,4% … +2,0% (pp) y el mismo veredicto. Con más decimales, cerca de más 0,9 a más 4,4 por ciento relativos. También por debajo de 0,025.

La lectura que cae en la trampa. “El sello reconocido ganó con 3,1 por ciento, el mayor efecto: vamos a contratar el sello de marca.” Ahora compara C contra B en la misma calculadora, con B en el control: 30000 y 13860 contra 30000 y 13920. La pantalla muestra 46,20% contra 46,40%, mejora de +0,4%, valor-p de 0,6233, intervalo de -0,6% … +1,0% (pp) y Todavía sin significancia.

Intervalos de confianza de las tres comparaciones del test de selloTres intervalos de 95 por ciento sobre un eje de efecto relativo de menos 2 a más 6 por ciento. Refuerzo neutro contra control: más 2,7 por ciento, de más 0,9 a más 4,4. Sello reconocido contra control: más 3,1 por ciento, de más 1,3 a más 4,9. Sello reconocido contra refuerzo neutro: más 0,4 por ciento, de menos 1,3 a más 2,2, cruzando el cero.los dos refuerzos ganan; la marca no mostró diferencia-2%0%+2%+4%+6%B contra Arefuerzo neutro+2,7%, p = 0,0032C contra Asello reconocido+3,1%, p = 0,0006C contra Blo que agrega la marca+0,4%, p = 0,6233intervalo relativo aproximado (diferencia dividida por la tasa del brazo de referencia); escenario ilustrativo
El intervalo de C contra B va de cerca de menos 1,3 a más 2,2 por ciento relativos: el test no descarta que la marca agregue algo, pero tampoco muestra que lo agregue.

Qué dice el resultado, y qué no dice. El refuerzo visual cerca de la tarjeta funcionó, con o sin marca, que es el patrón que describe Baymard. El sello reconocido no se separó del candado genérico. Y “no se separó” tiene tamaño: con 30.000 por brazo y una tasa cercana al 46 por ciento, el test tenía solo cerca de 20 por ciento de poder para ver 1 por ciento relativo entre C y B; ver esa diferencia pediría 182.925 por brazo. La decisión honesta es “la marca, si agrega, agrega poco”, y eso entra en la cuenta de costo del sello.

El corte declarado: nuevo contra recurrente (C contra A).

segmento A: pedidos / inicios C: pedidos / inicios mejora valor-p intervalo relativo aproximado
cliente nuevo 7.200 / 18.000 (40,00%) 7.560 / 18.000 (42,00%) +5,0% 0,0001 +2,5% a +7,5%
cliente recurrente 6.300 / 12.000 (52,50%) 6.360 / 12.000 (53,00%) +1,0% 0,4379 -1,5% a +3,4%

En la calculadora, con 18000 y 7200 contra 18000 y 7560, la pantalla muestra +5,0%, valor-p 0,0001 e intervalo de +1,0% … +3,0% (pp); con 12000 y 6300 contra 12000 y 6360, +1,0%, valor-p 0,4379, -0,8% … +1,8% (pp) y “Todavía sin significancia”. La dirección coincide con la observación de Baymard (quien ya conoce la tienda necesita menos refuerzo), pero la pregunta correcta es si los dos efectos son distintos entre sí, y esa cuenta la calculadora no la hace: la diferencia entre las ganancias absolutas es de 1,5 punto porcentual, con valor-p de 0,0697 en el test de interacción calculado por esta guía. Es una señal, no una prueba. Lee más en efecto heterogéneo por segmento.

Qué hacer con él. Lanzar el refuerzo visual para todos (cuesta casi nada y no empeoró a nadie), mantener el sello del certificado que la tienda ya tiene si el costo es bajo, y no contratar un sello de marca más caro con base en este test. El diagnóstico confirma la lectura: solo el 1,7 por ciento de los visitantes del brazo C pasó el mouse o tocó el sello; el efecto vino de quien ni siquiera verificó lo que decía.

Ejemplo trabajado 2: sellos SOC 2 e ISO 27001 en la página de precios SaaS

Escenario (ilustrativo). Un SaaS B2B tiene informe SOC 2 Tipo II y certificado ISO/IEC 27001:2022 vigentes, pero solo los menciona en una página de seguridad. La página de precios recibe 10.000 visitantes por semana, y el 3,0 por ciento pide demo. La hipótesis: una línea con los dos sellos y el enlace al centro de confianza, cerca del plan Enterprise y del botón de pedir demo, reduce la duda “¿ustedes pasan nuestra evaluación de seguridad?”.

El error de planificación. El equipo decidió correr cuatro semanas porque era el plazo del trimestre. Vuelve a la calculadora de tamaño de muestra y escribe: tasa 3; efecto mínimo 10, relativo; confianza 95; poder 80; visitantes por semana 10000; bilateral. La pantalla muestra 53.211 por variación, 106.422 en total y 75 días. Cuatro semanas dan 20.000 por brazo.

Días necesarios por efecto mínimo en la página de precios SaaSBarras horizontales de duración a 10 mil visitantes por semana y tasa base de 3 por ciento. Efecto de 5 por ciento: 292 días. 10 por ciento: 75 días. 15 por ciento: 34 días. 20 por ciento: 20 días. 30 por ciento: 10 días. Una línea vertical marca los 28 días que corrió el test.con 3% de base, un efecto pequeño cuesta meses5% relativo292 días10% relativo75 días15% relativo34 días20% relativo20 días30% relativo10 díasel test corrió 28 días95% de confianza, 80% de poder, bilateral, dos variaciones; escala de 1,5 píxeles por día
Un sello rara vez mueve una solicitud de demo en 30 por ciento. Con 28 días, el test solo vería con seguridad efectos a partir de cerca de 16 por ciento relativos.

El resultado. En la calculadora de significancia, escribe 20000 y 600 en el control y 20000 y 642 en la variación. La pantalla muestra 3,00% contra 3,21%, mejora de +7,0%, valor-p de 0,2260, intervalo de -0,1% … +0,5% (pp) y Todavía sin significancia. Con más decimales, el intervalo va de menos 0,13 a más 0,55 punto porcentual, cerca de menos 4,3 a más 18,3 por ciento relativos.

La lectura equivocada en los dos sentidos. “Los sellos no funcionan” es incorrecto: el test tenía cerca del 40 por ciento de poder para ver 10 por ciento relativo (cuenta de esta guía, misma fórmula), y el menor efecto que 20.000 por brazo ve con 80 por ciento de poder es de cerca del 16 por ciento. “Los sellos aumentaron 7 por ciento” también es incorrecto: el intervalo incluye el cero e incluye una ganancia de 18 por ciento. El test no lo sabe. No es el caso de calcular “poder observado” a partir de ese resultado, por el motivo explicado en poder observado.

El corte que tienta. El segmento declarado antes era “visitante que abrió el plan Enterprise”:

segmento A B mejora valor-p lectura
abrió el plan Enterprise 180 de 3.000 (6,00%) 219 de 3.000 (7,30%) +21,7% 0,0433 por debajo de 0,05, con poder de cerca de 46% para 20%
demás visitantes 420 de 17.000 (2,47%) 423 de 17.000 (2,49%) +0,7% 0,9167 nada

En la calculadora, 3000 y 180 contra 3000 y 219 muestran +21,7%, valor-p 0,0433 e intervalo de +0,0% … +2,6% (pp): la pantalla redondea el límite inferior a cero, pero con más decimales es más 0,04 punto porcentual (el intervalo queda todo por encima de cero, pegado a él, y por eso el valor-p queda justo debajo de 0,05), y el intervalo relativo va de cerca de más 0,7 a más 42,7 por ciento. La dirección tiene sentido (la duda sobre seguridad vive en quien evalúa el plan corporativo), pero con tres lecturas (total y dos segmentos) y un valor-p de 0,0433, eso es hipótesis, no resultado. Ver múltiples métricas y FDR.

Qué hacer con él. Mantener los sellos, porque son verdaderos, cuestan poco y responden a una pregunta que el comprador corporativo hace de todas formas, sin anunciar ninguna ganancia. Y, si la decisión importa, correr el test correcto: solo para quien abre el plan Enterprise, con 6 por ciento de base y 20 por ciento de efecto mínimo, la calculadora pide 6.719 por variación; a 1.500 visitantes de ese público por semana, son 63 días. La métrica que decide, en ese público, es oportunidad calificada, y madura en semanas, como describe la guía de formulario de demo SaaS.

Cómo leer un test de sello sin caer en “ganó porque es famoso”

Un test de sello que gana invita a una historia lista: la marca es conocida, luego genera confianza, luego convierte. La historia puede ser verdadera, pero el test de dos brazos no la sostiene. Seis preguntas antes de atribuir la ganancia:

  1. ¿Qué cambió además del sello? Destaque del área, espacio en blanco, texto al lado, posición del botón. Si cambió junto, la ganancia es del paquete.
  2. ¿Existe un brazo neutro? Sin él, “marca” y “refuerzo visual” están confundidos.
  3. ¿El efecto aparece donde existe la duda? Más efecto en cliente nuevo y en marca poco conocida es coherente con la hipótesis; un efecto igual en todo el mundo sugiere otra explicación.
  4. ¿La métrica es la conclusión de la etapa? El clic en el sello no cuenta como ganancia.
  5. ¿El test tenía poder para el efecto que estás celebrando? Si la muestra por brazo quedó por debajo de la que la calculadora pide para ese efecto, una ganancia de 2 a 3 por ciento que dio significativa tiende a estar exagerada.
  6. ¿La primera semana fue más fuerte? Un sello nuevo llama la atención por ser nuevo; mira efecto novedad.

Checklist antes de encender el test

  1. Verdad primero. Todo sello exhibido corresponde a una verificación, certificado o informe vigente, con un alcance que cubre lo que se está vendiendo, y toda garantía muestra las condiciones.
  2. Duda y público mapeados. ¿En qué punto el visitante entrega algo y duda, y quién duda? SOC 2 en el checkout de una tienda de ropa no responde ninguna duda.
  3. Proximidad. Uno o dos sellos en el área de la duda, no un muro en el pie de página.
  4. Muestra para un efecto pequeño. Dimensiona para 2 a 5 por ciento relativos, no para 20, y con corrección cuando haya un brazo neutro.
  5. Guarda para la garantía: devolución y solicitud de reembolso en 30 días.
  6. Test de layout del sello en celular y en los navegadores principales antes de encender el test.

Haz esto automático en Donnu

El dolor específico de testear sellos de confianza es que el efecto es pequeño, la pregunta de negocio suele tener más de dos brazos y la tentación de leer segmentos después es grande. Algunas elecciones de configuración hacen el error menos probable.

En Donnu, la meta de conversión puede confirmarse desde tu servidor, además de clics, envíos de formulario y visitas a páginas, lo que mide el pedido que de hecho se pagó en lugar del clic en “finalizar”. En el plan Pro, el experimento puede tener una variación C, lo que permite el diseño de control, refuerzo neutro y sello de marca del primer ejemplo, y puede restringirse por dispositivo, origen de tráfico y visitante nuevo o recurrente, lo que ayuda a declarar el público antes de correr. El informe es bayesiano, avisa cuando la división de visitantes se aleja de lo configurado y solo declara ganadora con al menos 200 visitantes por variación y 7 días de test.

Lo que sigue siendo tuyo: garantizar que el sello es verdadero, dimensionar para un efecto pequeño y esperar la muestra. Para eso, la calculadora de tamaño de muestra, la calculadora de significancia y la calculadora de poder estadístico hacen las cuentas de esta guía con tus números, gratis.

Referencias

Lee también: Optimización de checkout · Prueba social en test A/B · Test A/B de página de producto · Optimización de la página de precios SaaS · Optimización del formulario de demo SaaS · Test A/B de carrito abandonado · Test A/B/n · Leia em português · Read in English

Preguntas frecuentes

¿Los sellos de confianza aumentan la conversión?
Pueden aumentarla, sobre todo donde el visitante duda y la marca es poco conocida. Baymard Institute observa en tests de usabilidad que la preocupación por la seguridad aparece en el momento de escribir la tarjeta, que las marcas grandes necesitan menos refuerzo visual y que el 19 por ciento de los usuarios abandonó un checkout en los últimos tres meses por no confiarle la tarjeta al sitio (encuesta de 2025, 1.026 respondentes). Eso es evidencia de percepción, no promesa de ganancia: la única forma de saberlo en tu sitio es testear, midiendo pedido completado.
¿Dónde poner el sello de seguridad en el checkout?
Cerca del campo de tarjeta, y no solo en el pie de página. Baymard recomienda destacar visualmente el área de los datos de tarjeta (borde, fondo, sombreado) y observa que uno o dos íconos dentro de esa área funcionan bien para reforzar la sensación de seguridad. En SaaS, el equivalente es cerca del botón de pedir demo o del plan Enterprise, donde aparece la duda sobre seguridad de datos.
¿Qué métrica usar en un test de sello de confianza?
La conclusión de la etapa que el sello quiere destrabar, medida entre quien llegó a ella. En ecommerce, pedido completado entre quien inició el checkout; en SaaS, solicitud de demo o prueba, con oportunidad calificada como lectura siguiente. El clic en el sello es diagnóstico: en el ejemplo de esta guía, solo el 1,7 por ciento de los visitantes interactuó con el sello, y el pedido completado subió 3,1 por ciento con valor-p de 0,0006.
¿Un sello famoso funciona mejor que un candado genérico?
No siempre, y el test de dos brazos no responde eso. En las encuestas de Baymard, el sello de Norton lideró en confianza declarada, pero un sello inventado por los investigadores fue mejor que casi todos los sellos de certificado de marcas establecidas. En el ejemplo trabajado de esta guía, el sello reconocido y un candado con texto verdadero le ganan al control, pero la diferencia entre los dos es de 0,4 por ciento con valor-p de 0,6233. Para atribuirle la ganancia a la marca del sello hace falta un brazo de comparación con un ícono neutro en el mismo lugar.
¿Cuánto tráfico hace falta para testear sellos de confianza?
Depende de dónde midas. Con 45 por ciento de conclusión entre quien inicia el checkout, 95 por ciento de confianza y 80 por ciento de poder, detectar 3 por ciento relativo exige 21.371 inicios de checkout por variación. Medido sobre todos los visitantes del sitio, con 2,7 por ciento de pedido por visita, el mismo efecto exige 637.718 por variación. En una página de precios SaaS con 3 por ciento de solicitud de demo, detectar 10 por ciento relativo exige 53.211 por variación, 75 días a 10 mil visitantes por semana.
¿Puedo usar un sello sin tener la certificación?
No. En Estados Unidos, la guía de endosos de la FTC (16 CFR 255) dice que el nombre o el sello de una organización puede ser un endoso, y la FTC ya acusó a emisoras de sellos de prometer verificaciones que, según la agencia, no se hacían, como ControlScan en 2010 y TRUSTe en 2014 (los dos casos terminaron en acuerdo). En Brasil, el Código de Defensa del Consumidor prohíbe la publicidad total o parcialmente falsa y pone la carga de la prueba en quien anuncia. Para SOC 2 e ISO/IEC 27001, el logo depende del informe de un auditor independiente o del certificado de un organismo certificador.