Sellos de Confianza en Test A/B: cuándo ayudan de verdad
Sellos de confianza en test A/B: dónde ponerlos en el checkout y en SaaS, qué medir, por qué varía el efecto y cómo no confundir sello famoso con ganancia.

📚 Este artículo es parte de la guía Optimización de Conversión (CRO): La Guía Completa 2026.
Los sellos de confianza son marcas visuales que le dicen al visitante que un tercero verificó algo: el certificado del sitio, el medio de pago, la política de devolución, la reputación de la tienda o, en SaaS, los controles de seguridad de la empresa. Ayudan cuando responden a una duda real en el punto en que aparece, y casi siempre con un efecto pequeño, que pide muestra grande y la métrica correcta. En el ejemplo trabajado de esta guía, un sello reconocido cerca del campo de tarjeta aumenta los pedidos completados en 3,1 por ciento con valor-p de 0,0006, y un candado genérico con texto verdadero, en el mismo lugar, llega a 2,7 por ciento: la diferencia entre los dos no es significativa. Esta guía forma parte de nuestra guía completa de optimización de conversión (CRO) y cubre los tipos de sello, dónde ponerlos, qué muestra la investigación, qué medir, los riesgos de un sello desconocido o falso y dos ejemplos calculados, uno de ecommerce y uno de SaaS.
Qué son los sellos de confianza y por qué el efecto es tan variable
Un sello de confianza es una promesa tercerizada. En vez de que la tienda diga “somos seguros”, una marca externa aparece diciendo, en teoría, que lo revisó. El problema es el “en teoría”: el visitante rara vez sabe qué verifica cada sello, y Baymard Institute lo resume en una observación que atraviesa años de tests de usabilidad: el usuario medio juzga la seguridad de un sitio por instinto, guiado por la confianza en la marca y por la apariencia de solidez de la página, y no por la seguridad técnica real.
De ahí viene la primera regla de esta guía: el sello actúa sobre la percepción, así que el efecto depende de cuánta duda existe y de quién está mirando. Una tienda conocida tiene poca duda que reducir. Según Baymard, en tests con sitios de marcas grandes los participantes muestran pocas preocupaciones de seguridad incluso con poco refuerzo visual, mientras que en sitios más nuevos o de nicho la preocupación aparece con facilidad cuando no hay ninguna pista visual.
Los cinco tipos de sello y qué prueba cada uno
| tipo | ejemplos | qué verifica de hecho | qué suele entender el visitante | riesgo principal |
|---|---|---|---|---|
| Certificado del sitio (SSL/TLS) | sello de la autoridad certificadora | que la conexión está cifrada y, según el certificado, quién es la organización | “el sitio es seguro” | casi todo sitio ya tiene HTTPS; el sello no dice nada sobre la honestidad de la tienda |
| Pago | marcas de tarjeta, billeteras digitales, intermediario | que ese medio se acepta | “mi dinero está protegido” | marca que no se acepta de verdad en ese flujo |
| Garantía y devolución | “devolución gratis en 30 días”, “satisfacción garantizada” | una política de la propia tienda | “no corro riesgo” | condición escondida; promesa que la atención no cumple |
| Reputación y reseñas | puntuación en plataforma de reseñas, entidad de reclamos | la opinión agregada de terceros | “otras personas confiaron” | puntuación que no se actualiza o sello de plataforma que el visitante no conoce |
| Cumplimiento B2B | SOC 2, ISO/IEC 27001, protección de datos | controles auditados por terceros, en un alcance y período definidos | “mis datos quedan protegidos” | logo sin informe o certificado vigente; alcance menor que el producto |
La columna del medio y la del costado casi nunca coinciden, y en esa distancia vive el test A/B. Un sello de certificado prueba muy poco para el consumidor común; un sello de garantía prueba solo lo que la tienda se compromete a cumplir; un sello de cumplimiento prueba mucho, pero solo para quien sabe leerlo.
Qué muestra la evidencia sobre sellos de confianza (y qué no)
Casi toda la evidencia pública sobre sellos es de percepción declarada, no de conversión medida en un experimento. Eso no la vuelve inútil: dice dónde está la duda y qué marcas reconoce el público. Pero no dice cuánto va a subir tu conversión.
Baymard: la duda aparece en el campo de tarjeta
En el artículo sobre percepción de seguridad en el checkout, Baymard reúne cuatro observaciones que valen como punto de partida de cualquier hipótesis:
- El 19 por ciento de los usuarios abandonó un checkout en los últimos tres meses porque no le confió la tarjeta al sitio (1.026 respondentes, población adulta de internet de Estados Unidos, 2025).
- Los participantes casi no muestran preocupación en las etapas de dirección y envío; la preocupación surge frente a la interfaz de la tarjeta.
- Partes de una misma página se perciben como más o menos seguras, aunque todos los campos de una página HTTPS estén igualmente cifrados. Destacar visualmente los campos de tarjeta (borde, fondo, sombreado), con un estilo que no se repite en el resto del formulario, aumenta la seguridad percibida.
- Uno o dos íconos dentro del área destacada funcionan bien. Y las fallas de layout en el checkout erosionan la confianza al punto de que los participantes creen que el sitio fue hackeado.
Qué sello dice la gente que confía: la marca pesa más que la función
Baymard preguntó, en encuestas de 2013 a 2023, “¿qué sello te da la mayor sensación de confianza al pagar en línea?”. En la ronda de 2013, con 2.510 respuestas de adultos de Estados Unidos, el 49 por ciento eligió “no sé o no tengo preferencia”. Entre quienes eligieron un sello, Norton se quedó con cerca del 36 por ciento y McAfee con cerca del 23 por ciento, las dos de marcas de antivirus. El sello de Norton era un sello de certificado (SSL), pero los demás sellos de certificado de la lista, que también tienen función técnica real, quedaron bastante por debajo.
La actualización de 2023 cuenta, según el propio Baymard, la misma historia: Norton lidera, seguida de tres sellos de confianza de empresa, con varios sellos de certificado bastante por debajo. Y está el hallazgo más útil para quien testea: desde 2016 las encuestas incluyen un sello inventado por los investigadores, sin ningún significado, y le fue significativamente mejor que a los sellos de certificado de proveedores establecidos, con excepción de Norton. La conclusión de Baymard es que, fuera de la fuerza de una marca muy reconocida, importa menos cuál sello y más que exista algún refuerzo visual cerca de la tarjeta.
Una investigación de CXL Institute de 2016, con 2.100 personas de Estados Unidos, encontró el mismo patrón (cuanto más familiar la marca, mayor la seguridad percibida) y agregó diferencias por público: las personas de 20 a 30 años eligieron el sello de Google más que el promedio (19 contra 15 por ciento), y solo el 3 por ciento de los mayores de 50 hizo lo mismo. Los propios autores advierten que lo que la gente dice en un cuestionario no es lo que hace en una compra.
| fuente | diseño | qué se transfiere a tu test | qué no se transfiere |
|---|---|---|---|
| Baymard, percepción de seguridad en el checkout | tests de usabilidad y encuesta de abandono | dónde aparece la duda (tarjeta) y cómo reforzar (destaque + 1 o 2 íconos) | ningún número de ganancia de conversión |
| Baymard, encuesta de sellos 2013 a 2023 | elección declarada entre sellos, adultos de EE. UU. | la marca reconocida pesa; un ícono genérico ya ayuda | el ranking vale para ese público y esas marcas |
| CXL Institute, 2016 | cuestionario con 2.100 personas de EE. UU. | el sello que convence cambia con la edad y el género | familiaridad declarada no es conversión |
| estudios de caso de proveedores | tests publicados por quien vende sellos o herramientas | ideas de hipótesis | el tamaño del efecto, por sesgo de publicación |
Sobre la última fila: los casos publicados de “el sello aumentó la conversión en X por ciento” son, en general, los tests que salieron bien, contados por quien tiene interés en el resultado. Los que no movieron nada no vieron un artículo. Úsalos como fuente de hipótesis, nunca como estimación de efecto. El propio Baymard recomienda testear sellos y refuerzos visuales con tu público y leer casos ajenos con cautela.
El candado del navegador cambió, y el sello de certificado también
Dos cambios de 2023 envejecieron mucho de lo que se escribía sobre sellos de seguridad:
- Chrome cambió el candado. En mayo de 2023, el blog de Chromium anunció que el candado de la barra de direcciones daría lugar a un ícono de ajustes a partir de Chrome 117, con lanzamiento previsto para comienzos de septiembre de 2023. Los motivos declarados: más del 95 por ciento de las cargas de página en Chrome para Windows ya usaba HTTPS; en una encuesta de 2021, solo el 11 por ciento de los participantes entendía el significado preciso del candado; y casi todos los sitios de phishing usan HTTPS, así que el candado aparecía también en ellos. El nuevo ícono, según Google, no sugiere que la página sea confiable.
- El sello de Norton se volvió sello DigiCert. El registro de cambios de Akamai informa que, el 17 de octubre de 2023, DigiCert sustituyó automáticamente la imagen del sello de Norton por la del sello DigiCert en los sitios con certificados de validación de organización (OV) y extendida (EV) gestionados por Akamai. La documentación de DigiCert describe el sello actual como algo que muestra dinámicamente el estado del certificado y los detalles de validación.
La consecuencia práctica: “el sitio tiene HTTPS” dejó de ser un diferencial. Un sello de certificado comunica, como mucho, que la tienda se tomó el trabajo de exhibir uno. Eso no lo vuelve inútil (el refuerzo visual cerca de la tarjeta sigue ayudando a la percepción, según Baymard), pero cambia la hipótesis: testeas refuerzo visual y reconocimiento de marca, no “seguridad”.
Dónde poner los sellos de confianza: checkout, formulario y página de precios
La regla que atraviesa todos los contextos es la de la proximidad: el sello va donde aparece la duda, y la duda aparece donde el visitante entrega algo (tarjeta, datos personales, datos de la empresa, un compromiso de suscripción). Un sello en el pie de página es decoración; el mismo sello al lado del campo de tarjeta es una hipótesis.
| contexto | dónde testear el sello | duda que responde | métrica primaria | lectura siguiente |
|---|---|---|---|---|
| Checkout de ecommerce | dentro del área de la tarjeta, junto al botón de finalizar | “¿puedo confiarle mi tarjeta a este sitio?” | pedido completado entre quien inició el checkout | pedido pagado (no rechazado), contracargo |
| Página de producto | cerca del precio y del botón de compra (garantía, devolución, medios de pago) | “¿y si no me sirve? ¿puedo pagar como quiero?” | agregar al carrito y pedido | devolución en 30 días |
| Carrito | junto al total y al botón de ir al checkout | “¿el precio final y el cambio son claros?” | inicio de checkout | pedido completado |
| Formulario de demo SaaS | junto a los campos de correo corporativo y empresa | “¿qué hacen con mis datos?” | envío del formulario | reunión calificada |
| Página de precios SaaS | en el plan Enterprise y cerca de la solicitud de demo o prueba | “¿pasa la evaluación de seguridad de mi empresa?” | solicitud de demo o inicio de prueba | oportunidad calificada, ciclo de venta |
| Registro self-serve | cerca del botón de crear cuenta y del campo de tarjeta, cuando lo haya | “¿me van a cobrar sin querer?” | cuenta creada | activación, cuenta pagada |
Dos notas sobre la tabla. Primero, la garantía de devolución es el sello que más mueve la lectura siguiente: puede aumentar pedidos y aumentar devoluciones junto con ellos, así que la guarda de 30 días es obligatoria. Segundo, en Brasil el derecho de arrepentimiento en una compra fuera del establecimiento ya es de 7 días por el artículo 49 del CDC; un sello “7 días para desistir” describe la ley, no un diferencial, y así debe presentarse. Las guías de optimización de checkout, página de producto, carrito abandonado, formulario de demo SaaS y página de precios SaaS detallan el resto de cada etapa.
Qué medir en un test de sello
El sello es un elemento pequeño, y los elementos pequeños tienen efectos pequeños. Tres decisiones de medición separan un test útil de un test que “gana” por casualidad.
1. Conclusión de la etapa, no clic en el sello
Casi nadie hace clic en un sello. El clic es diagnóstico (confirma que el elemento se vio y si alguien quiso verificar lo que dice), nunca métrica primaria: un sello puede tener pocos clics y aun así cambiar la decisión, y un sello puede tener muchos clics porque parece un botón y distraer del pedido. La primaria es la conclusión de la etapa que el sello quiere destrabar: pedido completado, formulario enviado, demo solicitada.
2. Medir entre quien llegó a la etapa (y no en todo el sitio)
Si el sello solo aparece en la etapa de pago, solo quien llega a ella puede verse afectado. Medir la conversión sobre todos los visitantes del sitio mezcla a miles de personas que nunca vieron el sello y diluye el efecto en el ruido. La diferencia de muestra es enorme, como muestra la cuenta con el motor de las calculadoras del blog, para 3 por ciento de efecto relativo, 95 por ciento de confianza y 80 por ciento de poder:
| dónde se mide | tasa base | visitantes por variación | por qué cambia |
|---|---|---|---|
| conclusión entre quien inició el checkout | 45% | 21.371 | solo entra quien puede ver el sello |
| pedido sobre todos los visitantes del sitio | 2,7% | 637.718 | el mismo efecto relativo, diluido en una tasa base casi 17 veces menor |
El escenario es el mismo en las dos filas (el 6 por ciento de los visitantes inicia el checkout y el 45 por ciento de ellos lo concluye, lo que da 2,7 por ciento). Para que la exposición funcione así, el sorteo o el conteo tienen que empezar en la etapa en que aparece el sello, o el análisis tiene que filtrar a quien llegó ahí con la misma regla en los dos brazos.
3. Una variable por vez, y un brazo para separar marca de forma
“El sello ganó” puede querer decir cuatro cosas: ganó el destaque visual, ganó el ícono, ganó la marca del sello o ganó la promesa escrita. Un test de dos brazos (sin sello contra sello famoso) no distingue ninguna de ellas. Si la pregunta es “¿vale la pena pagar por un sello de marca?”, el diseño necesita un tercer brazo con un refuerzo neutro en el mismo lugar y del mismo tamaño. El primer ejemplo trabajado hace exactamente eso.
El riesgo del sello desconocido y del sello falso
Hay dos riesgos distintos, y solo uno de ellos aparece en el panel del test.
Sello desconocido: puede no hacer nada, o estorbar. Un sello que el público no reconoce es, en la práctica, una imagen más cerca del botón. Baymard registró sellos de certificado de proveedores establecidos por debajo de un sello inventado; CXL registró que la confianza declarada en cada sello cambia con la edad. Un sello con aspecto amateur, o que rompe el layout en el celular, puede tener el efecto contrario: Baymard observó participantes que sospechaban de un hackeo ante fallas de layout en la etapa de pago. Ese riesgo lo mide el test.
Sello falso o vencido: el test no lo ve, la ley sí. Un sello que afirma una verificación que no ocurrió puede “ganar” el test, porque el panel mide comportamiento, no veracidad.
| jurisdicción | regla o caso | qué dice, en resumen | qué cambia en un test |
|---|---|---|---|
| Estados Unidos | FTC, guía de endosos y testimonios (16 CFR 255), revisada el 29/06/2023 | el nombre o el sello de una organización puede ser un endoso; el endoso de una organización tiene que venir de un proceso que refleje su juicio colectivo y, si se presenta como experta, de expertos o estándares adecuados | un sello sin verificación real no es una variación testeable |
| Estados Unidos | FTC contra ControlScan, 2010 | según la FTC, los sellos que indicaban verificación se otorgaban con “poca o ninguna verificación” y exhibían la fecha actual, aunque ningún sitio se revisaba diariamente (algunos semanalmente, otros sin revisión continua); en el acuerdo, el fundador renunció a 102 mil dólares y la empresa tuvo que pedir a los sitios el retiro de los sellos | un sello “verificado hoy” necesita verificación de hoy |
| Estados Unidos | FTC contra TRUSTe, 2014 | según la denuncia de la FTC, de 2006 a enero de 2013 la recertificación anual prometida no se hizo en más de mil casos; el acuerdo incluyó un pago de 200 mil dólares | un sello sin la revisión periódica que promete puede engañar |
| Estados Unidos | FTC, guía de garantías (16 CFR 239.3) | “garantía de satisfacción” o “dinero de vuelta” solo si el precio total se devuelve a pedido del comprador, con las limitaciones relevantes divulgadas de forma clara | la variación de garantía necesita las condiciones visibles, en los dos brazos que las citan |
| Brasil | CDC, arts. 37, 38 y 67 | prohíbe la publicidad total o parcialmente falsa, incluso por omisión; la carga de la prueba es de quien patrocina; hacer publicidad que se sabe o se debería saber engañosa prevé detención de tres meses a un año y multa | el sello, la garantía y la certificación exhibidos tienen que ser comprobables |
Para SaaS, la regla es la misma con nombres técnicos. El AICPA mantiene logos de SOC para organizaciones que recibieron al menos un informe SOC 1, SOC 2 o SOC 3 emitido por un CPA licenciado e independiente. El informe SOC 2 tiene, en general, uso restringido, mientras que el SOC 3 es de distribución libre, y el Tipo 2 evalúa la eficacia de los controles a lo largo de un período, no solo el diseño en una fecha. Para ISO/IEC 27001, la ISO orienta buscar al organismo que emitió el certificado antes de usar un logo y citar la norma completa, como “certificada en ISO/IEC 27001:2022”. Un sello “SOC 2” sin informe, o “ISO 27001” sin certificado vigente para el alcance del producto, es el equivalente B2B del sello falso. Esto es contexto, no una opinión jurídica.
Ejemplo trabajado 1: sello en el checkout, con un brazo para separar la marca
Escenario (ilustrativo). Una tienda de moda de marca poco conocida recibe 30.000 inicios de checkout por semana, y el 45 por ciento de ellos se convierte en pedido. La etapa de pago hoy trata los campos de la tarjeta como cualquier otro campo. La hipótesis viene de Baymard: destacar el área de la tarjeta y poner un refuerzo dentro de ella aumenta la conclusión. La pregunta de negocio es doble: ¿funciona el refuerzo? ¿Y vale la pena pagar por un sello de marca reconocida, o basta con un candado genérico con texto verdadero?
Diseño. Tres brazos con el mismo tráfico: A (control), B (área destacada, candado genérico y el texto “pago cifrado”, que es verdadero), C (la misma área, con el sello del certificado que la tienda de hecho tiene, en el mismo lugar y tamaño). Unidad: visitante que inicia el checkout. Primaria: pedido completado. Diagnóstico: interacción con el sello. Guarda: tasa de pedido rechazado por el antifraude. Segmento declarado antes: cliente nuevo y recurrente. Comparaciones planificadas: B contra A y C contra A, cada una a 2,5 por ciento (Bonferroni); C contra B como lectura descriptiva.
Muestra. El equipo quiere ver 3 por ciento relativo. En la calculadora de abajo, escribe: tasa de conversión actual 45; efecto mínimo detectable 3, relativo; confianza 95; poder 80; visitantes por semana 30000; test bilateral.
Cálculo por aproximación normal de dos proporciones, 2 variaciones (50/50). Cambia los campos y mira el impacto en vivo.
La pantalla muestra 21.371 visitantes por variación, 42.742 en total y 10 días. Esos 10 días suponen dos variaciones; con tres brazos, los mismos 21.371 por brazo llevan 15 días. Y la calculadora trabaja al 95 por ciento: con la corrección para dos comparaciones (2,5 por ciento cada una), la cuenta de esta guía, con la misma fórmula, pide 25.881 por brazo, 19 días con tres brazos. El equipo corre tres semanas completas, 21 días, lo que da 30.000 inicios de checkout por brazo y cerca de 86 por ciento de poder para 3 por ciento de efecto en cada comparación.
La sensibilidad al efecto mínimo muestra por qué un sello es un test de mucho tráfico (dos variaciones, 95 por ciento, 80 por ciento de poder, 30.000 por semana):
| efecto relativo que quieres detectar | visitantes por variación | total | días |
|---|---|---|---|
| 1% | 192.031 | 384.062 | 90 |
| 2% | 48.048 | 96.096 | 23 |
| 3% | 21.371 | 42.742 | 10 |
| 5% | 7.705 | 15.410 | 4 |
La mirada de la primera semana. Con 10.000 por brazo, C tenía 4.680 pedidos contra 4.500 del control: más 4,0 por ciento, valor-p de 0,0106. Parecía una ganancia mayor que la planificada. En las semanas 2 y 3, con 20.000 por brazo, el marcador de C contra A fue de 9.240 contra 9.000, más 2,7 por ciento. La primera semana más fuerte no autoriza una decisión, y el costo de parar ahí está en el problema del peeking.
El resultado en 21 días.
| brazo | inicios de checkout | pedidos | conclusión | pedidos de más que A |
|---|---|---|---|---|
| A, control | 30.000 | 13.500 | 45,00% | |
| B, refuerzo neutro | 30.000 | 13.860 | 46,20% | 360 |
| C, sello reconocido | 30.000 | 13.920 | 46,40% | 420 |
La división está limpia (30.000 en cada brazo no enciende el verificador de SRM). Ahora pega en la calculadora de significancia la primera comparación: control con 30000 visitantes y 13500 conversiones; variación con 30000 y 13920; confianza 95.
Test z bilateral de dos proporciones. "Sin significancia" casi siempre significa que falta muestra, no que las versiones sean iguales.
La pantalla muestra 45,00% contra 46,40%, mejora relativa de +3,1%, valor-p de 0,0006, intervalo de 95 por ciento de la diferencia de +0,6% … +2,2% (pp) y Ganadora con significancia · B gana (la calculadora llama B a cualquier variación escrita en la segunda columna, aquí el brazo C). Con más decimales, la mejora es de 3,11 por ciento, el valor-p es 0,000577 y el intervalo va de más 0,60 a más 2,20 puntos porcentuales, cerca de más 1,3 a más 4,9 por ciento relativos. El valor-p está por debajo de 0,025, así que C pasa también por la regla corregida.
Cambia la variación al brazo B (30000 y 13860): la pantalla muestra 46,20%, mejora de +2,7%, valor-p de 0,0032, intervalo de +0,4% … +2,0% (pp) y el mismo veredicto. Con más decimales, cerca de más 0,9 a más 4,4 por ciento relativos. También por debajo de 0,025.
La lectura que cae en la trampa. “El sello reconocido ganó con 3,1 por ciento, el mayor efecto: vamos a contratar el sello de marca.” Ahora compara C contra B en la misma calculadora, con B en el control: 30000 y 13860 contra 30000 y 13920. La pantalla muestra 46,20% contra 46,40%, mejora de +0,4%, valor-p de 0,6233, intervalo de -0,6% … +1,0% (pp) y Todavía sin significancia.
Qué dice el resultado, y qué no dice. El refuerzo visual cerca de la tarjeta funcionó, con o sin marca, que es el patrón que describe Baymard. El sello reconocido no se separó del candado genérico. Y “no se separó” tiene tamaño: con 30.000 por brazo y una tasa cercana al 46 por ciento, el test tenía solo cerca de 20 por ciento de poder para ver 1 por ciento relativo entre C y B; ver esa diferencia pediría 182.925 por brazo. La decisión honesta es “la marca, si agrega, agrega poco”, y eso entra en la cuenta de costo del sello.
El corte declarado: nuevo contra recurrente (C contra A).
| segmento | A: pedidos / inicios | C: pedidos / inicios | mejora | valor-p | intervalo relativo aproximado |
|---|---|---|---|---|---|
| cliente nuevo | 7.200 / 18.000 (40,00%) | 7.560 / 18.000 (42,00%) | +5,0% | 0,0001 | +2,5% a +7,5% |
| cliente recurrente | 6.300 / 12.000 (52,50%) | 6.360 / 12.000 (53,00%) | +1,0% | 0,4379 | -1,5% a +3,4% |
En la calculadora, con 18000 y 7200 contra 18000 y 7560, la pantalla muestra +5,0%, valor-p 0,0001 e intervalo de +1,0% … +3,0% (pp); con 12000 y 6300 contra 12000 y 6360, +1,0%, valor-p 0,4379, -0,8% … +1,8% (pp) y “Todavía sin significancia”. La dirección coincide con la observación de Baymard (quien ya conoce la tienda necesita menos refuerzo), pero la pregunta correcta es si los dos efectos son distintos entre sí, y esa cuenta la calculadora no la hace: la diferencia entre las ganancias absolutas es de 1,5 punto porcentual, con valor-p de 0,0697 en el test de interacción calculado por esta guía. Es una señal, no una prueba. Lee más en efecto heterogéneo por segmento.
Qué hacer con él. Lanzar el refuerzo visual para todos (cuesta casi nada y no empeoró a nadie), mantener el sello del certificado que la tienda ya tiene si el costo es bajo, y no contratar un sello de marca más caro con base en este test. El diagnóstico confirma la lectura: solo el 1,7 por ciento de los visitantes del brazo C pasó el mouse o tocó el sello; el efecto vino de quien ni siquiera verificó lo que decía.
Ejemplo trabajado 2: sellos SOC 2 e ISO 27001 en la página de precios SaaS
Escenario (ilustrativo). Un SaaS B2B tiene informe SOC 2 Tipo II y certificado ISO/IEC 27001:2022 vigentes, pero solo los menciona en una página de seguridad. La página de precios recibe 10.000 visitantes por semana, y el 3,0 por ciento pide demo. La hipótesis: una línea con los dos sellos y el enlace al centro de confianza, cerca del plan Enterprise y del botón de pedir demo, reduce la duda “¿ustedes pasan nuestra evaluación de seguridad?”.
El error de planificación. El equipo decidió correr cuatro semanas porque era el plazo del trimestre. Vuelve a la calculadora de tamaño de muestra y escribe: tasa 3; efecto mínimo 10, relativo; confianza 95; poder 80; visitantes por semana 10000; bilateral. La pantalla muestra 53.211 por variación, 106.422 en total y 75 días. Cuatro semanas dan 20.000 por brazo.
El resultado. En la calculadora de significancia, escribe 20000 y 600 en el control y 20000 y 642 en la variación. La pantalla muestra 3,00% contra 3,21%, mejora de +7,0%, valor-p de 0,2260, intervalo de -0,1% … +0,5% (pp) y Todavía sin significancia. Con más decimales, el intervalo va de menos 0,13 a más 0,55 punto porcentual, cerca de menos 4,3 a más 18,3 por ciento relativos.
La lectura equivocada en los dos sentidos. “Los sellos no funcionan” es incorrecto: el test tenía cerca del 40 por ciento de poder para ver 10 por ciento relativo (cuenta de esta guía, misma fórmula), y el menor efecto que 20.000 por brazo ve con 80 por ciento de poder es de cerca del 16 por ciento. “Los sellos aumentaron 7 por ciento” también es incorrecto: el intervalo incluye el cero e incluye una ganancia de 18 por ciento. El test no lo sabe. No es el caso de calcular “poder observado” a partir de ese resultado, por el motivo explicado en poder observado.
El corte que tienta. El segmento declarado antes era “visitante que abrió el plan Enterprise”:
| segmento | A | B | mejora | valor-p | lectura |
|---|---|---|---|---|---|
| abrió el plan Enterprise | 180 de 3.000 (6,00%) | 219 de 3.000 (7,30%) | +21,7% | 0,0433 | por debajo de 0,05, con poder de cerca de 46% para 20% |
| demás visitantes | 420 de 17.000 (2,47%) | 423 de 17.000 (2,49%) | +0,7% | 0,9167 | nada |
En la calculadora, 3000 y 180 contra 3000 y 219 muestran +21,7%, valor-p 0,0433 e intervalo de +0,0% … +2,6% (pp): la pantalla redondea el límite inferior a cero, pero con más decimales es más 0,04 punto porcentual (el intervalo queda todo por encima de cero, pegado a él, y por eso el valor-p queda justo debajo de 0,05), y el intervalo relativo va de cerca de más 0,7 a más 42,7 por ciento. La dirección tiene sentido (la duda sobre seguridad vive en quien evalúa el plan corporativo), pero con tres lecturas (total y dos segmentos) y un valor-p de 0,0433, eso es hipótesis, no resultado. Ver múltiples métricas y FDR.
Qué hacer con él. Mantener los sellos, porque son verdaderos, cuestan poco y responden a una pregunta que el comprador corporativo hace de todas formas, sin anunciar ninguna ganancia. Y, si la decisión importa, correr el test correcto: solo para quien abre el plan Enterprise, con 6 por ciento de base y 20 por ciento de efecto mínimo, la calculadora pide 6.719 por variación; a 1.500 visitantes de ese público por semana, son 63 días. La métrica que decide, en ese público, es oportunidad calificada, y madura en semanas, como describe la guía de formulario de demo SaaS.
Cómo leer un test de sello sin caer en “ganó porque es famoso”
Un test de sello que gana invita a una historia lista: la marca es conocida, luego genera confianza, luego convierte. La historia puede ser verdadera, pero el test de dos brazos no la sostiene. Seis preguntas antes de atribuir la ganancia:
- ¿Qué cambió además del sello? Destaque del área, espacio en blanco, texto al lado, posición del botón. Si cambió junto, la ganancia es del paquete.
- ¿Existe un brazo neutro? Sin él, “marca” y “refuerzo visual” están confundidos.
- ¿El efecto aparece donde existe la duda? Más efecto en cliente nuevo y en marca poco conocida es coherente con la hipótesis; un efecto igual en todo el mundo sugiere otra explicación.
- ¿La métrica es la conclusión de la etapa? El clic en el sello no cuenta como ganancia.
- ¿El test tenía poder para el efecto que estás celebrando? Si la muestra por brazo quedó por debajo de la que la calculadora pide para ese efecto, una ganancia de 2 a 3 por ciento que dio significativa tiende a estar exagerada.
- ¿La primera semana fue más fuerte? Un sello nuevo llama la atención por ser nuevo; mira efecto novedad.
Checklist antes de encender el test
- Verdad primero. Todo sello exhibido corresponde a una verificación, certificado o informe vigente, con un alcance que cubre lo que se está vendiendo, y toda garantía muestra las condiciones.
- Duda y público mapeados. ¿En qué punto el visitante entrega algo y duda, y quién duda? SOC 2 en el checkout de una tienda de ropa no responde ninguna duda.
- Proximidad. Uno o dos sellos en el área de la duda, no un muro en el pie de página.
- Muestra para un efecto pequeño. Dimensiona para 2 a 5 por ciento relativos, no para 20, y con corrección cuando haya un brazo neutro.
- Guarda para la garantía: devolución y solicitud de reembolso en 30 días.
- Test de layout del sello en celular y en los navegadores principales antes de encender el test.
Haz esto automático en Donnu
El dolor específico de testear sellos de confianza es que el efecto es pequeño, la pregunta de negocio suele tener más de dos brazos y la tentación de leer segmentos después es grande. Algunas elecciones de configuración hacen el error menos probable.
En Donnu, la meta de conversión puede confirmarse desde tu servidor, además de clics, envíos de formulario y visitas a páginas, lo que mide el pedido que de hecho se pagó en lugar del clic en “finalizar”. En el plan Pro, el experimento puede tener una variación C, lo que permite el diseño de control, refuerzo neutro y sello de marca del primer ejemplo, y puede restringirse por dispositivo, origen de tráfico y visitante nuevo o recurrente, lo que ayuda a declarar el público antes de correr. El informe es bayesiano, avisa cuando la división de visitantes se aleja de lo configurado y solo declara ganadora con al menos 200 visitantes por variación y 7 días de test.
Lo que sigue siendo tuyo: garantizar que el sello es verdadero, dimensionar para un efecto pequeño y esperar la muestra. Para eso, la calculadora de tamaño de muestra, la calculadora de significancia y la calculadora de poder estadístico hacen las cuentas de esta guía con tus números, gratis.
Referencias
- Baymard Institute (Jamie Holst). How Users Perceive Security During the Checkout Flow (Incl. New ‘Trust Seal’ Study 2023). Fuente del 19 por ciento de abandono por desconfianza en la tarjeta (1.026 respondentes, 2025), de la preocupación concentrada en la interfaz de la tarjeta, del destaque visual del área, de uno o dos íconos dentro de ella, del sello inventado por encima de los sellos de certificado (excepto Norton), de las fallas de layout y de la recomendación de testear con el propio público. Artículo leído en su totalidad; los porcentajes de la ronda de 2023 están en un gráfico y no se usaron. Verificado el 16/09/2026. baymard.com.
- Baymard Institute (Christian Holst). Which Site Seal do People Trust the Most? (2013/2016 Survey Results). Fuente de la encuesta de 2013 con 2.510 respuestas, del 49 por ciento sin preferencia y del liderazgo de Norton (cerca de 36 por ciento) y McAfee (cerca de 23 por ciento). Artículo leído en su totalidad. baymard.com.
- CXL Institute (Ben Labay). Which Site Seals Create The Most Trust? [Original Research]. 2016. Fuente de la encuesta con 2.100 personas de Estados Unidos, de la relación entre familiaridad y seguridad percibida, de las diferencias por edad (Google: 19 contra 15 por ciento entre 20 y 30 años; 3 por ciento por encima de 50) y de la advertencia de que la familiaridad declarada no es conversión. Página leída en su totalidad. cxl.com.
- Google, Chromium Blog. An Update on the Lock Icon. 02/05/2023. Fuente del 14 por ciento de HTTPS en 2013, del más de 95 por ciento de cargas en HTTPS en Windows, del 11 por ciento que entendía el candado (encuesta de 2021), del phishing con HTTPS y del cambio por el ícono de ajustes en Chrome 117. Post leído en su totalidad. blog.chromium.org.
- Akamai TechDocs. Oct 17, 2023: DigiCert site seal replaces Norton site seal. Fuente de la sustitución automática de la imagen del sello Norton por el sello DigiCert. Verificado el 16/09/2026. techdocs.akamai.com. Complementario: DigiCert, Add DigiCert site seals, fuente de la descripción del sello como exhibición dinámica del estado del certificado y de los detalles de validación. Verificado el 16/09/2026. docs.digicert.com.
- Federal Trade Commission. 16 CFR Part 255, Guides Concerning the Use of Endorsements and Testimonials in Advertising (§ 255.0 y § 255.4) y el anuncio de la revisión del 29/06/2023. Fuente de que el nombre o el sello de una organización puede ser un endoso y de la exigencia de un proceso para el endoso de una organización. Verificado el 16/09/2026. § 255.0 · § 255.4 · ftc.gov.
- Federal Trade Commission. Online Privacy and Security Certification Service Settles FTC Charges (25/02/2010) y TRUSTe Settles FTC Charges it Deceived Consumers Through Its Privacy Seal Program (17/11/2014). Fuente de los dos casos, con las acusaciones de la FTC de verificación prometida y no realizada y los términos de los acuerdos. Leídos en su totalidad. ftc.gov · ftc.gov.
- Federal Trade Commission. 16 CFR § 239.3, Satisfaction Guarantees. Fuente de la regla de devolución íntegra a pedido y de la divulgación clara de las limitaciones. Verificado el 16/09/2026. law.cornell.edu.
- AICPA & CIMA. SOC Logos for Service Organizations: Registration and Guidelines. Fuente de la condición de uso del logo (al menos un informe SOC 1, SOC 2 o SOC 3 de un CPA licenciado e independiente). Verificado el 16/09/2026. aicpa-cima.com. Complementario: Journal of Accountancy (AICPA), Explaining the 3 faces of SOC, 2016, fuente del uso restringido del SOC 2, del uso libre del SOC 3 y de la diferencia entre Tipo 1 y Tipo 2. journalofaccountancy.com.
- ISO. ISO/IEC 27001:2022, Information security management systems. Fuente de lo que define la norma, de la orientación de buscar al organismo certificador para el uso del logo y de citar la referencia completa. Verificado el 16/09/2026. iso.org.
- Brasil. Ley nº 8.078/1990 (Código de Defensa del Consumidor), texto compilado. Fuente de los artículos 37, 38, 49 y 67. Verificado el 16/09/2026. planalto.gov.br.
Lee también: Optimización de checkout · Prueba social en test A/B · Test A/B de página de producto · Optimización de la página de precios SaaS · Optimización del formulario de demo SaaS · Test A/B de carrito abandonado · Test A/B/n · Leia em português · Read in English
Preguntas frecuentes
- ¿Los sellos de confianza aumentan la conversión?
- Pueden aumentarla, sobre todo donde el visitante duda y la marca es poco conocida. Baymard Institute observa en tests de usabilidad que la preocupación por la seguridad aparece en el momento de escribir la tarjeta, que las marcas grandes necesitan menos refuerzo visual y que el 19 por ciento de los usuarios abandonó un checkout en los últimos tres meses por no confiarle la tarjeta al sitio (encuesta de 2025, 1.026 respondentes). Eso es evidencia de percepción, no promesa de ganancia: la única forma de saberlo en tu sitio es testear, midiendo pedido completado.
- ¿Dónde poner el sello de seguridad en el checkout?
- Cerca del campo de tarjeta, y no solo en el pie de página. Baymard recomienda destacar visualmente el área de los datos de tarjeta (borde, fondo, sombreado) y observa que uno o dos íconos dentro de esa área funcionan bien para reforzar la sensación de seguridad. En SaaS, el equivalente es cerca del botón de pedir demo o del plan Enterprise, donde aparece la duda sobre seguridad de datos.
- ¿Qué métrica usar en un test de sello de confianza?
- La conclusión de la etapa que el sello quiere destrabar, medida entre quien llegó a ella. En ecommerce, pedido completado entre quien inició el checkout; en SaaS, solicitud de demo o prueba, con oportunidad calificada como lectura siguiente. El clic en el sello es diagnóstico: en el ejemplo de esta guía, solo el 1,7 por ciento de los visitantes interactuó con el sello, y el pedido completado subió 3,1 por ciento con valor-p de 0,0006.
- ¿Un sello famoso funciona mejor que un candado genérico?
- No siempre, y el test de dos brazos no responde eso. En las encuestas de Baymard, el sello de Norton lideró en confianza declarada, pero un sello inventado por los investigadores fue mejor que casi todos los sellos de certificado de marcas establecidas. En el ejemplo trabajado de esta guía, el sello reconocido y un candado con texto verdadero le ganan al control, pero la diferencia entre los dos es de 0,4 por ciento con valor-p de 0,6233. Para atribuirle la ganancia a la marca del sello hace falta un brazo de comparación con un ícono neutro en el mismo lugar.
- ¿Cuánto tráfico hace falta para testear sellos de confianza?
- Depende de dónde midas. Con 45 por ciento de conclusión entre quien inicia el checkout, 95 por ciento de confianza y 80 por ciento de poder, detectar 3 por ciento relativo exige 21.371 inicios de checkout por variación. Medido sobre todos los visitantes del sitio, con 2,7 por ciento de pedido por visita, el mismo efecto exige 637.718 por variación. En una página de precios SaaS con 3 por ciento de solicitud de demo, detectar 10 por ciento relativo exige 53.211 por variación, 75 días a 10 mil visitantes por semana.
- ¿Puedo usar un sello sin tener la certificación?
- No. En Estados Unidos, la guía de endosos de la FTC (16 CFR 255) dice que el nombre o el sello de una organización puede ser un endoso, y la FTC ya acusó a emisoras de sellos de prometer verificaciones que, según la agencia, no se hacían, como ControlScan en 2010 y TRUSTe en 2014 (los dos casos terminaron en acuerdo). En Brasil, el Código de Defensa del Consumidor prohíbe la publicidad total o parcialmente falsa y pone la carga de la prueba en quien anuncia. Para SOC 2 e ISO/IEC 27001, el logo depende del informe de un auditor independiente o del certificado de un organismo certificador.