Generador de Datos de Prueba Falsos
Genera filas de datos de prueba con aspecto realista pero completamente inventados — nombres, correos, teléfonos, direcciones — para QA y pruebas de bases de datos. Nada aquí pertenece a una persona real.
248 visitas
Todos los datos a continuación son inventados aleatoriamente solo con fines de prueba — no describen a ninguna persona real.
Por Qué Probar Con Datos Reales de Usuarios Es Una Mala Práctica
Poblar una base de datos de desarrollo exportando una porción de la tabla de clientes de producción parece conveniente, y es una de las formas más comunes en que las empresas filtran datos personales accidentalmente. Bajo regulaciones como el RGPD de la UE y la KVKK de Turquía, se supone que los datos personales solo deben procesarse para el propósito específico para el que fueron recopilados y protegerse con seguridad apropiada a ese propósito — un entorno de staging o desarrollo suele estar mucho menos protegido que producción, a menudo accesible para todos los ingenieros, a veces incluso registrado o respaldado en almacenamiento menos seguro, o expuesto accidentalmente si una URL de staging queda indexada o un servidor de pruebas está mal configurado. El nombre, correo, teléfono y dirección de un cliente real sentados en una base de datos que nunca fue auditada para ese nivel de exposición es un caso de manual de responsabilidad de cumplimiento y seguridad, y "usamos datos de producción en una demo" es una frase recurrente en los análisis posteriores de filtraciones de datos reales. Los datos inventados evitan todo el problema: no hay una persona real a quien notificar, ninguna base de consentimiento que justificar, y ninguna filtración que reportar si una base de datos de prueba se filtra, porque las filas nunca correspondieron a nadie.
Más allá del cumplimiento normativo, los datos de prueba inventados también son simplemente más útiles para QA. Los datos reales de producción reflejan el aspecto que casualmente tienen tus usuarios existentes — no contendrán de forma confiable los casos límite que los probadores realmente necesitan, como nombres con caracteres inusuales, campos opcionales vacíos, cadenas de longitud máxima o una distribución uniforme entre todo lo que un formulario acepta. La generación sintética te permite controlar con precisión el volumen y la forma: esta herramienta te permite pedir entre 1 y 100 filas y elegir exactamente qué campos poblar, un flujo de trabajo para el que las exportaciones de clientes reales nunca fueron diseñadas.
Cómo Funciona la Aleatoriedad
Cada valor aquí — qué nombre, qué ciudad, qué dígitos en un número de teléfono — se elige usando crypto.getRandomValues(), la fuente de números aleatorios criptográficamente segura de la Web Crypto API, en lugar de Math.random(). Para ser precisos sobre el porqué: el riesgo de seguridad real de elegir un nombre falso para una fila de prueba es cercano a cero, así que esto no es un requisito de seguridad de la forma en que lo sería, digamos, generar una contraseña o un token de sesión. La razón por la que esta herramienta lo usa de todos modos es demostrar el hábito predeterminado correcto — Math.random() es un generador pseudoaleatorio rápido y no criptográfico cuya salida puede, en principio, predecirse o reproducirse entre entornos, mientras que crypto.getRandomValues() extrae de la fuente de entropía segura del sistema operativo y es la herramienta correcta cada vez que la aleatoriedad necesita ser impredecible — así que recurrir a ella por defecto evita el error de usar Math.random() en un contexto — como generar un código de descuento o un token de restablecimiento — donde la previsibilidad sí importaría de verdad. Para evitar el sesgo de módulo (una desviación sutil que hace que algunos valores sean muy ligeramente más probables que otros cuando el rango aleatorio no divide de forma exacta el espacio de salida), cada elección usa muestreo por rechazo: los valores que introducirían ese sesgo se descartan y se vuelven a extraer.
- Grupos separados de nombres y ciudades por idioma: elegir "Turco" genera datos de un grupo dedicado de nombres de pila, apellidos y ciudades turcas; elegir "Inglés" extrae de un grupo separado en inglés, así que los datos se leen de forma coherente con la localidad en lugar de una mezcla de convenciones de nomenclatura no relacionadas.
- Solo dominios falsos: los correos generados siempre usan example.com, example.org o example.net, los dominios formalmente reservados por la RFC 2606 para uso de documentación y pruebas — nunca un dominio real, registrable, que pudiera enrutar correo accidentalmente a algún sitio.
- La exportación CSV tiene formato RFC 4180: los campos están separados por comas y entrecomillados, así que los valores que contienen comas, comillas o saltos de línea aún se analizan correctamente en Excel, Google Sheets o cualquier importador de CSV compatible con estándares.
- Totalmente local: la generación ocurre en tu navegador; nada se envía a un servidor, se registra o se almacena en ningún lugar más allá de tu propia descarga.
Preguntas Frecuentes
¿Alguno de estos datos es real o rastreable a una persona real?
No. Cada fila se ensambla combinando aleatoriamente valores de grupos fijos de nombres, ciudades, empresas y dominios construidos específicamente para esta herramienta. No hay ninguna búsqueda contra ninguna persona real, lista de clientes o fuente de datos externa; cualquier parecido con un individuo real es coincidencia.
¿Por qué la herramienta usa crypto.getRandomValues() en lugar de Math.random()?
El riesgo de seguridad aquí es bajo, pero la herramienta modela deliberadamente el hábito predeterminado correcto: crypto.getRandomValues() extrae de la fuente de entropía segura del sistema operativo y evita el riesgo de previsibilidad que conlleva Math.random(), así que usarlo por defecto construye el instinto correcto para contextos — como tokens o códigos — donde la previsibilidad sí sería un problema real.
¿Puedo usar esto para poblar una base de datos de producción o compartida?
Esta herramienta está construida para pruebas de QA, staging y desarrollo local — no para poblar nada de cara al cliente. Como los valores se generan aleatoriamente, es posible que haya nombres o correos duplicados entre distintas ejecuciones de generación, y esto no se verifica.
¿Por qué los dominios de correo generados siempre son example.com o similares?
example.com, example.net y example.org son dominios reservados permanentemente por la RFC 2606 específicamente para documentación y pruebas, con la garantía de que nunca se asignarán a una organización real — usarlos evita el riesgo pequeño pero real de generar accidentalmente una dirección falsa en un dominio que alguien realmente posee.
¿En qué formato está la descarga CSV?
Sigue la RFC 4180: campos separados por comas, cada valor entre comillas dobles con las comillas internas escapadas, y finales de línea CRLF — el formato que Excel, Google Sheets y prácticamente cualquier herramienta de importación de bases de datos espera por defecto.
Herramientas Similares
Reportar un Problema
Generador de Datos de Prueba Falsos
Comentarios
Aún no hay comentarios — ¡sé el primero en escribir uno!