01 · Definiciones
Qué categorizamos y qué no.
La categoría "bot" se usa con ligereza en el debate público para descalificar al contrario. Ese uso es exactamente lo que este observatorio combate. Aquí una cuenta solo se etiqueta como bot si hay evidencia técnica de automatización. Disentir, criticar o repetir argumentos de un partido no convierte a nadie en bot.
Diferenciamos cuatro categorías. Cada una tiene criterios técnicos, no políticos. Una cuenta puede caer en varias a la vez (p. ej. un bot operado por una cuenta falsa): en ese caso se etiquetan ambas y se explica la relación.
Cuenta con comportamiento automatizado demostrable.
Esto incluye: publicación programada con patrones no humanos (publicar exactamente cada N segundos sin variación), respuestas en milisegundos a eventos complejos, uso de API no oficial, o hilos generados por plantilla. La mera sospecha no basta: requerimos al menos dos señales técnicas independientes.
No implica intención política. Un bot puede promocionar criptomonedas, spam de marketing o coordinar harassment. La categoría describe el cómo, no el para qué.
Cuenta operada por una persona que persigue hostigar, polarizar o desviar conversaciones.
Hay un humano detrás. No es automatización. El comportamiento típicamente incluye: ataques ad hominem repetidos, hilos diseñados para fragmentar debate, respuesta rápida a figuras públicas con intención de acosar, o coordinación implícita con otros trolls en una narrativa.
Esta categoría es la más difícil de etiquetar y la que más revisión humana requiere. Una cuenta puede ser abrasiva sin ser troll; el patrón sostenido es lo que cuenta.
Identidad fabricada.
Foto de perfil robada o generada por IA, datos biográficos inconsistentes (p. ej. "periodista" sin portfolio verificable), historial de cuenta que no encaja con la persona que dice ser, o conexión técnica con otras cuentas falsas (misma IP de origen, mismo patrón de creación, misma plantilla de bio).
La verificación se hace con búsqueda inversa de imágenes, análisis de consistencia biográfica y revisión de huella digital de la cuenta. Nunca se afirma "falsa" solo por carecer de verificación azul: muchas cuentas legítimas no la tienen.
Conjunto de cuentas que actúan en sincronía de forma que sugiere dirección central.
Esto se detecta por: publicación casi simultánea (ventanas de segundos) del mismo contenido o variaciones menores, uso coordinado de hashtags que no son tendencia orgánica, narrativa común en un periodo corto, o patrones de horario que sugieren un turno de trabajo. No necesariamente son bots: pueden ser humanos pagados.
Esta categoría se aplica al conjunto, no a cuentas individuales. Decir "operador coordinado" requiere identificar al menos 5 cuentas con comportamiento sincronizado sostenido.
Regla editorial fundamental
"Bot" no es persona que discrepa. Nunca etiquetamos como bot a alguien solo por disentir. La categoría requiere evidencia técnica de automatización. Confundir disenso con automatización es exactamente lo que combate este observatorio.
02 · Recolección de datos
De dónde sale la información.
Solo trabajamos con datos públicos. No compramos credenciales filtradas, no accedemos a mensajes privados, no usamos APIs internas filtradas. Toda la información proviene de endpoints públicos de las plataformas o de capturas realizadas por ciudadanos que nos las envían como reporte.
Cada registro capturado lleva: marca de tiempo (UTC), plataforma, URL original del contenido público, método de captura (API oficial, scraping de página pública, reporte ciudadano) y hash del contenido para detectar ediciones posteriores.
Twitter / X
API v2 con bearer token, dentro de los límites del tier gratuito. Capturamos timelines públicos, respuestas a tweets de cuentas de interés público (medios, autoridades, figuras políticas) y mentions de hashtags monitoreados. No capturamos mensajes directos ni datos de cuentas privadas.
Telegram
Solo canales públicos. Usamos la API de bots de Telegram con un bot observador añadido a cada canal monitoreado. No participamos en grupos privados. Los canales se seleccionan por mención en investigaciones previas o por reporte ciudadano verificable.
Bluesky
API atproto pública. Capturamos posts públicos y respuestas en firehose filtrada por cuentas de interés. Bluesky facilita la investigación porque el protocolo es abierto; registramos el DID de cada cuenta (identificador permanente).
Limitado a páginas públicas. No usamos scraping automatizado por restricciones de ToS. Trabajamos principalmente con capturas ciudadanas verificadas y con datos publicados por Facebook en su Transparency Center.
Rate-limit y ética
Respetamos los límites de cada API. No hacemos scraping agresivo. No capturamos datos en masa de cuentas personales sin contexto de investigación. Si una plataforma nos bloquea, lo documentamos y buscamos alternativas públicas; no eludimos el bloqueo.
03 · Criterios de etiquetado
Cómo decidimos la categoría.
Cada etiqueta lleva un grado de confianza entre 0 y 1. No publicamos una etiqueta con confianza menor a 0.7. La confianza se calcula combinando heurísticas automáticas y revisión humana, y se documenta el razonamiento en el expediente interno de cada cuenta.
Las heurísticas que aplicamos se agrupan en tres familias. Una cuenta necesita señales en al menos dos familias para recibir una etiqueta; una sola señal no basta.
A. Señales temporales
Distribución de horarios de publicación (un humano duerme; un bot no), intervalos entre posts (regularidad mecánica vs. variación humana), picos de actividad sincronizada entre cuentas, y publicación en momentos imposibles (mismo segundo, milisegundos de diferencia entre cuentas distintas).
B. Señales de contenido
Repetición de frases idénticas o casi idénticas entre cuentas, uso de plantillas detectables, hashtags que aparecen simultáneamente en cuentas desconectadas, o contenido copiado de fuentes externas (web, otros posts) sin variación. Se mide con similitud de coseno sobre embeddings del texto.
C. Señales de grafo
Estructura de interacciones: cuentas que solo se responden entre sí, clusters densos sin conexión externa, patrones de seguimiento recíproco en masa, o cuentas creadas en la misma ventana de tiempo con biografías similares. Se construye un grafo dirigido y se aplican métricas de centralidad y comunidad.
04 · Limitaciones
Qué no podemos afirmar.
La credibilidad del observatorio depende de declarar sus límites. Esto es lo que no podemos hacer, y por qué.
- 01
No identificamos al operador humano detrás de un bot.
Podemos decir que una cuenta es automatizada. Atribuirla a una persona o institución específica requiere evidencia adicional (p. ej. investigación periodística firmada o informe de autoridad) que no siempre tenemos. No especulamos.
- 02
No afirmamos intenciones.
Describimos el comportamiento observado: "esta cuenta publicó 1.200 veces en 6 horas con plantilla repetida". No decimos "para influir en la elección X" salvo cuando un informe con firma lo atribuye explícitamente.
- 03
No medimos impacto real en opiniones o votos.
Medir si una operación cambió la opinión pública requiere metodología de encuestas que está fuera de nuestro alcance. Reportamos presencia, volumen y patrón, no efecto causal.
- 04
No tenemos cobertura completa.
Monitoreamos 4 plataformas y un conjunto acotado de cuentas y hashtags. Hay desinformación que opera en canales privados (WhatsApp, Telegram cerrados) que no podemos ver. La ausencia de evidencia no es evidencia de ausencia.
- 05
No somos autoridad judicial ni periodística.
Nuestras etiquetas son análisis técnico. No constituyen acusación penal ni reemplazan investigación periodística firmada. Cualquiera puede usar nuestros datos como insumo; la responsabilidad de la atribución final es de quien la hace.
05 · Corrección y retracto
Cómo gestionamos los errores.
Equivocarse es parte del método. Lo que da credibilidad no es no equivocarse, sino corregir visible. Toda corrección lleva fecha, motivo y firma del revisor. Nunca borramos silenciosamente.
Corrección menor
Error de dato, link roto, typo en cifra. Se edita el caso y se añade nota al pie con fecha.
Cambio de categoría de una cuenta o cifra agregada. Se mantiene el original tachado, se añade el nuevo y se explica el motivo.
Retracto
El caso no se sostiene. Se publica una retractación al inicio del caso, se mantiene el contenido original y se explica qué falló.
Si detectas un error, escríbenos a correcciones@operacionbotin.co con la referencia del caso. Respondemos en máximo 7 días hábiles.
06 · Glosario
Términos clave.
- Astroturfing
- Campaña que busca aparentar apoyo popular espontáneo pero que en realidad es coordinada. No requiere bots; puede hacerse con voluntarios reales.
- Brigading
- Coordinación de un grupo para inundar un objetivo (cuenta, hashtag, mención) con mensajes, generalmente para silenciar o acosar.
- Confianza (grado de)
- Número entre 0 y 1 que expresa cuán segura es una etiqueta. No publicamos etiquetas con confianza < 0.7.
- Grafo de interacciones
- Representación matemática de quién responde a quién en una plataforma. Permite detectar clusters y cuentas que solo interactúan entre sí.
- Heurística
- Regla práctica que produce una etiqueta candidata. No es prueba, es señal. Varias heurísticas combinadas sí constituyen evidencia.
- Seudonimización
- Reemplazo del identificador real de una cuenta por uno sintético (p. ej. "@cuenta***01") para proteger identidad mientras se preserva el seguimiento longitudinal.
¿Tienes una cuenta que reportar?
Tu reporte anónimo fortalece el observatorio. Te explicamos qué información necesitamos.
Ir a Verifica