sala.red Desde Bolivia, sala.red investiga, analiza y comenta cómo la tecnología da forma a la sociedad en el sur global.

Poder Análisis

¿Quien controla la IA?

Detrás de cada respuesta hay gente que casi nunca aparece y nunca cobra.

Por — Psicología, Tecnología, cultura e IA

Segunda parte. En la primera vimos que una IA aprende mirando miles de ejemplos. Ahora la pregunta que sigue: de dónde salen esos ejemplos.

Cuando le preguntas algo a una IA parece que contesta sola. No contesta sola. Detrás de esa respuesta hay una cadena de gente, y conviene saber quién está en cada eslabón.

Empieza contigo. Hoy, sin darte cuenta, produjiste datos. Una foto. Un audio de voz. Un comentario. Una búsqueda. Un like. Cada una de esas cosas es material que sirve para entrenar una máquina.

La palabra dato suena a planilla y a números. En realidad un dato es cualquier cosa que se pueda guardar y contar. Tu voz es un dato. Tu cara es un dato. Lo que escribiste en quechua en un chat es un dato, y bastante valioso, porque casi no existe.

¿Esto es un dato?

Toca cada cosa y mira dónde termina.

Probador

Cosas que haces todos los días.

Toca una.

Tú produces datos todos los días. Nadie te paga por eso y casi nunca decides quién los usa.

De dónde saca todo lo que sabe

Los modelos grandes aprendieron leyendo y mirando internet. Millones de páginas, fotos, videos y conversaciones, recogidos de forma automática con programas que se llaman .

rastreador: un programa que recorre internet copiando todo lo que encuentra. Va de enlace en enlace, guarda el texto y las imágenes, y arma un montón gigante de material. Casi nadie le pidió permiso a nadie.

Entonces la pregunta cambia. Ya no es qué sabe la IA. Es qué había en internet cuando la entrenaron.

El mundo no está parejo

Esto es lo que hay publicado, medido en junio de 2026 sobre los sitios web más visitados del planeta.

Contenido web por idioma

Porcentaje de sitios web en cada idioma. Fuente: W3Techs, junio de 2026.

El quechua tiene entre ocho y diez millones de hablantes, más que muchos idiomas europeos con presencia fuerte en internet. En la medición no aparece. El aymara tampoco.

Un idioma con millones de hablantes y sin material digital es invisible para cualquier modelo.

¿Y quién armó esos datos?

Acá viene la parte que casi nadie cuenta.

El material recogido de internet llega sucio y desordenado. Alguien tiene que revisarlo, etiquetarlo y sacar lo que no sirve. Ese alguien es una persona, no un algoritmo.

En 2023, una investigación de la revista TIME reveló que OpenAI subcontrató a la empresa Sama para etiquetar contenido tóxico destinado a entrenar los filtros de ChatGPT. Los trabajadores estaban en Kenia y cobraban entre 1,32 y 2 dólares por hora, leyendo descripciones de violencia y abuso durante toda la jornada.

Esa cadena sigue funcionando. Trabajadores en Kenia, India, Filipinas y Venezuela etiquetan datos, evalúan respuestas y moderan contenido para los modelos que usas. Sin ese trabajo humano la IA no funciona, y casi nunca aparece en la foto.

LA CADENA DEL DATO 1. TU subes, escribes 2. RASTREO copian todo 3. ETIQUETADO gente, 2 USD/h 4. MODELO entrenamiento 5. PRODUCTO te lo venden DONDE QUEDA LA PLATA Pasos 1, 2 y 4: nadie cobra por el material. Paso 3: cobra poco, y es el unico trabajo humano reconocible. Paso 5: aca esta el negocio.

Tu foto entra gratis y sale como producto. En el medio hay gente cobrando dos dólares la hora por el trabajo que hace posible todo lo demás.

Qué hay de Bolivia adentro

Prueba a buscar cada cosa y mira qué encuentra un modelo.

Buscador de huecos

Qué material existe en internet sobre cada tema.

Elige un tema.

El patrón se repite. Lo que fue fotografiado por gente de afuera existe. Lo que se vive todos los días acá, y nadie subió, no existe para la máquina.

Los datos tienen dueño

Si tu comunidad graba sus canciones, sus tejidos o su lengua, eso vale. Y hay que decidir tres cosas antes de subir nada.

Quién puede usarloCualquiera, solo gente de la comunidad, o solo con permiso escrito. Se decide antes, no después de que ya está en internet.
Para qué sí y para qué noSe puede permitir investigación y educación, y prohibir uso comercial o militar. Existen licencias hechas para esto, como las etiquetas de Local Contexts para conocimiento indígena.
Qué pasa si genera plataSi una empresa entrena un modelo con ese material y lo vende, la comunidad tiene derecho a una parte. Eso se escribe en un acuerdo, no se supone.

Subir todo abierto sin acuerdo previo se parece a lo que ya pasó con la música, con los tejidos y con las plantas. El material sale del país y vuelve convertido en producto de otro.

Lo que sí se puede hacer

No hace falta permiso de nadie ni un título de ingeniero.

  1. Graba a tu abuela hablando. Conversación normal, media hora, con buen audio. Eso es un dato que no existe en ninguna parte del mundo.
  2. Fotografía lo cotidiano. La feria, la cocina, el aguayo de todos los días. Lo de la postal ya está. Lo normal no.
  3. Escribe en tu lengua en internet. Un comentario, un post, un subtítulo. Cada texto en quechua o aymara aumenta el material que existe.
  4. Anota siempre qué es. Un archivo sin descripción sirve poco. Qué, quién, dónde, cuándo. Eso se llama metadato y es lo que lo vuelve utilizable.
  5. Acuerda las reglas primero. Con quien aparece en la foto y con la comunidad. Por escrito, aunque sea simple.

Entonces, ¿quién la maneja?

No una sola persona. Cinco grupos, con muy distinto poder.

Los que producimos el material, sin cobrar y casi sin decidir. Los que lo recogen con rastreadores, sin pedir permiso. Los que lo etiquetan, por horas y por monedas. Los que entrenan los modelos, que son un puñado de empresas con dinero para hacerlo. Y los que ponen las reglas, que hasta ahora son las mismas empresas.

La IA no la maneja una máquina. La manejan decisiones de gente, y casi ninguna se toma acá.

La inteligencia artificial no sabe nada que alguien no le haya dado. Todo lo que sabe se lo dio una persona, en algún lado, casi siempre sin cobrar. Lo que subamos nosotros es lo único que va a saber de nosotros.

Sigue en esta serie
  1. ¿Quién controla la inteligencia artificial?
  2. ¿Qué pasa si Bolivia no crea sus propios datos?
  3. ¿Podemos construir nuestra propia tecnología?

Jasmin Jiménez Gonzales.
Estudiante de psicología, 26 años, Cochabamba. Quechua.
Trabaja en el cruce entre psicología, tecnología, cultura e inteligencia artificial.
Producción y desarrollo interactivo: sala.red.

Fuentes: W3Techs, contenido web por idioma, junio de 2026. TIME, investigación sobre etiquetadores de Sama en Kenia, enero de 2023. Ethnologue, hablantes de quechua.

¿Quien controla la IA?