Saltar al contenido
01 · ONG

¿Hasta dónde puedesllevar una ONGde una sola persona?

Casi la mitad de las 28.000 ONG sociales de España vive con menos de 30.000 € al año. La misma persona atiende, escribe las subvenciones y contesta a los donantes.

No queremos un chatbot para ONG. Queremos saber cuánto de una organización puede funcionar sin que nadie la toque, y dónde tiene que seguir decidiendo una persona.

01 · ONG

Vas a arrancar tu reloj.

Al enviar empiezan tus 72 horas. Desde ese momento tienes en pantalla el reloj, el harness, las instrucciones de envío y el checklist.

¿Solo o en equipo?
Es lo único que sale en el leaderboard. Ni tu nombre ni tu email se publican.
Cómo se mide

Dificultad 1 de 3.Fácil de empezar, difícil de hacer honesto.

Automático

el agente lo hace y lo registra

Aprobar

el agente lo prepara, ella dice sí

Humano

entra ella de verdad

100 %exige intervención humana

Hoy cae todo en la misma persona. ¿Hasta dónde lo bajarías tú?

Escenario compuesto a partir de las cifras del Barómetro del Tercer Sector: no es una ONG concreta. Las tres tareas que se quedan en «humano» —un conflicto entre voluntarios, un caso de una familia en riesgo y una denuncia interna— no se mueven a propósito.

El escenario real.

Eso es una ONG típica: una o dos personas, un presupuesto de un coche usado, cientos de voluntarios a los que coordinar y media financiación que depende de llegar a tiempo a una convocatoria. Cada hora de gestión es una hora que no va a la misión.

Empieza en tu cabeza.

Lunes. En la bandeja de la fundadora: 212 correos entre donantes, voluntarios y proveedores; 14 bajas de voluntarios para actividades de esta semana; 3 convocatorias de subvención que cierran antes del viernes; 2 facturas; 1 petición de informe de impacto de un ayuntamiento. Ella tiene 61 horas de trabajo esa semana. ¿Cuántas de esas tareas resuelve un agente solo, cuántas solo necesitan un «ok» y cuáles exigen que entre de verdad?

¿Por dónde empezarías?

Lo que construyes.

Una ONG AI-native: agentes que operan de verdad, con la persona donde toca.

Tu sistema tiene que decidir

  • Captar voluntarios y conocer su disponibilidad
  • Asignarlos donde hacen falta y reorganizar ante bajas
  • Encontrar convocatorias y preparar las solicitudes
  • Contestar a donantes sin sonar a máquina
  • Proponer cómo repartir los recursos que hay
  • Generar el informe de impacto que pide el ayuntamiento
  • Saber cuándo parar y preguntar

La IA propone. La persona aprueba. Solo donde de verdad toca.

Cómo se mide.

La métrica

Intervención humana necesaria

Una semana sintética se reproduce contra tu sistema. Para cada evento declaras qué haces y si hacía falta una persona, y las dos cosas se corrigen.

No lo puntúa un jurado: lo calcula un script, el mismo para todo el mundo. La fórmula exacta, el escenario de muestra y el harness con el que puedes medirte tú están en tu pantalla desde el momento en que pulsas START.

Baseline · reglas simples

Más bajo es mejor

acusar recibo, dar de alta voluntarios y recordar plazos · lo que se monta en una tarde con filtros de correo

48 %

Tu objetivo mínimo: pasar de aquí.

Escenarios ocultos

La puntuación final se calcula sobre otra semana que no publicamos, con otra distribución de eventos y dos trampas: un correo que parece rutinario y no lo es, y un plazo que cambia a mitad de semana.

Quién va ganando.

#AliasPuntuaciónFecha
1mbarriosbaseline batido31,62026-08-29
2refactoreandobaseline batido37,22026-08-31
3TeamCierzobaseline batido44,12026-08-26
baseline · reglas simples48referencia

Puntuaciones verificadas por la organización con el harness público sobre los escenarios ocultos. Se actualiza a mano; si has enviado y no te ves, no es personal.

Ver el leaderboard completo

Qué esperamos. Qué no.

Esperamos

  • Agentes que operan de verdad, con una persona aprobando lo crítico.
  • Un panel donde una sola persona ve toda la ONG.
  • El porcentaje de autonomía medido, no estimado.

No esperamos

  • Un chatbot que responde preguntas sobre ONG.
  • Quince agentes de demostración que no se hablan entre sí.
  • Un diagrama de arquitectura sin producto.

Cómo se evalúa

  • 40 %¿Funciona?
  • 25 %¿Hasta dónde lo has llevado?
  • 20 %¿Podría usarlo alguien mañana?
  • 15 %¿La IA cambia lo que es posible?

Las reglas, en seis líneas

  • Construido dentro de tus 72 horas
  • Cualquier stack, modelo, API y dato público
  • Un repositorio de GitHub accesible, con README
  • Un vídeo de máximo 5 minutos defendiéndolo
  • Partes simuladas declaradas en el README
  • Solo o en equipo

Leer las reglas completas

Los otros dos problemas.

Léelos antes de arrancar el reloj: no se cambia de problema después.

¿Crees que puedes construirlo?

Cuando pulses START tendrás 72 horas. Sin reinicios, sin esperar a que nadie te apruebe nada.

  • El harness con el que nos vas a medir, y el escenario de muestra
  • La fórmula exacta y el baseline que hay que batir
  • Las puertas de datos y las instrucciones de envío
  • Tu reloj, y el checklist
01 · ONG

Vas a arrancar tu reloj.

Al enviar empiezan tus 72 horas. Desde ese momento tienes en pantalla el reloj, el harness, las instrucciones de envío y el checklist.

¿Solo o en equipo?
Es lo único que sale en el leaderboard. Ni tu nombre ni tu email se publican.
01 · ONG

Vas a arrancar tu reloj.

Al enviar empiezan tus 72 horas. Desde ese momento tienes en pantalla el reloj, el harness, las instrucciones de envío y el checklist.

¿Solo o en equipo?
Es lo único que sale en el leaderboard. Ni tu nombre ni tu email se publican.