Math Challenge
Más

Clubs, retos de grupo y prendas: cómo tener apuestas sin perdedor y sin exposición regulatoria

mc-46 · Publicado: · de Math Challenge Research · 4552 palabras · 7 fuentes citadas

Resumen ejecutivo

478 palabras

Este documento fue traducido del original en inglés por Claude (Anthropic) y verificado automáticamente contra la fuente: cada número, URL, marcador de cita y marca [unverified] coincide con el original. La prosa todavía no ha sido revisada por un hablante nativo humano.

Estado de verificación

Este documento no lleva ninguna marca [unverified]. Cada afirmación está atada a una fuente numerada de abajo.

[unverified] quiere decir que la afirmación está en la investigación pero no se confirmó contra una fuente primaria en la sesión que la produjo. Se publica en vez de borrarse, porque un corpus que esconde sus huecos no es verificable.

Cómo se produjo esta investigación

Los 47 documentos se hicieron el 2026-07-31 por agentes independientes, cada uno con instrucción explícita de no inventar citas y de marcar como [unverified] lo que no pudiera confirmar contra una fuente primaria. La cuota de búsqueda web de la sesión se agotó a media investigación y los agentes posteriores trabajaron por descarga directa contra fuentes primarias. Varios sitios (ftc.gov, ico.org.uk) bloquean la descarga automatizada, y por eso ciertas afirmaciones legales están marcadas a propósito.

Hallazgos

1. Los tres elementos, y cómo se elimina uno

Thompson Coburn LLP resume el marco que gobierna todo esto: prácticamente toda ley estatal define el juego ilegal como la presencia simultánea de premio, azar y consideración, y los tres deben estar presentes para que una promoción califique como juego ilegal [1]. La estrategia entera de la industria de sorteos consiste en asegurarse de eliminar al menos uno.

Cómo se elimina cada uno, según la misma fuente [1]:

Dónde queda Math Challenge. El azar está ausente por la naturaleza del producto: resolver retos matemáticos es un criterio medible de destreza, no suerte. La consideración está ausente mientras la plataforma no cobre por entrar a un reto ni retenga, transfiera o haga cumplir nada de valor. Y con las formas de prenda propuestas abajo (§3), el premio se reduce a agencia o a una experiencia compartida, es decir, cerca del umbral de “derecho a presumir”.

Faltan dos de tres, posiblemente los tres. Pero esa posición depende enteramente de que la plataforma nunca toque valor. El día que Math Challenge retenga $20 de cada participante, aparece la consideración y el análisis se invierte por completo. Esa es la línea, y no es difusa.

2. El precedente que ya existe: Strava Group Goal

Strava opera cuatro tipos de reto de grupo: Most Activity (quien acumule más tiempo, distancia o desnivel), Fastest Effort (ritmo promedio), Longest Single Activity, y Group Goal (perseguir una meta compartida como grupo) [2][3]. Los primeros tres son competitivos con tabla de posiciones; el cuarto no.

La descripción de Strava del modo cooperativo es la observación de diseño más útil de toda esta investigación: “Si competir con tus amigos no es tu estilo, puedes crear un reto de Group Goal para ir avanzando juntos hacia una meta compartida. Esta versión del reto grupal no tiene tabla de posiciones, así que terminas comparándote menos con los demás [3].

Dos lecturas importan. Primero, la ausencia de tabla es la función, no una limitación — es lo que hace que el modo sirva a quien la competencia desmotiva, que es exactamente la población que mc-18 identifica como la que se desengancha en el fondo del tablero. Segundo, Strava lo ofrece junto a los competitivos, no en lugar de: la elección de modo la hace el organizador del reto según su grupo. Análisis de la propia plataforma señalan que los retos grupales priorizan la conexión sobre la competencia pura y sostienen la comunidad [2].

Esto converge con lo que ya está en mc-18: el meta-análisis de Johnson & Johnson (122 estudios, 286 hallazgos) encuentra que las estructuras cooperativas superan consistentemente a las competitivas e individualistas tanto en logro como en relaciones entre pares.

3. Qué hace divertida una apuesta, descompuesto

Antes de proponer formas, vale descomponer qué produce el disfrute de una apuesta social. Cuatro cosas: que todos tengan algo en juego, que el resultado importe, que quede una anécdota, y que el grupo haya hecho algo junto.

Ninguna de las cuatro requiere un perdedor. El castigo al último no es el ingrediente activo — es una consecuencia de asumir, sin examinarlo, que la prenda tiene que caer sobre alguien. De esa observación salen tres formas que conservan las cuatro propiedades:

A · Prenda colectiva. El grupo se compromete junto contra una meta compartida. Se gana o no se gana en grupo. Es el Group Goal de Strava aplicado a puntos de matemáticas, con el respaldo cooperativo de Johnson & Johnson.

B · El ganador elige. Se invierte la dirección del premio: el primer lugar no recibe tributo de los demás, sino que decide algo para el grupo — el próximo reto, la meta del club, el lugar a donde van. El premio es agencia, no tributo. Legalmente es la forma más limpia, porque decidir no tiene valor monetario y roza el umbral de “derecho a presumir” que [1] señala como probablemente insuficiente para constituir premio.

C · Compromiso propio. Cada quien se apuesta contra su propia meta, públicamente. Es la forma mejor respaldada por evidencia: son las intenciones de implementación de Gollwitzer ya documentadas en mc-19, con efectos grandes y replicados (100% vs. 53% de cumplimiento en autoexámenes; 4,2 kg vs. 2,1 kg de pérdida de peso). Es también, no por casualidad, el mecanismo con el que HealthyWage sostiene que no es juego: su argumento público es que el usuario controla el resultado en todo momento [6].

4. La propiedad estructural que hace innecesaria la moderación

Las tres formas comparten algo que vale más que cualquier regla de moderación: ninguna tiene una casilla de perdedor.

En ninguna de las tres existe un campo que responda a “¿qué le pasa al último?”. Esto significa que el texto libre puede existir sin que la humillación tenga dónde aterrizar: no es que se prohíba escribirla, es que no hay ranura en el modelo de datos donde ponerla. Es la misma lógica estructural con la que mc-43 resuelve los alias (elección dentro de un conjunto acotado en vez de entrada libre), aplicada un nivel más arriba: en vez de acotar el vocabulario, se acota el objeto sobre el que el texto puede hablar.

Riesgo residual, dicho de frente. Esto no es hermético. Alguien puede escribir, dentro de una prenda colectiva, “vamos por tacos y Juan se rapa”. Lo que la estructura garantiza es que el sistema nunca designe a Juan, nunca lo señale y nunca lo haga cumplir — la prenda sigue siendo del grupo. Ese hueco es el que cierra Larry en §5, y lo que queda después se mitiga por procedimiento: la prenda es visible antes de que empiece el reto, todos los miembros la aceptan explícitamente para quedar dentro, cualquiera puede salirse sin penalización, no se puede editar una vez arrancado, y hay botón de reporte permanente. Con eso, nadie queda sujeto a una prenda que no leyó y aceptó.

5. Larry como moderador de prendas

Decisión del dueño: el texto libre de las prendas lo revisa Larry antes de que la prenda exista, con criterio explícito de juego entre adultos — la broma pasa; el sexo, la violencia y lo denigrante no.

Esto no rompe el canon de “Larry nunca calcula”. Esa regla, documentada en mc-37 y D-004, existe por una razón específica: un tutor que recalcula matemáticas se equivoca y enseña error. Juzgar si un texto es denigrante es una tarea distinta, y es de las que los modelos de lenguaje hacen bien. Lo que sí se hereda es que es otra llamada, no la misma: prompt propio, modelo propio, bitácora propia, y ninguna relación con el endpoint del tutor.

El criterio que Larry aplica, en orden de precedencia:

  1. ¿Señala a una persona? Una prenda que nombra a un individuo como quien carga la consecuencia se rechaza, aunque venga en tono de broma. Es la única regla que no admite matiz, porque es la que sostiene la línea roja del producto.
  2. ¿Hay sexo, violencia o denigración? Se rechaza. Incluye lo que degrada por apariencia, peso, origen, capacidad o cualquier característica de una persona — el canon de Larry ya prohíbe que el humor vaya sobre características de las personas (mc-37), y aquí se extiende de lo que Larry dice a lo que Larry deja pasar.
  3. ¿Es un juego entre adultos? Si pasa 1 y 2, pasa. Larry no es un censor de buen gusto: “el que gana escoge el bar”, “el club paga la primera ronda”, “el ganador elige la playlist un mes” son prendas legítimas y Larry no tiene por qué opinar sobre ellas.

El tono al rechazar importa tanto como el rechazo. Larry no sermonea. mc-11 es explícito en que la retroalimentación dirigida a la persona en vez de a la tarea es el mecanismo por el cual más de un tercio de las intervenciones estudiadas empeoran el resultado — y aunque ese hallazgo es sobre aprendizaje, el mecanismo social es el mismo: un rechazo moralizante convierte a un adulto en adversario del producto. Larry rechaza breve, en personaje, sin lección: “Esa se la voy a tener que rebotar — deja al grupo entero en la prenda, no a uno solo. ¿Le damos otra vuelta?”

Comportamiento a prueba de fallos. Si la llamada de moderación falla o expira, la prenda no se publica. Se muestra que Larry no pudo revisarla y se ofrece reintentar. Nunca se publica texto sin revisar bajo ninguna condición de error — el modo de falla barato es un usuario molesto, el modo de falla caro es una humillación publicada que el producto prometió que no podía ocurrir.

Ruteo y costo. El volumen es trivial comparado con el del tutor: una llamada por prenda creada, no por intento. Haiku 4.5 alcanza para el caso claro, con escalada a Sonnet 5 cuando el veredicto sea de baja confianza — el matiz entre “broma entre amigos” y “denigración” es justo donde un modelo chico se equivoca en ambas direcciones. Con el ruteo de D-015 y el tope de gasto de AI Gateway, esto no mueve la aguja del presupuesto.

Falsos positivos y apelación. Larry se va a equivocar, y va a rechazar bromas legítimas. Sin vía de apelación, eso se siente como censura y es la queja que va a llegar. Toda prenda rechazada debe poder mandarse a revisión humana con un toque, y esa cola necesita dueño y tiempo de respuesta comprometido — la misma cola de los reportes.

Bitácora. Cada decisión se registra: texto propuesto, veredicto, modelo, motivo y confianza. Sirve para tres cosas: afinar el prompt con casos reales, resolver apelaciones con evidencia, y detectar a quien insiste en pasar lo mismo diez veces con variantes.

6. Los clubs de padres y el estándar real de salvaguarda

La literatura de deportes juveniles es la referencia más cercana a “un adulto organiza una actividad para niños ajenos”. El estándar general que reporta: se requiere verificación de antecedentes para “any volunteer with the opportunity for unsupervised or one-on-one contact with minors” — incluyendo a padres coordinadores que organizan actividades o manejan comunicaciones que involucran contacto con niños [4][5]. Una verificación mínima cubre antecedentes penales federales y registro de ofensores sexuales; se recomienda repetirla cada año o cada temporada, con consentimiento escrito previo [4][5]. Y estructuralmente: debe existir una persona nombrada, cuyo nombre y contacto conozcan todos, como primer punto de contacto ante cualquier preocupación de salvaguarda [5].

Math Challenge no puede correr verificación de antecedentes, y fingir lo contrario sería peor que no hacerlo. Pero la definición misma señala dónde está el riesgo: contacto no supervisado. La salida de diseño es eliminar la categoría entera:

La afirmación honesta que sale de esto: un club de padres es seguro precisamente porque es anémico. Es un tablero compartido, no un espacio social. Cada vez que alguien proponga agregarle chat, fotos o perfiles, la respuesta ya está escrita aquí, con su razón.

7. Por qué dos sistemas y no uno con bandera

grupo_infantil (que cubre salón de maestro y club de padres, con reglas de seguridad idénticas) y club_adulto (con retos y prendas) deben ser estructuras separadas en la base de datos, no una tabla con un campo tipo.

La razón no es de modelado sino de modo de falla. Con una sola tabla, el día que alguien agregue texto libre, mensajes o subida de imágenes a “los clubs”, esa función aterriza por defecto también sobre los grupos infantiles, y la protección depende de que quien escriba ese código recuerde la regla. Con dos estructuras, agregar texto libre al club de adultos no puede tocar a los niños aunque nadie recuerde nada. Es la diferencia entre una convención y un candado.

Tabla de formas de prenda

FormaQuién carga la consecuenciaTabla de posicionesRespaldoElemento legal que elimina
A · ColectivaEl grupo entero, juntoNo (por diseño)Strava Group Goal [2][3]; Johnson & Johnson vía mc-18Premio (experiencia compartida, sin transferencia)
B · El ganador eligeNadie; el primero gana agenciaThompson Coburn sobre premios intangibles [1]Premio (decidir no tiene valor monetario)
C · Compromiso propioUno mismo, contra su propia metaOpcionalGollwitzer vía mc-19; postura de HealthyWage [6]Azar (controlas tu resultado por completo)
Castigo al últimoEl que quedó atrásProhibido: línea roja #7, mc-18 sobre daño en el fondo del tablero
Tributo entre miembrosLos perdedores pagan al ganadorProhibido: crea premio + transferencia de valor entre personas

Implicaciones de diseño

  1. Ningún menor entra jamás a un reto con prenda. Los grupos infantiles tienen metas y celebraciones; las prendas viven exclusivamente en club_adulto. Esto saca a los niños de todo el análisis de §1.
  2. La plataforma nunca toca valor: no cobra por entrar a un reto, no retiene, no transfiere, no arbitra y no hace cumplir. La prenda es un acuerdo social que el producto muestra, no una obligación que el producto administra. Es la única condición que sostiene la posición de §1.
  3. Las tres formas de prenda (A, B, C) se implementan como tipos distintos, no como variantes de texto de un mismo objeto — porque cada una tiene un sujeto gramatical distinto (el grupo, el ganador, uno mismo) y es esa diferencia la que elimina la casilla de perdedor (§4).
  4. No existe ningún campo que pregunte qué le pasa al último, en ninguna forma, en ninguna pantalla, en ninguna API.
  5. Larry revisa toda prenda de texto libre antes de que exista, con el criterio de tres pasos de §5: señalar a una persona se rechaza siempre, sexo/violencia/denigración se rechazan, y todo lo demás pasa sin que Larry opine.
  6. La moderación es una llamada separada de la del tutor — prompt propio, bitácora propia, ruteo propio (Haiku 4.5 con escalada a Sonnet 5 en baja confianza). No comparte endpoint ni prompt con Larry Profe.
  7. A prueba de fallos: si Larry no puede revisar, la prenda no se publica. Nunca hay texto sin revisar en producción, bajo ninguna condición de error.
  8. Larry rechaza breve y en personaje, sin sermón — un rechazo moralizante convierte al adulto en adversario del producto, y el canon de Larry ya prohíbe el tono condescendiente (mc-11, mc-37).
  9. Toda prenda rechazada tiene apelación a revisión humana con un toque. Larry va a rebotar bromas legítimas, y sin apelación eso se siente como censura.
  10. Toda prenda se acepta explícitamente por cada miembro antes de que arranque el reto, es visible desde antes, no se puede editar después de arrancar, y cualquiera puede salirse del reto sin penalización ni señalamiento (§4).
  11. Botón de reporte permanente en cada prenda y cada club, con revisión humana — la segunda capa, para lo que Larry deje pasar.
  12. Dos estructuras de datos separadas, grupo_infantil y club_adulto, para que ninguna función social agregada a los adultos pueda alcanzar a los niños por omisión (§7).
  13. El dueño de un grupo infantil ve alias, puntos y racha. Nada más. Ni nombre real, ni edad exacta, ni pertenencia a otros grupos.
  14. Cero canal privado adulto-niño, en cualquier grupo infantil, sea de maestro o de padre — la mitigación directa contra lo que §6 identifica como el riesgo real.
  15. El padre de cada niño aprueba, viendo antes la identidad declarada del dueño del club, con insignia visible cuando esa identidad no está verificada.
  16. Tope de tamaño de club infantil menor que el de salón, y límite de clubs por cuenta, porque la creación ilimitada de grupos es la palanca que un abusador usaría.
  17. Bitácora completa y visible para el padre de quién pidió acceso, quién aprobó y cuándo — el análogo del “contacto de salvaguarda nombrado” que [5] exige, adaptado a un producto sin personal.
  18. No presentar el club de padres como equivalente a la supervisión de un club deportivo real. Copy honesto: es un tablero compartido entre familias que ya se conocen, no un programa supervisado.
  19. Registrar la posición legal de §1 por escrito y revisarla con abogado antes de habilitar prendas en cualquier mercado — este documento es investigación, no asesoría legal, y la conclusión “faltan dos de tres elementos” depende de hechos de producto que un cambio de roadmap puede invalidar.

Preguntas abiertas para el dueño del proyecto

  1. ¿Un adolescente de 12-17 puede estar en un club_adulto? La respuesta por defecto de este documento es no (implicación 1), pero eso cierra el caso de un grupo de primos o de compañeros de prepa.
  2. ¿El catálogo de prendas arranca vacío con texto libre desde el día uno, o se siembra con ejemplos curados que muestren el tono esperado? Sembrarlo es la forma barata de comunicar la norma sin prohibirla.
  3. ¿La aceptación explícita de la prenda (implicación 5) es por reto o una sola vez por club? Por reto es más seguro y más molesto.
  4. ¿Los retos de club de adultos afectan el tablero global, o viven aislados en el club? Si afectan, hay que revisar el control de exposición de ítems de mc-29.
  5. ¿Quién atiende la cola de apelaciones y reportes (implicaciones 9 y 11), y con qué tiempo de respuesta comprometido? Es la misma persona para las dos colas o son dos.
  6. Cuando Larry rechaza una prenda, ¿le dice al autor cuál de las tres reglas rompió, o solo que no pasó? Decirlo ayuda a corregir; también enseña a esquivar el filtro.
  7. ¿El prompt de moderación de Larry se autora por idioma o se traduce? Lo denigrante es fuertemente cultural — lo que en México es una broma entre cuates en Alemania puede no serlo, y al revés.
  8. ¿Se permite que un club infantil mezcle hijos de varias familias que no se conocen entre sí, o se limita a familias que ya tienen un vínculo previo? Es la diferencia entre un riesgo acotado y uno abierto.

Fuentes

  1. Thompson Coburn LLP, "Shield your sweepstakes from gambling laws"
  2. Strava Community Hub, "Combining Competition and Collaboration with Group Challenges"
  3. Strava Support, "Group Challenges"
  4. JDP, "The Ultimate Guide to Background Checks for Youth Sports Volunteers"
  5. TidyHQ, "SafeSport Compliance Checklist for US Youth Sports Organizations"
  6. HealthyWage, HealthyWager FAQ
  7. Investigación interna: 2026-07-31-mc-18-leaderboards-competition.md (Johnson & Johnson sobre estructuras cooperativas; daño concentrado en el fondo del tablero), 2026-07-31-mc-19-habit-loops-push-notifications.md (intenciones de implementación de Gollwitzer), 2026-07-31-mc-28-teacher-classroom-mode.md (el hueco de verificación del maestro, T-5), 2026-07-31-mc-43-avatars-identity-progression.md (elección acotada en vez de entrada libre), 2026-07-31-mc-17-ethical-gamification-dark-patterns.md (exposición regulatoria de mecánicas de azar con menores), 2026-07-31-mc-37-larry-profe-port.md (canon de Larry, ruteo de modelos, el patrón de llamada separada), 2026-07-31-mc-11-feedback-formative-assessment.md (por qué el rechazo moralizante es contraproducente)

Preguntas que este documento le deja abiertas al dueño

Están sin responder a propósito. Se listan, no se resuelven — convertirlas en preguntas frecuentes obligaría a inventar respuestas que el documento no tiene.

Uno de 51 documentos de investigación, 168.346 palabras en total, contadas en el build sobre los archivos mismos. Leer este documento en el repositorio