El Proyecto SAMUEL (3 en Raya con Q-Learning) es una propuesta de la línea THEMIS en el IES Monterroso para enseñar Aprendizaje por Refuerzo (Reinforcement Learning) sin recurrir a modelos de lenguaje ni redes neuronales preentrenadas. El alumnado comprueba cómo un agente que arranca en blanco (Tabula Rasa) aprende a jugar al 3 en raya mediante partidas simuladas contra sí mismo. La aplicación despliega en tiempo real la Q-Table y un mapa de calor con los valores $Q(s,a)$, demostrando de forma transparente cómo la IA toma decisiones basadas en premios y castigos acumulados.

