Cómo funcionan los niveles

Bandas de práctica de lectura en español

MindCraft genera y filtra automáticamente las oraciones de español con un motor propio del español. No genera una oración inglesa para después traducirla. Las bandas ayudan a controlar la práctica; no equivalen a grados escolares, niveles oficiales, diagnósticos ni resultados prometidos.

Estado de validación: la versión spanish-latam-1.2.0 es una beta transparente basada en reglas. El banco de regresión pasa los límites automáticos, pero la revisión por especialistas de alfabetización en español y la calibración con una muestra representativa siguen pendientes.

Qué medimos y qué mantenemos separado

Dificultad del texto

Vocabulario, sílabas ortográficas estimadas, acentuación, patrones de escritura, morfología, longitud, cláusulas y estructura.

Lectura oral observada

Coincidencia de palabras, con velocidad o prosodia solo cuando existe evidencia suficiente. No es la dificultad del texto.

Pronunciación

Una señal aparte con su propia incertidumbre. La transcripción automática no es una grabación verdadera de lo que dijo la persona.

Comprensión

Se registra solo con una tarea de significado separada; pronunciar las palabras no demuestra comprensión.

El ERCE de UNESCO evalúa comprensión literal, inferencial y crítica mediante preguntas ligadas a textos; por eso una coincidencia oral no se presenta como comprensión. Ese estudio regional de 3.º y 6.º no valida las bandas de MindCraft. [ES-CONSTRUCT-01]

Las diez bandas de práctica

Las diez bandas y sus fronteras numéricas son decisiones de producto versionadas. Las bandas 7-10 exigen palabras de ortografía poco transparente, como hierro o hielo. Cada una fija un máximo de palabras, sílabas estimadas por palabra, vocabulario desconocido, morfología y complejidad de oración para evitar saltos bruscos después de una sola sesión buena. [ES-BANDS-01]

Banda 1: Palabras iniciales

13 palabras

Palabras familiares y frases muy breves con ortografía controlada.

Banda 2: Oraciones breves

46 palabras

Oraciones completas cortas con vocabulario frecuente y sintaxis directa.

Banda 3: Oraciones conectadas

58 palabras

Oraciones simples más largas con flexión y ortografía más variadas.

Banda 4: Texto en desarrollo

710 palabras

Ideas conectadas, formas flexionadas y coordinación controlada.

Banda 5: Oraciones complejas

913 palabras

Ideas de varias partes con subordinación y vocabulario menos frecuente.

Banda 6: Texto avanzado

1116 palabras

Práctica sintácticamente más rica con vocabulario técnico o abstracto.

Banda 7: Ortografía opaca

1216 palabras

Debe incluir al menos una palabra de ortografía poco transparente, como hierro o hielo.

Banda 8: Familias irregulares

1317 palabras

Debe incluir dos palabras con h muda u otra ortografía poco transparente.

Banda 9: Morfología densa

1418 palabras

Oraciones más largas con derivación y al menos una palabra de ortografía poco transparente.

Banda 10: Discurso extendido

1520 palabras

Las oraciones más largas, con dos palabras poco transparentes y varias cláusulas.

Reglas propias del español

  • El tokenizador conserva ñ, diéresis y vocales con tilde, y verifica la pareja de signos ¿? y ¡!. RAE-ASALE aporta la referencia descriptiva exacta para las formas de apertura y cierre. [ES-PUNCT-01]
  • La estimación silábica distingue vocales abiertas y cerradas, diptongos, triptongos e hiatos escritos, incluidas las vocales cerradas tónicas y las vocales iguales. Es una aproximación de la escritura, no una predicción de pronunciación regional. [ES-ORTHO-01]
  • La carga morfológica considera flexión y derivación como señales distintas. La evidencia en cuarto grado hispanohablante relaciona la conciencia morfológica con comprensión, no con exactitud de pronunciación; nuestra lista de sufijos sigue siendo un filtro reducido pendiente de revisión, no un analizador completo. [ES-MORPH-01]

Español latinoamericano y vocabulario

“Español latinoamericano ampliamente comprensible” es una política de lanzamiento, no la afirmación de que exista un único español neutro. Evitamos regionalismos opacos en el banco inicial y conservamos la variedad regional como una limitación que debe probarse. El diseño panhispánico del CORPES XXI informa nuestra obligación de representar variedades, pero no convierte la frecuencia del corpus en familiaridad infantil ni valida nuestro vocabulario. [ES-VARIETY-01]

La lista de vocabulario de esta beta es pequeña, explícita y por niveles internos. No usamos una lista inglesa traducida ni presentamos rangos de corpus como currículo infantil. La revisión con especialistas de distintos países y con lectores representativos está pendiente.

Registro de afirmaciones y evidencia

Versión methodology-evidence-1.0.0. Cada registro limita la afirmación al alcance de la fuente y marca por separado las decisiones de producto.

ES-CONSTRUCT-01: Leer palabras en voz alta no demuestra por sí solo comprensión literal, inferencial o crítica.

official-guidance

Alcance respaldado: ERCE 2019 evaluó esas categorías de comprensión con preguntas ligadas a textos variados.

No establece: ERCE es una evaluación regional de 3.º/6.º y no valida las bandas, elementos ni puntajes orales de MindCraft.

Estado: source-checked

ES-PUNCT-01: Los signos de interrogación y exclamación del español tienen formas de apertura y cierre que delimitan la secuencia afectada.

official-language-reference

Alcance respaldado: RAE-ASALE aporta la convención ortográfica descriptiva que comprueba el validador de parejas de signos de MindCraft.

No establece: Esta convención no valida la calidad de la oración, la dificultad lectora, el habla regional ni las bandas de MindCraft.

Estado: source-checked

ES-ORTHO-01: El motor español usa una estimación silábica ortográfica que distingue diptongos, triptongos e hiatos escritos.

official-language-reference

Alcance respaldado: RAE-ASALE define las convenciones vocálicas escritas usadas por la heurística, incluidas vocales cerradas tónicas e hiatos; Casillas y Goikoetxea aportan evidencia de alfabetización temprana en español de que la conciencia fonológica silábica es relevante para el desarrollo de la lectura y la escritura.

No establece: Ninguna fuente valida la heurística ni los máximos silábicos de MindCraft: las convenciones ortográficas no predicen toda pronunciación regional y el estudio infantil no prueba los elementos ni umbrales de MindCraft.

Estado: source-checked

ES-MORPH-01: La morfología española puede aportar información distinta de la decodificación y no debe reducirse a una secuencia de sufijos inglesa.

primary-study

Alcance respaldado: Un estudio con estudiantes hispanohablantes de cuarto grado relacionó la conciencia morfológica directamente con comprensión, no con exactitud de pronunciación.

No establece: El estudio no valida la lista de sufijos, los conteos, las bandas ni efectos causales de aprendizaje de MindCraft.

Estado: specialist-review-pending

ES-VARIETY-01: Una política latinoamericana de lanzamiento debe conservar la variedad regional como limitación, no afirmar un único español neutro.

official-language-reference

Alcance respaldado: CORPES XXI documenta un muestreo panhispánico con mayoría de material americano y zonas geográficas explícitas.

No establece: La representación del corpus no establece familiaridad infantil, secuencia didáctica ni los niveles de vocabulario de MindCraft.

Estado: source-checked

ES-BANDS-01: Las diez bandas españolas, niveles de vocabulario, fronteras numéricas y límites duros son decisiones de diseño versionadas de MindCraft.

product-design

Alcance respaldado: La implementación propia del español es determinista y tiene pruebas de regresión.

No establece: Ningún estudio valida todavía estas reglas como grado, nivel MCER/DELE, diagnóstico o enseñanza óptima.

Estado: product-calibration-pending

Decisión de producto; no se atribuye a una fuente externa.

Cómo se elige una oración

  1. 1. Se fija la banda. El puntaje almacenado se migra de forma determinista a una banda española versionada.
  2. 2. Se traduce el contexto del juego, no la oración. Un bloque, entidad, bioma o momento puede aportar palabras españolas aprobadas. Identificadores ingleses desconocidos se descartan.
  3. 3. Se redacta directamente en español. El modelo recibe límites y vocabulario españoles.
  4. 4. Se vuelve a comprobar. Solo se guarda y se sirve lo que pasa el límite duro español. Si falla, se usa un elemento español exacto del banco de regresión.
  5. 5. La traducción de apoyo es posterior. Puede ayudar a una persona angloparlante, pero no decide la dificultad del texto español.

Cuatro recorridos, sin mezclar niveles

Lectura nativa en inglés, lectura nativa en español, inglés→español y español→inglés son contratos distintos. La lengua que se practica elige el motor de dificultad del texto. Los recorridos de segunda lengua tienen además progresiones, bancos, reglas de apoyo y evidencia propios, documentados con sus fuentes y límites en la metodología bilingüe de segunda lengua.

Limitaciones conocidas

  • Los límites son hipótesis de producto, no equivalencias con grados escolares ni niveles oficiales.
  • La revisión por especialista nativo de alfabetización y la calibración representativa siguen pendientes.
  • El silabeo, la acentuación y la morfología automáticos son aproximaciones ortográficas y pueden fallar.
  • La lista de vocabulario inicial no representa todavía toda la variación regional, cultural o de edad.
  • Las reglas no pueden confirmar por sí solas naturalidad, significado, exactitud de Minecraft o conocimiento previo.
  • MindCraft todavía no ha publicado estudios propios de fiabilidad, equidad, comprensión o resultados de aprendizaje.
  • MindCraft no diagnostica dislexia ni condiciones del habla, lenguaje o aprendizaje.

Versión y registro de cambios

Metodología
spanish-latam-1.2.0
Publicación
14 de agosto de 2026
Revisión
Propietario del producto; revisión externa de alfabetización en español pendiente
Cambios
Diez bandas sin edad. Las bandas 1-5 conservan sus fronteras. Las bandas 7-10 exigen ortografía poco transparente. Siguen el motor español paralelo, la tokenización Unicode, el silabeo, la morfología y el banco de regresión.