Metodología
Esta página explica cómo funciona GradPrepIA por dentro: de dónde salen las preguntas, cómo las validamos, cómo calculamos los puntajes y —lo más importante— qué no puede hacer nuestro sistema. La escribimos porque una plataforma de preparación que no explica su método le pide al estudiante una confianza que no se ganó.
De dónde salen las preguntas
Todo nuestro contenido es original. Reproducir preguntas oficiales de ETS o del consorcio IELTS es una infracción de derechos de autor, y además es mala preparación: el examen real nunca te dará esa pregunta.
Lo que replicamos son los formatos públicos: la estructura de un text completion de dos blancos, las cuatro opciones fijas de un quantitative comparison, la lógica de True / False / Not Given, el formato de una cue card. Esos formatos están documentados abiertamente por los dueños de cada examen y son lo que efectivamente hay que entrenar.
Las preguntas se generan con Claude, de Anthropic, a partir de plantillas por sub-skill que fijan el formato, el nivel de dificultad y el tipo de razonamiento evaluado. Cada pregunta generada incluye:
- El enunciado y las alternativas.
- La clave correcta.
- Una justificación por alternativa: no solo por qué la correcta lo es, sino por qué cada distractor no lo es. Esto es deliberado: aprender por qué te equivocaste vale más que saber cuál era la buena.
- Etiquetas de sección, sub-skill y dificultad, que son las que alimentan tus estadísticas.
Cada pregunta que un usuario genera se suma al banco compartido, así que la plataforma mejora con el uso.
Validación: el doble pase en Quant
Las preguntas de matemática tienen un modo de fallar particularmente dañino: un error aritmético produce una pregunta que parece correcta, con una clave equivocada. Un estudiante que la responde bien la ve marcada como error y aprende algo falso.
Por eso todo ítem de Quantitative Reasoning pasa por una segunda revisión antes de entrar al banco:
- Un segundo modelo recibe el ítem sin la clave, solo el enunciado y las alternativas.
- Lo resuelve desde cero, paso a paso.
- Comparamos su respuesta con la clave original. En los ítems de respuesta numérica la comparación es numérica, no textual, para no descartar un
0.5frente a un1/2. - Si las dos pasadas no coinciden, el ítem se descarta. No se corrige ni se marca como dudoso: se bota.
Preferimos un banco más chico y correcto que uno grande con errores. El costo de esta decisión es real —descartamos una fracción de lo que generamos— y lo asumimos.
En Verbal y en Reading el criterio de corrección es interpretativo, no aritmético, así que el segundo pase no aplica del mismo modo; ahí la validación descansa en la estructura del prompt y en el reporte de los usuarios.
Corrección de respuestas escritas
El Listening y el Reading del IELTS incluyen respuestas escritas, no solo alternativas, y una corrección literal por igualdad de strings sería injustamente estricta. Nuestro corrector acepta:
- Mayúsculas y minúsculas indistintamente.
- Ortografía británica y estadounidense (colour / color, organise / organize).
- Números en cifra o en palabra (15 / fifteen).
- Artículos opcionales cuando no cambian el sentido.
- Variantes declaradas por el autor de la pregunta.
Lo que no flexibilizamos es el límite de palabras, porque el examen real tampoco lo hace: si la instrucción pide dos palabras y escribes tres, la respuesta es incorrecta. Entrenarte con una regla más blanda que la del examen sería engañarte.
Si crees que tu respuesta era válida y la corregimos mal, puedes marcarla y la revisamos.
Cómo estimamos los puntajes
GRE. Convertimos tu porcentaje de aciertos, ponderado por la dificultad de las preguntas que respondiste, a la escala de 130–170 por sección. En los simulacros incorporamos además la lógica adaptativa: tu desempeño en la primera sección de cada área determina de qué pool de dificultad sale la segunda, y el pool influye en el puntaje resultante, igual que en el examen real.
IELTS. En Listening y Reading convertimos las respuestas correctas sobre 40 a banda usando las tablas de conversión públicas. En Writing y Speaking la banda sale de la rúbrica. La overall es el promedio de las cuatro secciones con la regla de redondeo oficial: los promedios terminados en .25 suben a .5 y los terminados en .75 suben al entero siguiente.
La proyección de score que ves en tus estadísticas es una regresión lineal simple sobre tus simulacros anteriores. Es una recta trazada sobre tus propios datos, no una predicción del examen real: no aparece con menos de dos simulacros, y con pocos puntos su margen de error es grande. La mostramos porque una tendencia es útil, no porque sea un pronóstico.
Ningún puntaje que entrega GradPrepIA es oficial. Son estimaciones construidas sobre tablas públicas y sobre tu desempeño en nuestro contenido.
Evaluación de Writing
Usamos las rúbricas oficiales, tal como están publicadas.
Para el AWA del GRE, una puntuación de 0 a 6 en medios puntos sobre articulación y sustento de la posición, desarrollo de las ideas, organización y dominio del lenguaje.
Para el Writing del IELTS, los cuatro criterios oficiales —Task Achievement/Response, Coherence and Cohesion, Lexical Resource y Grammatical Range and Accuracy— con una banda por criterio, no solo una banda global. Recibes además fortalezas concretas, errores marcados sobre tu propio texto y ejemplos de reescritura.
Las limitaciones, dichas de frente:
- Un modelo de lenguaje aplicando una rúbrica no es un examinador certificado. Nuestras bandas son una aproximación calibrada, no un resultado oficial.
- La evaluación de un mismo texto puede variar ligeramente entre ejecuciones.
- Tiende a ser algo más generosa que un examinador humano en los tramos medios. Si tu objetivo es 7.0, apunta a 7.5 en la plataforma.
- Es más confiable diciéndote qué está mal y por qué que asignando el número exacto. Úsala como diagnóstico, no como certificado.
Evaluación de Speaking
Grabas tus respuestas a las tres partes, transcribimos el audio y evaluamos la transcripción con los criterios oficiales.
Esto significa que evaluamos tres de los cuatro criterios: Fluency and Coherence, Lexical Resource y Grammatical Range and Accuracy.
La pronunciación se marca como no evaluable. Un transcript no conserva la información acústica que la rúbrica de Pronunciation necesita: acentuación, entonación, ritmo, agrupación de palabras. Podríamos inventar una banda y quedaría más completo el informe; preferimos decir que no la tenemos. Como la banda de Speaking promedia cuatro criterios y nosotros solo medimos tres, el número que entregamos es incompleto por construcción, y así lo etiquetamos.
La fluidez la estimamos parcialmente desde la duración y la densidad del habla, lo que captura pausas largas pero no muletillas ni titubeos breves.
Práctica adaptativa y repaso
Recomendación por sub-skill. Calculamos tu accuracy por sub-skill y priorizamos las más débiles. Una sub-skill necesita al menos cinco intentos para entrar en el cálculo: con menos, el porcentaje es ruido y te mandaría a estudiar lo que no corresponde.
Repetición espaciada. Creamos una tarjeta de repaso solo cuando fallas una pregunta, y programamos su siguiente aparición con el algoritmo SM-2: los intervalos crecen cuando aciertas y se reinician cuando vuelves a fallar. No generamos tarjetas de lo que ya respondes bien, porque el tiempo de estudio es finito.
Qué no hacemos
- No reproducimos preguntas oficiales. Ni tenemos "el banco real filtrado" ni lo tendremos.
- No prometemos un puntaje. Ninguna plataforma puede, y quien lo promete está vendiendo otra cosa.
- No estamos afiliados a ETS ni al consorcio IELTS. GRE es marca registrada de Educational Testing Service; IELTS lo es de British Council, IDP: IELTS Australia y Cambridge University Press & Assessment.
- No sustituimos un examinador humano en Writing y Speaking. Complementamos: damos volumen, inmediatez y detalle que un tutor no puede dar a diario.
Fuentes
Las estructuras, escalas, rúbricas y tablas de conversión que usamos provienen de la documentación pública de los dueños de cada examen: ets.org/gre para el GRE y ielts.org para el IELTS. Cuando esas fuentes cambien, cambiamos nosotros.