COCA · mil millones de palabras
Las palabras más comunes en inglés
Un ranking construido a partir de un corpus de mil millones de palabras de inglés americano real. Aprende las palabras en la cima de esta página y reconocerás una gran parte de casi cualquier texto en inglés — antes de estudiar una sola lista temática de vocabulario.
Las palabras más comunes en inglés son palabras gramaticales o de función: the, be, and, a, of, to, in, I, you e it. Aportan estructura gramatical más que significado, motivo por el cual la cima de cualquier lista de frecuencia no se parece a un libro de texto tradicional.
5,000
words ranked
top of the corpus frequency list
14
word classes
tagged in the source data
1bn
words of corpus
COCA, 1990–2019
Las 100 palabras más frecuentes en bruto
El ranking directo del corpus, sin eliminar nada. Usa el selector para ocultar las palabras gramaticales y ver las palabras de contenido más comunes que realmente transmiten significado.
- 1theart.50,385
- 2beverb32,623
- 3andconj.24,952
- 4aart.24,396
- 5ofprep.23,322
- 6toinf.16,888
- 7inprep.15,781
- 8Ipron.14,318
- 9youpron.12,164
- 10itpron.11,120
- 11haveverb10,588
- 12toprep.9,297
- 13thatconj.8,378
- 14forprep.8,253
- 15doverb8,245
- 16hepron.6,513
- 17withprep.6,488
- 18onprep.6,123
- 19thisdet.5,580
- 20n'tneg.5,322
Por qué la cima de la lista parece tan peculiar
Casi todas las palabras entre las primeras cincuenta son palabras gramaticales o de función: artículos, preposiciones, pronombres, conjunciones o auxiliares. Las palabras de función forman un conjunto cerrado: el inglés cuenta con unas pocas cientos de ellas y prácticamente no añade nuevas. Como cada oración las necesita, se repiten constantemente y dominan cualquier recuento de frecuencia.
Las palabras de contenido —sustantivos, verbos, adjetivos y adverbios— son un conjunto abierto de cientos de miles de entradas, por lo que cada una aparece con mucha menor frecuencia individual. Por eso 'the' supera en frecuencia a 'time', el sustantivo más común, en una proporción aproximada de veinticinco a uno.
Ambas mitades son importantes, pero se aprenden de forma diferente. Las palabras de función son una lista corta que se domina de una vez por todas; las palabras de contenido son la cola larga que sigues ampliando durante años. Los rankings por categoría a continuación cubren la mitad correspondiente a las palabras de contenido.
Rankings por categoría gramatical
Los mismos datos del corpus, filtrados por tipo de palabra. Las barras son relativas a la palabra más frecuente de cada categoría.
- 1be32,623
- 2have10,588
- 3do8,245
- 4say4,125
- 5go3,572
Explora por clase de palabra
Profundiza en una categoría gramatical a la vez.
Verbos
Los verbos que sostienen casi cualquier oración en inglés, desde be y have hasta serve y break.
0 de 100 marcadas como conocidas
Ver el ranking →
Sustantivos
Las cosas, personas e ideas de las que más se habla en inglés: time, people, year, way, thing.
0 de 100 marcadas como conocidas
Ver el ranking →
Adjetivos
Las palabras descriptivas que hacen el trabajo pesado: other, good, new, great, big.
0 de 100 marcadas como conocidas
Ver el ranking →
Phrasal verbs
PróximamenteCombinaciones de verbo + partícula que los hablantes nativos usan constantemente y los estudiantes evitan.
100 palabras planeadas
Empieza aquí
be
El verbo más frecuente que aún no has marcado — aparece unas 32,623 veces por millón de palabras.
Abrir el ranking de verbos →Metodología
Los rankings se calculan a partir del Corpus of Contemporary American English (COCA), un corpus de mil millones de palabras de inglés estadounidense que abarca de 1990 a 2019 en transcripciones orales, ficción, revistas, periódicos, textos académicos, blogs y subtítulos de TV/cine. Los datos de frecuencia están publicados en www.wordfrequency.info, fuente de cada cifra en esta página.
Los recuentos brutos se normalizan a una tasa por millón de palabras para comparar equitativamente entre géneros de tamaños diversos. La cifra junto a cada palabra indica esa tasa: 'the' aparece unas 50.385 veces por millón de palabras, 'be' unas 32.623.
Las entradas son lemas, no formas flexionadas. Las formas derivadas se agrupan bajo su lema de diccionario — runs, ran y running cuentan para run —, reflejando cómo se organiza mentalmente el vocabulario e impidiendo que un solo verbo ocupe seis puestos en un top 100.
El etiquetado gramatical procede del propio corpus. Las palabras que funcionan en más de una categoría se cuentan por separado en cada una, por lo que una palabra puede figurar en varios rankings con cifras distintas. Los verbos modales están etiquetados como verbos, motivo por el cual can, will y would figuran en el ranking de verbos.
Los niveles MCER junto a cada palabra son una estimación editorial de cuándo se suele aprender cada término (escala A1–C2). Son una ayuda de estudio añadida a los datos, no parte del corpus original.
Cómo la frecuencia de las palabras debe cambiar tu forma de estudiar
La mayoría de los estudiantes aprende vocabulario en conjuntos temáticos —comida, viajes, oficina— porque así se organizan los libros. Los datos de frecuencia sugieren otra prioridad. Las palabras no son igualmente útiles, y la diferencia entre las más útiles y las simplemente útiles es enorme. Una palabra en el puesto 100 aparece muchas más veces que una en el puesto 3.000, por lo que una hora dedicada a las primeras cien rinde mucho más que horas dedicadas más abajo.
Esto tiene una consecuencia práctica: antes de aprender una lista temática, asegúrate de dominar el núcleo. Si lees la cima de esta página y conoces de verdad cada palabra —no solo reconocerla, sino usarla correctamente en una oración— tienes una base firme sobre la que construir. De lo contrario, las listas temáticas se desmoronarán porque las oraciones se sostienen con palabras que aún no dominas.
La frecuencia también te indica cuándo parar. Pasadas unas pocas miles de palabras, el rendimiento decrece rápidamente y la lectura contextual se convierte en mejor maestra que cualquier lista. Los rankings son una herramienta para la primera etapa del camino, no para la totalidad del trayecto.
Por último, utiliza estas listas como diagnóstico. Marca lo que sabes, observa lo que falta y deja que los huecos elijan tu próximo tema. Es una guía más honesta para decidir qué estudiar a continuación que cualquier programa cerrado.
Preguntas frecuentes
¿Qué es un corpus y por qué es importante?
Un corpus es una colección estructurada de textos y transcripciones reales usada para medir cómo se emplea un idioma. Es importante porque la intuición sobre qué palabras son comunes resulta engañosa; contar su aparición en mil millones de palabras no lo es.
¿Cuál es la diferencia entre palabras gramaticales y palabras de contenido?
Las palabras gramaticales (the, of, and, to, a) aportan estructura y pertenecen a un conjunto cerrado pequeño. Las palabras de contenido (time, make, good, quickly) aportan significado y forman un conjunto abierto enorme. Las palabras gramaticales dominan la cima de la lista porque cada oración las necesita.
¿Cuántas de estas palabras necesito saber?
Las primeras cien palabras representan una gran proporción del texto en inglés, pero son mayoritariamente gramática. La comprensión real proviene de combinarlas con las palabras de contenido de las listas por categorías.
¿Cómo se calcula mi puntuación personal?
Cuenta las palabras que has marcado como conocidas en las listas por categorías, dividido por el total de palabras clasificadas. Tus marcas se guardan en tu navegador y se sincronizan si tienes cuenta. Son privadas —nada se comparte ni compara.
¿De dónde proceden los datos y con qué frecuencia se actualizan?
De www.wordfrequency.info, que publica listas derivadas de COCA (1990 a 2019). Reimportamos los datos cuando se actualizan las listas publicadas; la fecha al inicio indica la última actualización.
Frequency data from www.wordfrequency.info, derived from the Corpus of Contemporary American English (COCA). wordfrequency.info
