Anar al contingut principal
Nadia Zhang Classes de xinès · Girona

文本分析 wénběn fēnxī

Analitzador de textos en xinès

Enganxa qualsevol text en caràcters xinesos i sabràs quants n'hi ha, quins es repeteixen, què vol dir cadascun i quina part del text ja cobreixes amb el vocabulari d'HSK 1 i HSK 2.

  • 9.574 caràcters a l'índex
  • 626 caràcters amb fitxa pròpia
  • 237 caràcters del material HSK 1-2

Què fa aquesta eina

L'analitzador de textos en xinès compta els caràcters d'un text enganxat, separa els diferents dels repetits i els ordena per freqüència amb el pinyin i el significat. Després compara aquesta llista amb el vocabulari d'HSK 1 i HSK 2 i calcula quin percentatge del text ja entens. Tot el càlcul es fa al teu navegador.

分析 · Eina

Enganxa el teu text i mira'l per dins

L'índex de caràcters es descarrega el primer cop que t'acostes a la caixa, no en obrir la pàgina. A partir d'aquí l'anàlisi és instantània i no surt res del teu navegador.

Serveix qualsevol cosa: un missatge, una carta de restaurant, el subtítol d'un vídeo o un paràgraf copiat d'un web xinès. La puntuació i les paraules en altres llengües s'ignoren.

例子 · Exemple resolt

Un diàleg de restaurant, caràcter a caràcter

Aquest és el diàleg de «Demanar menjar en un restaurant» que ensenyem a l'HSK 3, i és el mateix text que carrega el botó d'exemple. L'anàlisi que ve tot seguit està calculada en publicar la pàgina: es veu igual amb el JavaScript desactivat.

El text

你好,服务员,我要点菜。好的,您想吃点儿什么?你们有什么好吃的菜?我们的牛肉面很不错,很多人喜欢。好,那要一碗牛肉面。再要一瓶啤酒。好的,请稍等。

Dels 38 caràcters diferents del teu text, 28 són al material d'HSK 1 i 2 i 10 no.

Si coneixes els caràcters del material d'HSK 1 i 2, entens el 80 % d'aquest text.

Els caràcters diferents, del que més surt al que menys

  1. hǎo 5 vegades

    bo, excel·lent, fi; apropiat, adequat; bé

    HSK 1-2 Veure la fitxa de

  2. de 4 vegades

    blanc, meta; de; partícula possessiva; sufix -mateix

    HSK 1-2 Veure la fitxa de

  3. yào 3 vegades

    essencial, necessari; demanar; forçar; exigir

    HSK 1-2 Veure la fitxa de

  4. 2 vegades

    tu, pronom de segona persona

    HSK 1-2 Veure la fitxa de

  5. 2 vegades

    jo, em, meu; nostre, ens

    HSK 1-2 Veure la fitxa de

  6. diǎn 2 vegades

    punt, taca, clapa

    HSK 1-2 Veure la fitxa de

  7. cài 2 vegades

    verdures; plat; menjar

    HSK 1-2 Veure la fitxa de

  8. chī 2 vegades

    menjar; beure; patir, suportar, aguantar

    HSK 1-2 Veure la fitxa de

  9. shén 2 vegades

    què?; barrejat, miscel·lani

    HSK 1-2 Veure la fitxa de

  10. me 2 vegades

    (partícula interrogativa)

    HSK 1-2 Veure la fitxa de

  11. men 2 vegades

    marca de plural per a pronoms i alguns substantius

    HSK 1-2 Veure la fitxa de

  12. niú 2 vegades

    bou, vaca, toro

    Fora del material Veure la fitxa de

  13. ròu 2 vegades

    carn; carn del cos

    Fora del material Veure la fitxa de

  14. miàn 2 vegades

    cara; superfície, costat; pla, dimensió

    HSK 1-2 Veure la fitxa de

  15. hěn 2 vegades

    molt, força, bastant

    HSK 1-2 Veure la fitxa de

  16. 2 vegades

    un; un, una; sol

    HSK 1-2 Veure la fitxa de

  17. 1 vegada

    roba; vestir, dur posat; prendre un medicament

    Fora del material Veure la fitxa de

  18. 1 vegada

    afers, negocis; caldre; haver de

    Fora del material Veure la fitxa de

  19. yuán 1 vegada

    empleat; membre; personal, plantilla

    Fora del material Veure la fitxa de

  20. nín 1 vegada

    forma honorífica de "tu"

    HSK 1-2 Veure la fitxa de

  21. xiǎng 1 vegada

    creure, desitjar; considerar, planejar, pensar

    HSK 1-2 Veure la fitxa de

  22. ér 1 vegada

    fill, nen

    HSK 1-2 Veure la fitxa de

  23. yǒu 1 vegada

    tenir, posseir; haver-hi, existir

    HSK 1-2 Veure la fitxa de

  24. 1 vegada

    no, in-; prefix negatiu

    HSK 1-2 Veure la fitxa de

  25. cuò 1 vegada

    error, equivocació; incorrecte, erroni

    HSK 1-2 Veure la fitxa de

  26. duō 1 vegada

    molt, molts, multi-; més de

    HSK 1-2 Veure la fitxa de

  27. rén 1 vegada

    home, persona; gent

    HSK 1-2 Veure la fitxa de

  28. 1 vegada

    estimar; gaudir, estar content; alegre, joiós

    HSK 1-2 Veure la fitxa de

  29. huān 1 vegada

    content, alegre, joiós

    HSK 1-2 Veure la fitxa de

  30. 1 vegada

    aquell, aquell mateix, aquells

    HSK 1-2 Veure la fitxa de

  31. wǎn 1 vegada

    bol, plat petit

    Fora del material Veure la fitxa de

  32. zài 1 vegada

    un altre cop, dues vegades, re-

    HSK 1-2 Veure la fitxa de

  33. píng 1 vegada

    ampolla, gerra, càntir, gerro

    Fora del material Veure la fitxa de

  34. 1 vegada

    cervesa

    Fora del material Veure la fitxa de

  35. jiǔ 1 vegada

    vi, licor, aiguardent, alcohol

    Fora del material Veure la fitxa de

  36. qǐng 1 vegada

    demanar, sol·licitar; convidar; si us plau

    HSK 1-2 Veure la fitxa de

  37. shāo 1 vegada

    una mica, lleugerament, un poc; més aviat

    Fora del material Veure la fitxa de

  38. děng 1 vegada

    rang, grau; igual, equivalent; esperar

    HSK 1-2 Veure la fitxa de

用法 · Mètode

Com es fa servir, pas a pas

Quatre moviments. L'ordre importa: la cobertura es mira abans que la llista, perquè és la que decideix si aquell text és per avui o per d'aquí a un mes.

  1. Enganxa el text a la caixa. No cal netejar-lo: els signes, els espais i les paraules en català s'ignoren, i només es compten els caràcters xinesos.

  2. Mira primer la cobertura. És el percentatge de caràcters del text —repeticions incloses— que ja has vist al material d'HSK 1 i HSK 2 d'aquest web.

  3. Recorre la llista de freqüència. Està ordenada del que més surt al que menys, de manera que els primers caràcters són els que més et compensa assegurar.

  4. Filtra per «els que falten» i copia'ls. Aquesta llista, i no el text sencer, és la teva feina d'estudi abans de tornar a llegir-lo.

覆盖率

Què t'està dient el percentatge

La cobertura no compta caràcters diferents: compta aparicions. Els caràcters freqüents del xinès es repeteixen moltíssim —你, 我, 的, 是 i 不 surten en gairebé qualsevol frase—, de manera que un text pot tenir quaranta caràcters diferents, que només en coneguis vint-i-vuit i que tot i així arribi al 80 % de cobertura. El percentatge mesura quina part del text et resulta transparent quan el llegeixes, que és el que decideix de debò si te'n surts.

Les xifres de referència ajuden a interpretar-lo. Per sobre del 98 % es llegeix de cap a cap i gairebé no cal el diccionari. Al voltant del 95 % es llegeix amb un esforç raonable i s'endevina força pel context. Per sota del 90 % el text deixa de ser lectura i passa a ser material d'estudi: s'hi pot treballar, però frase a frase i amb ajuda.

Un 80 % sona bé i no ho és tant: vol dir que un de cada cinc caràcters t'atura. Saber-ho abans de començar és justament el que evita triar malament el text i deixar-lo al tercer paràgraf.

Cada caràcter de la llista enllaça a la seva fitxa del diccionari , amb el radical, la descomposició i l'animació de l'ordre de traços. I si vols saber quants caràcters s'esperen a cada examen, els tens a la pàgina dels nivells HSK .

字与词

Caràcters no és el mateix que paraules

L'error més car dels dos primers anys és estudiar llistes de paraules sense mirar de quins caràcters estan fetes. 中国人 és una paraula i tres caràcters; 服务员 és una altra paraula i uns altres tres. Memoritzades soltes són dues coses. Vistes per peces són 中, 国, 人, 服, 务 i 员, i cinc d'aquestes sis reapareixen en desenes de paraules més.

Aquesta eina compta caràcters expressament. No segmenta en paraules i no ho pretén: la segmentació automàtica s'equivoca just on més molesta, amb els noms propis i amb les paraules que encara no coneixes. Comptant caràcters el recompte és exacte i, a més, el caràcter és la unitat que et serveix per estudiar.

El que sí que convé és llegir la llista sabent que un caràcter aïllat pot no voler dir res tot sol en xinès modern. 服 i 务 gairebé no apareixen solts; junts volen dir «servei». La definició que hi veus és la del caràcter, no la de la paraula que forma amb el del costat.

Per veure els caràcters funcionant dins de paraules senceres, amb pinyin i exemples, hi ha el vocabulari per temes ; i si el que vols és el pinyin col·locat a sobre de cada caràcter del text sencer, ho fa el convertidor de hanzi a pinyin .

生词

Què fer amb els que falten

Copia la llista dels que falten i mira-te'ls abans de llegir, no mentre llegeixes. Aturar-te cada tres línies a cercar un caràcter trenca la lectura i no fixa res. Deu caràcters nous són una sessió raonable; trenta no ho són, i aleshores el més sensat és canviar de text i tornar a aquest d'aquí a un mes.

Dins dels que falten, no tots valen el mateix. Els que apareixen tres o quatre vegades al text se't quedaran sols quan el llegeixis; els que hi surten una sola vegada i no porten cap radical reconeixible poden esperar. El nombre d'aparicions de cada caràcter hi és justament per això.

I abans de memoritzar el traç, mira'n la peça. Molts caràcters «nous» són un radical que ja coneixes més un component fonètic que ja has vist: 啤 és 口 «boca» més 卑, i sona pí. Reconèixer-ho converteix vint caràcters solts en quatre o cinc famílies.

Els cent components que més renten els tens explicats als radicals xinesos , i les vuit regles que ordenen els traços, a la guia de l'ordre de traços .

读什么

Amb quins textos començar

Si la cobertura d'allò que vols llegir es queda per sota del 85 %, la drecera no és esforçar-s'hi més: és llegir una altra cosa durant unes setmanes. Els diàlegs amb àudio i el vocabulari per temes d'aquest web estan escrits just en aquesta franja i fan de rampa.

Un mètode que funciona: tria tres textos de temes diferents, analitza'ls i queda't amb el que tingui la cobertura més alta dels tres. Llegeix-lo dues vegades —la primera amb la llista dels que falten al davant, la segona sense res— i passa al següent. En dos mesos la diferència es nota al percentatge, sense haver comptat ni una sola paraula memoritzada.

Pots començar pel bloc de salutacions i presentacions o pels diàlegs d'HSK 3 , que porten àudio i la transcripció sencera.

常见问题

Preguntes sobre l'analitzador

Quin percentatge d'un text cal reconèixer per llegir-lo sense diccionari?

Al voltant del 98 % de les aparicions. És la xifra que fa servir la recerca sobre lectura extensiva, i en xinès vol dir que només un de cada cinquanta caràcters et resulta desconegut. Amb un 95 % es llegeix amb un esforç raonable i endevinant molt pel context. Per sota del 90 % el text ja no és lectura: és material d'estudi que cal treballar frase a frase.

Per què l'anàlisi compta caràcters i no paraules?

Perquè la segmentació automàtica en paraules s'equivoca just on més molesta: als noms propis i a les paraules que encara no coneixes. Comptant caràcters el recompte és exacte i, a més, el caràcter és la unitat que de debò s'estudia: un cop saps i pots reconèixer 服务 , 服务员 i 服务台 sense aprendre-les d'una en una.

D'on surten el pinyin i els significats?

Del mateix índex que fa servir el diccionari d'aquest web: 9.574 caràcters del xinès simplificat amb el pinyin, el radical i el nombre de traços, derivats de Make Me a Hanzi, que al seu torn parteix de la base Unihan. Les definicions en català i en castellà són traduccions nostres. Els 626 caràcters que ensenyem tenen, a més, fitxa pròpia, i la llista hi enllaça.

El meu text s'envia a algun servidor?

No. L'índex de caràcters es descarrega un sol cop al teu navegador i tota l'anàlisi es fa allà: el text que enganxes no viatja a cap servidor, no queda als nostres registres i aquest web no fa servir galetes. L'única cosa que es desa és una còpia del text a l'emmagatzematge local del navegador, perquè no el perdis si recarregues; s'esborra en buidar la caixa.

Llegir en xinès s'entrena, no s'espera

Saber en quin percentatge ets canvia la manera d'estudiar: es deixa de llegir el que ve de gust i es comença a llegir el que es pot, que és com puja la xifra. A classe hi treballem exactament així, amb textos triats per cobertura i no per tema, i amb les explicacions en català o en castellà, com prefereixis.