ISO 639-2
ISO 639-2:1998 అనేది భాషల పేర్లను సూచించడానికి ఉపయోగించే మూడు అక్షరాల సంకేతాల ప్రమాణం. ఇది ISO 639 ప్రమాణంలోని రెండవ భాగం. ఇందులో ప్రతి భాషకు ఒక ప్రత్యేక మూడు అక్షరాల కోడ్ ఇవ్వబడుతుంది, వీటిని "ఆల్ఫా-3 కోడ్లు" అంటారు. ISO 639-2 జాబితాలో మొత్తం 487 కోడ్లు ఉన్నాయి.
యునైటెడ్ స్టేట్స్లోని Library of Congress సంస్థ ISO 639-2 కు నమోదు అధికార సంస్థగా (ISO 639-2/RA) పనిచేస్తుంది. ఈ సంస్థకు కొత్త మార్పుల ప్రతిపాదనలు పంపబడతాయి, వాటిని పరిశీలించే బాధ్యత కూడా దీనిదే. అదనంగా, ISO 639 కోడ్ పట్టికలను నిర్వహించే ISO 639-RA సంయుక్త సలహా కమిటీలో కూడా ఈ సంస్థ ప్రతినిధులు ఉంటారు.[1]
చరిత్ర, ఇతర ISO 639 ప్రమాణాలతో సంబంధం
[మార్చు]| Find a language |
|---|
| Enter an ISO 639-2 code to find the corresponding language article. |
ISO 639-1 ప్రమాణం రెండు అక్షరాల భాషా కోడ్లను మాత్రమే ఉపయోగించేది. దీంతో ప్రపంచంలోని అన్ని భాషలకు సరిపడే సంఖ్యలో కోడ్లను ఇవ్వడం సాధ్యం కాలేదు. ఈ కారణంగా 1989లో ISO 639-2 ప్రమాణంపై పని ప్రారంభించారు. ఈ ప్రమాణం మొదటగా 1998లో విడుదలైంది.[2]
ప్రయోగంలో చూస్తే, ISO 639-2 స్థానాన్ని చాలా వరకు ISO 639-3 (2007) తీసుకుంది. ISO 639-3 లో ISO 639-2 లోని అన్ని వ్యక్తిగత భాషా కోడ్లతో పాటు మరెన్నో భాషల కోడ్లు కూడా ఉన్నాయి.[3] ఇందులో ప్రత్యేక కోడ్లు, స్థానిక వినియోగం కోసం కేటాయించిన కోడ్లు కూడా ఉన్నాయి. అలాగే, ఇది ISO 639-2 తో ఘర్షణ రాకుండా రూపొందించబడింది.[4]
అయితే, ISO 639-3 లో ISO 639-2 లో ఉన్న సామూహిక భాషా కోడ్లు చేర్చలేదు. వాటిలో చాలా కోడ్లు ISO 639-5 లో చేర్చబడ్డాయి.
B, T కోడ్లు
[మార్చు]చాలా భాషలకు ISO 639-2 లో ఒకే కోడ్ ఉంటుంది. అయితే, 20 భాషలకు రెండు మూడు-అక్షరాల కోడ్లు ఉన్నాయి:
- “బిబ్లియోగ్రాఫిక్” కోడ్ (ISO 639-2/B)
- “టెర్మినాలజికల్” కోడ్ (ISO 639-2/T)
బిబ్లియోగ్రాఫిక్ కోడ్ ఆ భాష ఆంగ్ల పేరును ఆధారంగా తీసుకుని రూపొందించబడింది. ఇది పాత గ్రంథాలయ వ్యవస్థల అవసరాల కారణంగా కొనసాగించబడింది. టెర్మినాలజికల్ కోడ్ మాత్రం ఆ భాష స్వదేశీ పేరును ఆధారంగా తీసుకుని రూపొందించబడింది. ఇది సాధారణంగా ISO 639-1 లోని రెండు అక్షరాల కోడ్కు దగ్గరగా ఉంటుంది.
మొదట 22 B కోడ్లు ఉండేవి. వాటిలో scc, scr కోడ్లు ఇప్పుడు అమాన్యమైనవిగా (deprecated) గుర్తించబడ్డాయి.[5] సాధారణంగా T కోడ్లకే ఎక్కువ ప్రాధాన్యం ఇస్తారు. ISO 639-3 కూడా ISO 639-2/T కోడ్లనే ఉపయోగిస్తుంది.[6]
పరిధులు, రకాలు
[మార్చు]ISO 639-2 లోని కోడ్లు వివిధ రకాల అర్థాలు, వినియోగాలను సూచిస్తాయి. వాటిలో ముఖ్యమైనవి:
- వ్యక్తిగత భాషలు
- మాక్రోభాషలు
- భాషల సమూహాలు
- మాండలికాలు
- స్థానిక వినియోగం కోసం కేటాయించిన కోడ్లు
- ప్రత్యేక పరిస్థితుల కోడ్లు
- మాక్రోభాషలు, సామూహిక భాషల నిర్వచనాలు ISO 639-3/RA లో ఇవ్వబడ్డాయి.[7]
- వ్యక్తిగత భాషలను కూడా మరింతగా ఈ విధంగా వర్గీకరిస్తారు:
- జీవ భాషలు
- అంతరించిపోయిన భాషలు
- ప్రాచీన భాషలు
- చారిత్రక భాషలు
- కృత్రిమ భాషలు
భాషల సేకరణలు
[మార్చు]ISO 639-2 లో సాధారణంగా భాషల కోసం ఉపయోగించే కొన్ని కోడ్లు, ఒక నిర్దిష్ట భాషను మాత్రమే ఖచ్చితంగా సూచించవు. అవి సంబంధిత భాషల సమూహాన్ని సూచించవచ్చు. ఇటువంటి కోడ్లను “సామూహిక భాషా కోడ్లు” (collective language codes) అంటారు. ఈ కారణంగా వాటిని ISO 639-3 ప్రమాణంలో చేర్చలేదు.
ISO 639-2 లో కొన్ని కోడ్లు ఒక్క భాషను కాకుండా, భాషల సమూహాలను సూచిస్తాయి. వీటిలో కొన్ని “మిగిలిన భాషలు” అనే విధంగా పనిచేస్తాయి. అంటే, ఇప్పటికే ప్రత్యేక కోడ్ ఉన్న భాషలను తప్పించి, మిగతా భాషలను సూచిస్తాయి. మరికొన్ని కోడ్లు మాత్రం ఆ సమూహంలోని అన్ని భాషలను కలుపుకుంటాయి.
“మిగిలిన భాషల” సమూహాల కోడ్లు:
afa, alg, art, ath, bat, ber, bnt, cai, cau, cel, cpe, cus, dra, fiu, gem, inc, ine, ira, khi, kro, map, mis, mkh, mun, nai, nic, paa, roa, sai, sem, sio, sit, sla, saa, tai, tut.
అన్ని భాషలను కలుపుకునే సమూహాల కోడ్లు:
apa, arn, art, aus, bad, bai, bih, cad, car, chb, cmc, cpe, cpp, dua, hmn, iro, mno, mul, myn, nub, oto, phi, sgn, wak, yao, zap, znd, zun.[8]
క్రింది కోడ్ను ISO 639-2 లో సామూహిక భాషా కోడ్గా గుర్తించారు. అయితే, ప్రస్తుతం అది ISO 639-5 లో లేదు.
him Himachali
ISO 639-2 కోసం నమోదు చేసిన కొన్ని కోడ్లు, ISO 639-5 లో సామూహిక భాషా కోడ్లుగా జాబితా చేయబడ్డాయి. అలాగే, ISO 639-2 లో కూడా అవి పేరుతో సామూహిక కోడ్లుగానే పేర్కొనబడ్డాయి.
- afa ఆఫ్రో-ఆసియాటిక్ భాషలు
- alg ఆల్గోంక్వియన్ భాషలు
- apa అపాచీ భాషలు
- art కృత్రిమ భాషలు
- ath అతపాస్కన్ భాషలు
- aus ఆస్ట్రేలియన్ భాషలు
- bad బండా భాషలు
- bai బమిలెకే భాషలు
- bat బాల్టిక్ భాషలు
- ber బెర్బర్ భాషలు
- bih బిహారీ భాషలు
- bnt బాంటు భాషలు
- btk బటాక్ భాషలు
- cai మధ్య అమెరికా ఆదివాసీ భాషలు
- cau కాకేసియన్ భాషలు
- cel సెల్టిక్ భాషలు
- cmc చామిక్ భాషలు
- cpe ఇంగ్లీషు ఆధారిత క్రియోల్, పిడ్జిన్ భాషలు
- cpf ఫ్రెంచ్ ఆధారిత క్రియోల్, పిడ్జిన్ భాషలు
- cpp పోర్చుగీస్ ఆధారిత క్రియోల్, పిడ్జిన్ భాషలు
- crp క్రియోల్, పిడ్జిన్ భాషలు
- cus కుషిటిక్ భాషలు
- day ల్యాండ్ డాయక్ భాషలు
- dra ద్రావిడ భాషలు
- fiu ఫిన్నో-ఉగ్రియన్ భాషలు
- gem జర్మానిక్ భాషలు
- ijo ఇజో భాషలు
- inc ఇండిక్ భాషలు
- ine ఇండో-యూరోపియన్ భాషలు
- ira ఇరానియన్ భాషలు
- iro ఐరోక్వోయన్ భాషలు
- kar కరెన్ భాషలు
- khi ఖోయిసాన్ భాషలు
- kro క్రూ భాషలు
- map ఆస్ట్రోనేషియన్ భాషలు
- mkh మోన్-ఖ్మేర్ భాషలు
- mno మనోబో భాషలు
- mun ముండా భాషలు
- myn మాయన్ భాషలు
- nah నహువాట్ల్ భాషలు
- nai ఉత్తర అమెరికా ఆదివాసీ భాషలు
- nic నైజర్-కోర్డోఫేనియన్ భాషలు
- nub నూబియన్ భాషలు
- oto ఓటోమియన్ భాషలు
- paa పాపువన్ భాషలు
- phi ఫిలిప్పీన్ భాషలు
- pra ప్రాకృత భాషలు
- roa రొమాన్స్ భాషలు
- sai దక్షిణ అమెరికా ఆదివాసీ భాషలు
- sal సలిషన్ భాషలు
- sem సెమిటిక్ భాషలు
- sgn సంకేత భాషలు
- sio సియోవన్ భాషలు
- sit సినో-టిబెటన్ భాషలు
- sla స్లావిక్ భాషలు
- smi సామి భాషలు
- son సాంగ్హై భాషలు
- ssa నిలో-సహారన్ భాషలు
- tai తాయ్ భాషలు
- tup టుపి భాషలు
- tut అల్టాయిక్ భాషలు
- wak వాకషన్ భాషలు
- wen సోర్బియన్ భాషలు
- ypk యూపిక్ భాషలు
- znd జాండే భాషలు
స్థానిక వినియోగం కోసం కేటాయించిన కోడ్లు
[మార్చు]qaa నుండి qtz వరకు ఉన్న కోడ్ల పరిధిని “స్థానిక వినియోగం కోసం కేటాయించినవి”గా గుర్తించారు. ఇవి ISO 639-2 లోనూ, ISO 639-3 లోనూ ఉపయోగించబడవు. సాధారణంగా, ఈ కోడ్లు ఇంకా ప్రమాణాల్లో చేర్చని భాషల కోసం వ్యక్తిగతంగా లేదా స్థానిక అవసరాల కోసం ఉపయోగిస్తారు.
Microsoft Windows వ్యవస్థలో qps అనే భాషా కోడ్ను pseudo-locales కోసం ఉపయోగిస్తారు. ఇవి ఆంగ్ల పాఠ్యాల ఆధారంగా స్వయంచాలకంగా రూపొందించబడతాయి, సాఫ్ట్వేర్ స్థానీకరణ (localization) పరీక్షల కోసం వీటిని ఉపయోగిస్తారు.[9]
ప్రత్యేక పరిస్థితులు
[మార్చు]ప్రత్యేక సందర్భాల కోసం నాలుగు సాధారణ కోడ్లు ఉన్నాయి:
- mis — “కోడ్ ఇవ్వని భాషలు” కోసం ఉపయోగిస్తారు. ఇది మొదట “miscellaneous” అనే పదానికి సంక్షిప్త రూపంగా వచ్చింది.
- mul — “అనేక భాషలు” అనే అర్థంలో ఉపయోగిస్తారు. ఒకకంటే ఎక్కువ భాషలు ఉన్నప్పుడు, అన్ని భాషా కోడ్లను విడిగా ఇవ్వడం సాధ్యం కాకపోతే దీనిని వాడుతారు.
- und — భాషను సూచించాల్సిన అవసరం ఉన్నా, ఆ భాషను గుర్తించలేని పరిస్థితుల్లో ఉపయోగిస్తారు.
- zxx — “భాషా విషయవస్తువు లేదు” అనే అర్థంలో ఉపయోగిస్తారు. ఉదాహరణకు, జంతువుల శబ్దాలు. ఈ కోడ్ను 2006 జనవరి 11న చేర్చారు.
ఈ నాలుగు కోడ్లు ISO 639-3 లో కూడా ఉపయోగించబడుతున్నాయి.
ఇవి కూడా చూడండి
[మార్చు]మూలాలు
[మార్చు]- ↑ "Terms of Reference of the ISO 639 Maintenance Agency (ISO 639/MA)" (PDF). ISO. ఒరిజినల్ పేజీని చూసిన తేదీ: 23 July 2025.
- ↑ "Development of ISO 639-2". Language Coding Agency. Library of Congress. 19 July 2024. ఒరిజినల్ పేజీని చూసిన తేదీ: 5 October 2025.
- ↑ "ISO 639-2: Codes for the representation of names of languages -- Part 2: Alpha-3 code - HL7 Terminology (THO) v6.5.0". Health Level Seven International. the original నుండి 2020-08-05 న ఆర్కైవు చెయ్యబడింది. ఒరిజినల్ పేజీని చూసిన తేదీ: 5 October 2025.
- ↑ "Codes for the representation of names of languages - Part 3: Alpha-3 code for comprehensive coverage of languages". Slovenski inštitut za standardizacijo. 6 November 2008. ఒరిజినల్ పేజీని చూసిన తేదీ: 5 October 2025.
.Likewise, elements other than collections listed in ISO 639-2 are a subset of those listed ISO 639-3; each non-collective element in ISO 639-2 is included in ISO 639-3, but not necessarily vice versa. ... The language code in this part of ISO 639 does not include collective language code elements.
- ↑ "ISO 639-2 Language Code List - Codes for the representation of names of languages". Library of Congress.
- ↑ "ISO 639-2/RA Change Notice". Language Coding Agency. Library of Congress. 17 October 2024. ఒరిజినల్ పేజీని చూసిన తేదీ: 19 October 2025.
- ↑ ISO 639-3/RA Scope of denotation for language identifiers
- ↑ "ISO 639-2 Language Code List - Codes for the representation of names of languages". Library of Congress.
- ↑ "Pseudo-Locales - Win32 apps". Microsoft Learn. 2021-01-07. ఒరిజినల్ పేజీని చూసిన తేదీ: 2023-08-31.