1. TAGNT
Translators Amalgamated Greek New Testament
What it is. TAGNT is an open, word-by-word Greek New Testament text. It amalgamates the major scholarly editions of the Greek NT into one tagged text where every word carries its lemma, parsing, and Strong number. It was created by Tyndale House, Cambridge and is now curated by STEPBible.org.
How it is used here. TAGNT is the base data for this whole glossary. Every lemma, frequency count, and book distribution you see was produced by parsing the two TAGNT files (TAGNT_Mat-Jhn.txt and TAGNT_Act-Rev.txt) one word at a time.
1. TAGNT
Translators Amalgamated Greek New Testament — орчуулагчдад зориулсан нэгтгэсэн Грек Шинэ Гэрээ
Юу вэ. TAGNT нь үг бүрээр нь тэмдэглэсэн, нээлттэй Грек Шинэ Гэрээний эх бичвэр юм. Энэ нь Грек Шинэ Гэрээний судалгааны гол хэвлэлүүдийг нэг тэмдэглэгээтэй эх бичвэр болгон нэгтгэдэг бөгөөд үг бүр lemma (толгой үг), хэл зүйн шинжилгээ, Strong's number (Стронгийн дугаар)-тай. Үүнийг Tyndale House, Cambridge бүтээсэн бөгөөд одоо STEPBible.org хариуцан хөтөлдөг.
Энд хэрхэн ашигладаг вэ. TAGNT нь энэ нэр томьёоны толийн бүх үндсэн өгөгдөл юм. Энд харагдах lemma бүр, давтамжийн тоо, ном тус бүрээрх тархалтыг TAGNT-ийн хоёр файл (TAGNT_Mat-Jhn.txt болон TAGNT_Act-Rev.txt)-ыг үг нэг бүрээр шинжилж гаргасан.
1. TAGNT
Translators Amalgamated Greek New Testament(번역자 통합 그리스어 신약성경)
무엇인가. TAGNT는 공개된 단어 단위 그리스어 신약성경 본문입니다. 주요 그리스어 신약성경 비평본들을 하나로 통합(amalgamate)하여, 각 단어에 lemma, 문법 분석, Strong 번호를 태깅한 본문입니다. 틴데일 하우스 케임브리지에서 만들었고 현재 STEPBible.org에서 관리합니다.
여기에서 어떻게 쓰이는가. TAGNT는 이 용어집 전체의 기초 데이터입니다. 여기에서 볼 수 있는 모든 lemma, 빈도수, 권별 분포는 두 TAGNT 파일(TAGNT_Mat-Jhn.txt와 TAGNT_Act-Rev.txt)을 한 단어씩 분석하여 산출한 것입니다.
2. TBESG
Translators Brief lexicon of Extended Strongs for Greek
What it is. TBESG is a concise Greek lexicon (dictionary) keyed to extended Strong's numbers. For each Greek word it gives a short gloss (a quick meaning) and a fuller definition with grammatical notes and example references. It comes from the same STEPBible dataset as TAGNT.
How it is used here. TBESG supplies the meaning side of each entry. It is matched (joined) onto every lemma by Strong number, filling the tbesg.gloss and tbesg.definition fields.
2. TBESG
Translators Brief Lexicon of Extended Strongs for Greek — орчуулагчдад зориулсан өргөтгөсөн Стронгийн дугаартай Грек хэлний товч толь
Юу вэ. TBESG нь өргөтгөсөн Strong's number-т тулгуурласан Грек хэлний товч lexicon (толь бичиг) юм. Грек үг бүрд товч gloss (богино утга), мөн хэл зүйн тэмдэглэл, жишээ лавлагаа бүхий дэлгэрэнгүй тодорхойлолт өгдөг. Энэ нь TAGNT-тай адил STEPBible өгөгдлийн сангаас гаралтай.
Энд хэрхэн ашигладаг вэ. TBESG нь бичлэг бүрийн утгын хэсгийг өгнө. Strong's number-аар lemma бүрд тааруулан нэгтгэж, tbesg.gloss болон tbesg.definition талбарыг дүүргэдэг.
2. TBESG
Translators Brief lexicon of Extended Strongs for Greek(번역자를 위한 확장 Strong 그리스어 간이 사전)
무엇인가. TBESG는 확장(extended) Strong 번호를 기준으로 구성한 간결한 그리스어 사전입니다. 그리스어 단어마다 짧은 뜻풀이(gloss)와 문법 설명 및 용례 참조가 딸린 더 자세한 정의를 제공합니다. TAGNT와 같은 STEPBible 데이터셋에서 나왔습니다.
여기에서 어떻게 쓰이는가. TBESG는 각 항목의 의미 부분을 제공합니다. Strong 번호를 기준으로 모든 lemma에 매칭(조인)되어 tbesg.gloss와 tbesg.definition 필드를 채웁니다.
3. Strong's numbers
The join key between text and lexicon
What it is. Strong's numbers are unique identifiers assigned to each distinct biblical word, originally from Strong's Concordance. Greek words use a G prefix, e.g. G3588 for the article ὁ. Extended Strong numbers add letter suffixes to cover words the original list never numbered.
How it is used here. The Strong number is the key that links the two halves of the data: it lets each TAGNT word be joined to its TBESG lexicon entry. If two forms share a Strong number, they share a dictionary meaning.
ὁ carries Strong G3588, so its TBESG definition is pulled in by matching on G3588.3. Strong's numbers (Стронгийн дугаар)
Эх бичвэр ба үгийн санг холбох түлхүүр
Юу вэ. Strong's numbers (Стронгийн дугаар) нь Библи судрын ялгаатай үг бүрд өгсөн давтагдашгүй таних дугаар бөгөөд анх Strong's Concordance-оос үүсэлтэй. Грек үгэнд G угтвар хэрэглэнэ. Жишээлбэл, ὁ артиклийн дугаар нь G3588. Өргөтгөсөн Strong's numbers нь анхны жагсаалтад дугаар өгөөгүй үгсийг хамруулахын тулд үсгэн дагавар нэмдэг.
Энд хэрхэн ашигладаг вэ. Strong's number нь өгөгдлийн хоёр хэсгийг холбох түлхүүр: TAGNT-ийн үг бүрийг TBESG-ийн толь бичгийн бичлэгтэй нэгтгэх боломж олгоно. Хоёр хэлбэр ижил Strong's number-той бол тэдгээр нь толь бичгийн ижил утгатай байна.
ὁ нь Strong G3588-тай тул G3588-ыг тааруулж TBESG-ийн тодорхойлолтыг авч холбоно.3. Strong 번호
본문과 사전을 연결하는 결합 키
무엇인가. Strong 번호는 서로 다른 성경 단어마다 부여한 고유 식별자로, 본래 Strong's Concordance(스트롱 성구 사전)에서 유래했습니다. 그리스어 단어에는 G 접두사를 사용합니다. 예를 들어 관사 ὁ의 번호는 G3588입니다. 확장(extended) Strong 번호는 원래 목록에서 번호를 받지 못한 단어까지 포함하도록 알파벳 접미사를 덧붙입니다.
여기에서 어떻게 쓰이는가. Strong 번호는 데이터의 두 부분을 연결하는 키입니다. 이 번호로 TAGNT의 각 단어를 해당 TBESG 사전 항목과 결합합니다. 두 형태가 같은 Strong 번호를 공유하면 같은 사전적 의미를 공유합니다.
ὁ에는 Strong 번호 G3588이 있으므로, G3588을 매칭하여 TBESG 정의를 가져옵니다.4. lemma (headword)
The dictionary form you would look up
What it is. A lemma is the base, dictionary form of a word — the form you would find as a headword in a lexicon (e.g. ὁ). Greek is heavily inflected, so one lemma can appear in the text under many different endings; all of them "belong to" the same lemma.
How it is used here. The glossary has one row per lemma. Its freq counts every occurrence that reduces to that lemma, and its meaning is attached once at the lemma level.
4. lemma (толгой үг)
Толь бичгээс хайх үндсэн хэлбэр
Юу вэ. Lemma (толгой үг) гэдэг нь үгийн үндсэн, толь бичгийн хэлбэр буюу lexicon-д толгой үг болон бичигдэх хэлбэр (жишээлбэл ὁ) юм. Грек хэл хувилал ихтэй тул нэг lemma эх бичвэрт олон өөр төгсгөлтэй гарч болно; тэдгээр нь бүгд ижил lemma-д «харьяалагдана».
Энд хэрхэн ашигладаг вэ. Нэр томьёоны тольд lemma бүрд нэг мөр байна. Түүний freq нь тухайн lemma-д хураагдах бүх тохиолдлыг тоолох бөгөөд утгыг lemma-ийн түвшинд нэг удаа холбоно.
4. lemma(표제어)
사전에서 찾아볼 기본형
무엇인가. lemma는 단어의 기본형, 곧 사전에서 표제어로 찾을 수 있는 형태입니다(예: ὁ). 그리스어는 굴절이 많아서 하나의 lemma가 본문에서 서로 다른 여러 어미 형태로 나타날 수 있으며, 이 형태들은 모두 같은 lemma에 속합니다.
여기에서 어떻게 쓰이는가. 이 용어집에는 lemma마다 한 행이 있습니다. freq는 해당 lemma로 환원되는 모든 출현을 세며, 의미는 lemma 수준에서 한 번 연결됩니다.
5. surface form
The word exactly as it appears in the text
What it is. A surface form is the actual inflected form a word takes in a given verse — the letters as printed — before it is reduced to its lemma. One lemma yields many surface forms depending on case, number, tense, and so on.
τὸν is a surface form of the lemma ὁ. Same headword, different ending.How it is used here. Each lemma's rep_verse.text_el shows one real surface form in its verse context, so you can see how the dictionary form looks in running text.
5. surface form (бичвэрт гарч буй хэлбэр)
Эх бичвэрт яг харагдах үг
Юу вэ. Surface form (бичвэрт гарч буй хэлбэр) нь тухайн ишлэлд үгийн авсан бодит хувилсан хэлбэр, өөрөөр хэлбэл lemma-д хураахаас өмнө хэвлэгдсэн яг тэр үсгүүд юм. Нэг lemma нь тийн ялгал, тоо, цаг зэрэгт тохирон олон surface form-оор гарна.
τὸν нь lemma ὁ-гийн surface form юм. Толгой үг нь адил, төгсгөл нь өөр.Энд хэрхэн ашигладаг вэ. Lemma бүрийн rep_verse.text_el нь ишлэлийн хам сэдэвт буй нэг бодит surface form-ыг харуулдаг. Ингэснээр толь бичгийн хэлбэр үргэлжилсэн эх бичвэрт хэрхэн харагддагийг үзэж болно.
5. surface form(표면형)
본문에 실제로 나타난 그대로의 단어 형태
무엇인가. surface form은 특정 구절에서 단어가 실제로 취하는 굴절형, 곧 lemma로 환원되기 전 인쇄된 그대로의 글자입니다. 하나의 lemma는 격, 수, 시제 등에 따라 여러 surface form으로 나타납니다.
τὸν은 lemma ὁ의 surface form입니다. 표제어는 같지만 어미가 다릅니다.여기에서 어떻게 쓰이는가. 각 lemma의 rep_verse.text_el은 구절 문맥 속의 실제 surface form 하나를 보여 주므로, 사전형이 실제 본문에서 어떤 형태로 나타나는지 확인할 수 있습니다.
6. NT book codes (27 books)
Three-letter codes for the New Testament books
What it is. STEPBible/TAGNT identifies each of the 27 New Testament books with a short three-letter code. In canonical order: Mat, Mrk, Luk, Jhn, Act, Rom, 1Co, 2Co, Gal, Eph, Php, Col, 1Th, 2Th, 1Ti, 2Ti, Tit, Phm, Heb, Jas, 1Pe, 2Pe, 1Jn, 2Jn, 3Jn, Jud, Rev.
How it is used here. The book_dist field keys each lemma's frequency by these codes, and verse references such as Mat.1.2 use them as the book part.
6. Шинэ Гэрээний номын кодууд (27 ном)
Шинэ Гэрээний ном бүрийн гурван тэмдэгт код
Юу вэ. STEPBible/TAGNT нь Шинэ Гэрээний 27 ном бүрийг гурван тэмдэгт богино кодоор танина. Тогтсон номын дарааллаар: Mat, Mrk, Luk, Jhn, Act, Rom, 1Co, 2Co, Gal, Eph, Php, Col, 1Th, 2Th, 1Ti, 2Ti, Tit, Phm, Heb, Jas, 1Pe, 2Pe, 1Jn, 2Jn, 3Jn, Jud, Rev.
Энд хэрхэн ашигладаг вэ. book_dist талбар нь lemma бүрийн давтамжийг эдгээр кодоор ялган хадгалдаг бөгөөд Mat.1.2 зэрэг ишлэлийн лавлагаанд тэдгээрийг номын хэсэг болгон хэрэглэдэг.
6. 신약성경 권명 코드(27권)
신약성경 각 권을 나타내는 세 글자 코드
무엇인가. STEPBible/TAGNT는 신약성경 27권을 각각 짧은 세 글자 코드로 나타냅니다. 정경 순서는 다음과 같습니다. Mat(마태오 복음서), Mrk(마르코 복음서), Luk(루카 복음서), Jhn(요한 복음서), Act(사도행전), Rom(로마 신자들에게 보낸 서간), 1Co(코린토 신자들에게 보낸 첫째 서간), 2Co(코린토 신자들에게 보낸 둘째 서간), Gal(갈라티아 신자들에게 보낸 서간), Eph(에페소 신자들에게 보낸 서간), Php(필리피 신자들에게 보낸 서간), Col(콜로새 신자들에게 보낸 서간), 1Th(테살로니카 신자들에게 보낸 첫째 서간), 2Th(테살로니카 신자들에게 보낸 둘째 서간), 1Ti(티모테오에게 보낸 첫째 서간), 2Ti(티모테오에게 보낸 둘째 서간), Tit(티토에게 보낸 서간), Phm(필레몬에게 보낸 서간), Heb(히브리인들에게 보낸 서간), Jas(야고보 서간), 1Pe(베드로의 첫째 서간), 2Pe(베드로의 둘째 서간), 1Jn(요한의 첫째 서간), 2Jn(요한의 둘째 서간), 3Jn(요한의 셋째 서간), Jud(유다 서간), Rev(요한 묵시록).
여기에서 어떻게 쓰이는가. book_dist 필드는 이 코드들을 키로 사용하여 각 lemma의 빈도를 권별로 나눕니다. Mat.1.2와 같은 구절 참조에서도 이 코드가 권명 부분에 쓰입니다.
7. TAGNT token
One running word in the text
What it is. A token is a single word-occurrence in the TAGNT text — one running word as it appears, counted individually. Tokens are the raw units; grouping tokens by their lemma is what produces headword entries.
How it is used here. The freq figure counts tokens, not lemmas. A frequency of 20,754 for the lemma ὁ means that word occurs as 20,754 separate tokens across the New Testament.
7. TAGNT token
Эх бичвэрийн урсгал дахь нэг үг
Юу вэ. Token (токен) нь TAGNT эх бичвэрт нэг үг тусдаа гарсан тохиолдол буюу харагдах байдлаар нь нэг бүрчлэн тоолсон урсгалын нэг үг юм. Token-ууд бол боловсруулаагүй үндсэн нэгж; тэдгээрийг lemma-аар бүлэглэснээр толгой үгийн бичлэгүүд үүснэ.
Энд хэрхэн ашигладаг вэ. freq тоо нь lemma-г бус, token-ыг тоолно. Lemma ὁ-ийн давтамж 20,754 гэдэг нь уг үг Шинэ Гэрээ даяар 20,754 тусдаа token болж гарсныг илэрхийлнэ.
7. TAGNT token(토큰)
본문의 흐름 속에 나타난 단어 하나
무엇인가. token은 TAGNT 본문에 나타나는 단어의 개별 출현 하나, 곧 실제로 나타난 대로 하나씩 세는 단어입니다. token은 기초 데이터 단위이며, token들을 lemma별로 묶으면 표제어 항목이 만들어집니다.
여기에서 어떻게 쓰이는가. freq 수치는 lemma가 아니라 token을 셉니다. lemma ὁ의 빈도가 20,754라면, 이 단어가 신약성경 전체에서 20,754개의 개별 token으로 나타난다는 뜻입니다.
8. representative verse
One fixed example citation per lemma
What it is. The representative verse is the lemma's first occurrence in canonical New Testament order, pinned as its standing example. It records three parts: ref (the reference, e.g. Mat.1.2), text_el (the Greek surface form there), and gloss (a short meaning).
How it is used here. Fixing the first occurrence gives every lemma one concrete, reproducible citation instead of an arbitrary pick, so the example never shifts between runs.
8. representative verse (төлөөлөх ишлэл)
Lemma бүрд зориулсан нэг тогтмол жишээ ишлэл
Юу вэ. Representative verse (төлөөлөх ишлэл) нь тухайн lemma Шинэ Гэрээний тогтсон номын дарааллаар анх гарсан ишлэлийг тогтмол жишээ болгон сонгосон ишлэл юм. Энэ нь гурван хэсэг хадгална: ref (лавлагаа, жишээлбэл Mat.1.2), text_el (тухайн газрын Грек surface form), gloss (богино утга).
Энд хэрхэн ашигладаг вэ. Анхны тохиолдлыг тогтоосноор lemma бүрд санамсаргүй сонголтын оронд бодит, дахин адил гаргаж болох нэг ишлэл өгнө. Тиймээс ажиллуулах бүрд жишээ солигдохгүй.
8. representative verse(대표 구절)
lemma마다 고정한 예시 구절 하나
무엇인가. representative verse는 신약성경의 정경 순서에서 해당 lemma가 처음 나타나는 곳을 고정 예시로 삼은 것입니다. 세 부분을 기록합니다. ref(참조, 예: Mat.1.2), text_el(그곳의 그리스어 surface form), gloss(짧은 뜻)입니다.
여기에서 어떻게 쓰이는가. 첫 출현을 고정하면 임의로 고른 예시 대신 lemma마다 구체적이고 재현 가능한 참조 하나를 제공할 수 있으며, 실행할 때마다 예시가 바뀌지 않습니다.
9. TBESG joined (statistics)
How completely the lexicon attaches to the text
What it is. "TBESG joined" describes the result of matching TBESG lexicon entries onto the TAGNT lemma rows by Strong number. The join statistic reports how many lemma rows received a lexicon entry.
How it is used here. In the current build the join is complete: 5,412 / 5,412 lemmas (100%) carry a TBESG entry. Because coverage is total, every row holds both its TAGNT frequency data and its TBESG gloss and definition — no lemma is left without a meaning.
9. TBESG joined (нэгтгэлийн статистик)
Үгийн сан эх бичвэртэй хэр бүрэн холбогдсоныг харуулах үзүүлэлт
Юу вэ. «TBESG joined» (TBESG нэгтгэл) гэдэг нь TBESG-ийн толь бичгийн бичлэгүүдийг Strong's number-аар TAGNT-ийн lemma мөрүүдэд тааруулсан үр дүнг хэлнэ. Нэгтгэлийн статистик нь хэдэн lemma мөр толь бичгийн бичлэгтэй болсныг мэдээлдэг.
Энд хэрхэн ашигладаг вэ. Одоогийн бүрдэлд нэгтгэл бүрэн: 5,412 / 5,412 lemma (100%) TBESG бичлэгтэй. Хамрах хүрээ бүрэн учраас мөр бүр TAGNT-ийн давтамжийн өгөгдөл болон TBESG-ийн gloss, definition-ыг хоёуланг нь агуулна; утгагүй үлдэх lemma байхгүй.
9. TBESG joined(결합 통계)
사전이 본문 데이터에 얼마나 완전하게 연결되었는가
무엇인가. "TBESG joined"는 Strong 번호를 기준으로 TBESG 사전 항목을 TAGNT lemma 행에 매칭한 결과를 뜻합니다. 결합 통계는 사전 항목을 받은 lemma 행의 수를 보여 줍니다.
여기에서 어떻게 쓰이는가. 현재 빌드에서는 결합이 완전합니다. 5,412개 lemma 중 5,412개(100%)가 TBESG 항목을 가집니다. 전체가 연결되어 있으므로 모든 행에는 TAGNT 빈도 데이터와 TBESG의 gloss 및 definition이 함께 들어 있으며, 뜻풀이가 누락된 lemma는 하나도 없습니다.