π°π· νκ΅μ΄ ννμ λΆμ 4 μμ§μ NSDevil μ΄ μ체 κ°λ°Β·λ΄μ¬νν λ¨μΌ 컨ν μ΄λ ν΅ν© ν ν¬λμ΄μ μ λλ€. μΈλΆ λΌμ΄λΈλ¬λ¦¬(Nori/MeCab-ko/Khaiii/Komoran) μμ‘΄μ±μ λͺ¨λ μ κ±°νκ³ μμ Python μΌλ‘ μ¬κ΅¬ν + μ체 GT κΈ°λ° ν΄λ¦¬μ€ν± μ¬μ κ°νλ‘, κΈ°μ‘΄ 5-컨ν μ΄λ ensemble λλΉ token μ νλ +0.661%p / sentence μ νλ +0.600%p / p50 latency 1.85Γ / λΆν throughput 3.73Γ (conc=16) μ λμ λ¬μ±ν NSDevil μμ°μ λλ€ (5ν deterministic μ€μΈ‘, std=0.0000).
πΊπΈ NSD Tokenizer v2.2 is NSDevil's in-house Korean morphological analyzer integrating 4 engines into a single container. All external library dependencies (Nori/MeCab-ko/Khaiii/Komoran) have been replaced by pure-Python re-implementations + an in-house GT-driven heuristic dictionary, delivering +0.661%p token accuracy / +0.600%p sentence accuracy / 1.85Γ p50 latency / 3.73Γ throughput at conc=16 over the legacy 5-container ensemble (5-run deterministic measurement, std=0.0000).