oz1115/korean-pretraining-corpus-ko
Updated • 15
한국어 Foundation Model (GPT-style, From Scratch)
이 모델은 처음부터(from scratch) 학습된 한국어 생성 모델입니다.
from transformers import AutoTokenizer, AutoModel
tokenizer = AutoTokenizer.from_pretrained("oz1115/korean-gpt-150m-ko")
model = AutoModel.from_pretrained("oz1115/korean-gpt-150m-ko", trust_remote_code=True)
prompt = "인공지능의 미래는"
inputs = tokenizer(prompt, return_tensors="pt")
outputs = model.generate(inputs["input_ids"], max_length=50)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))
## Citation
@misc{korean-gpt-150m-ko,
author = {oz1115},
title = {korean-gpt-150m-ko: Korean Foundation Model},
year = {2025},
publisher = {HuggingFace},
url = {https://huggingface.co/oz1115/korean-gpt-150m-ko}
}
## Contact
HuggingFace: @oz1115
## License
MIT