NII가 개발한 일본어 특화 대규모 언어 모델입니다. 150M~172B까지 8가지 크기로 제공됩니다. llm-jp-corpus v3로 학습했으며, Instruct2/Instruct3를 통해 SFT 및 DPO를 지원합니다. (13B 이하 모델은 Apache 2.0 라이선스)
파라미터
Undisclosed
컨텍스트
라이선스
Proprietary
출시일
2025-03-12
API 가격
이 모델의 API 가격 정보는 현재 공개되지 않았습니다
강점
- •일본어 처리에 특화되어 높은 성능을 발휘합니다.
- •다양한 크기의 모델로 배포되어 유연한 선택이 가능합니다.
- •SFT/DPO 등 다양한 지도학습 및 선호도 기반 학습을 적용했습니다.
약점
- •13B 이상의 모델은 Apache 2.0 라이선스가 아닙니다.
- •일본어 외 다른 언어 처리 성능은 상대적으로 낮을 수 있습니다.
- •초대규모 모델(172B)은 많은 연산 자원을 요구합니다.
활용 사례
- •일본어 텍스트 생성 및 요약 작업
- •한국어/일본어 번역 등 다국어 처리 과제
- •한국어 학습 데이터가 제한적인 환경에서의 한국어 NLP 연구