NII가 개발한 일본어 특화 대규모 언어 모델입니다. 150M~172B까지 8가지 크기로 제공됩니다. llm-jp-corpus v3로 학습했으며, Instruct2/Instruct3를 통해 SFT 및 DPO를 지원합니다. (13B 이하 모델은 Apache 2.0 라이선스)
파라미터
Undisclosed
컨텍스트
라이선스
Proprietary
출시일
2025-01-29
API 가격
이 모델의 API 가격 정보는 현재 공개되지 않았습니다
강점
- •172B 파라미터의 초대규모 모델로 높은 추론 능력을 보유합니다.
- •일본어 데이터로 집중 학습되어 해당 언어에 대한 깊은 이해를 가집니다.
- •SFT와 DPO를 통해 지시를 잘 따르는 응답을 생성합니다.
약점
- •추론 및 운영에 엄청난 연산 자원(GPU 메모리 등)이 필요합니다.
- •Apache 2.0 라이선스가 적용되지 않아 상업적 사용에 제한이 있을 수 있습니다.
- •초대규모 모델 특유의 할루시네이션(환각) 가능성이 존재합니다.
활용 사례
- •고성능이 필요한 일본어 질의응답 및 콘텐츠 생성 시스템
- •일본어 특화 복잡한 추론 및 분석 과제
- •대규모 연산 자원을 확보한 연구 기관이나 기업의 NLP 연구