빌리빌리의 Index-Translate는 Qwen3.5를 기반으로 한 번역 모델군이다. 텍스트 번역뿐 아니라 음성 자막과 더빙, 목표 음절 수에 맞춘 번역, 장문서 번역 등 작업별 모델과 도구를 제공한다. 텍스트 모델은 2B·9B·35B-A3B 프리뷰로 나뉘며, 150개 언어를 지원한다고 소개됐다. 다만 모든 모델이 모든 언어 조합과 작업에서 똑같이 작동한다는 뜻은 아니다.
2
5
텍스트 모델은 세 가지 규모
텍스트 모델은 2B와 9B, 그리고 프리뷰로 표시된 35B-A3B다. 35B-A3B는 전체 매개변수가 350억 개이고 토큰을 처리할 때는 약 30억 개가 활성화되는 혼합 전문가(MoE) 모델이다. 모델 설명에 따르면 이들 텍스트 모델은 150개 언어 번역을 지원하며, 용어 선택이나 형식·문체·구조, 콘텐츠 보존 등 번역 지시를 반영하도록 설계됐다. 다만 공개된 설명만으로 각 규모가 모든 언어쌍에서 같은 성능을 낸다고 단정할 수는 없다.
2
4
5
라이선스는 실제로 내려받아 사용할 모델 파일을 확인하는 게 안전하다. Index-Translate 2B 모델 카드에는 Apache-2.0이 표시돼 있고, 출시 보도도 모델군을 Apache-2.0으로 소개했다. 그래도 배포하거나 활용하려는 각 가중치 파일의 라이선스를 별도로 확인할 필요가 있다.
4
9
음성·더빙·장문 번역은 별도 특화 모델로
- Index-Echo는 음성 번역을 담당한다. 음성을 자막으로 옮기는 워크플로는 중국어 음성·영상에서 영어·일본어·스페인어 자막을 만들고, 타임스탬프와 음성 구간 분할, 문맥 참조, 선택형 용어집을 활용하도록 안내돼 있다. 음성 간 번역·더빙 모델은 원 화자의 목소리 특성을 반영하는 것을 목표로 한다. 이는 설계 방향이지, 매번 동일한 음성 품질을 보장한다는 의미는 아니다.
21
23
- Index-Homura는 지정한 음절 수에 맞춰 번역 표현을 조정한다. 대사 길이가 중요한 더빙 대본을 염두에 둔 기능이다. 다만 음절 수를 맞췄다고 해서 표현이 늘 자연스럽거나 장면에 완벽히 들어맞는다고 볼 수는 없다.
25
27
- Index-NativeLong은 Index-Nailong이라는 이름으로도 공개됐다. 문장을 하나씩 따로 번역하기보다 원문 문서 전체를 입력으로 삼아, 멀리 떨어진 문단 사이의 용어와 지칭, 흐름을 일관되게 유지하는 데 초점을 둔다. 다만 공개된 문서 번역 클라이언트의 고정 템플릿은 중국어↔영어와 중국어↔일본어에 한정돼 있어, 텍스트 모델의 150개 언어 지원과는 범위가 다르다.
3
26
도구와 공개 자료가 보여주는 것
저장소에는 로컬에 배포한 모델을 OpenAI 호환 API로 연결해 웹페이지를 번역하는 브라우저 확장 프로그램도 포함돼 있다. 영상 더빙 안내에는 오디오 추출, 보컬 분리, 타임스탬프가 포함된 음성 구간 분할, 번역, 원래 영상 타임라인에 맞춘 정렬 과정이 나온다. 즉 영상 더빙은 번역 외에도 여러 처리·정렬 단계를 거치는 작업이다.
20
22
팀이 공개한 자료와 예시는 텍스트 번역, 자막, 음절 수 제약이 있는 번역, 장문서 등 여러 용도를 다룬다. 하지만 예시나 자체 평가만으로 특정 모델이 모든 언어와 작업에서 가장 뛰어나다고 입증되지는 않는다. 35B-A3B 텍스트 모델은 프리뷰로 표시돼 있으며, NativeLongBench 결과 중 공유 가능한 자료도 공개 예정으로 안내됐다. 현재 확인 가능한 자료는 각 모델이 무엇을 겨냥하는지 보여주지만, 모든 상황에서 일정한 번역 품질이나 정확한 음성·타이밍·문서 전체 일관성을 보장하지는 않는다.
5
26