10장 Kimi Agent와 Kimi K3를 해부한다
Kimi 계열을 한 제품처럼 말하면 실습이 꼬인다. K3는 모델, Kimi Agent는 범용 실행 제품, Kimi Work는 문서·표 같은 업무 산출물, Kimi Code는 코딩 하니스다. 공식 발표 기준 K3는 대규모 MoE, 네이티브 비전, 최대 100만 토큰 문맥을 내세웠다. 이 숫자는 장문 입력 가능성을 뜻할 뿐 백만 토큰을 넣으면 정확하다는 보증은 아니다.
Kimi의 좋은 역할은 중국어 원문 탐색과 장문 자료의 후보 추출이다. 최종 법률 판단을 맡기지 않는다. 다음 작업 봉투를 Kimi Agent에 넣는다.
목표: 중국 개인정보보호법의 개인정보 처리 원칙 근거를 찾는다.
허용 출처: 정부·법령 원문, 공식 해설.
출력: URL, 문서명, 중국어 원문 1~3문장, 한국어 직역,
적용 범위, 확인일. 찾지 못하면 missing으로 반환한다.
금지: 법률 자문, 블로그만으로 결론, 인용문 창작.
결과를 fixtures/inbox/kimi-BP-01.json으로 저장하고 스키마 검사 후 가져온다. 원문에서 실제 문장을 검색해 일치 여부를 사람이 확인한다. 긴 문맥에서는 페이지 단위 후보를 먼저 좁힌 뒤 최종 근거를 추출하는 2단계가 더 재현 가능하다.
K3의 벤치마크는 역할 선택의 힌트일 뿐 채택 판정이 아니다. Frontend Code Arena 강점은 UI 후보 생성 실험을 정당화하지만, 보안·백엔드·법규 해석까지 우수하다는 증거는 아니다.