한국형 소버린 AI · 개발 중

AI 비용은 국내에,
데이터는 회사 안에.

클라우드에 회사를 올리지 않습니다. 설치해서 소유하는 AI — 사무실 PC 한 대가 서버가 되고, 견적서도 인사기록도 그 안에 머뭅니다.

초기 3개월 무료 · 사용자 무제한 · 전 모듈 개방 예정

원전 · 전자책「AI AX 2.0 — 기업의 미래를 바꾸는 AI AX 대전환」의 철학을 그대로 제품으로 구현한 것이 urinara.ai입니다.책 보러 가기 →
사무실 PC — 우리나라AI

$ 우리나라AI 시작

[엔진] Midm-2.0-Mini-Q4 로드 — 1.4GB

[모듈] 음성 = 켜짐 (화자분리 가능)

[모듈] 문서스캔 = 켜짐 (PP-OCRv5)

[모듈] 이미지·영상 = 꺼짐 — 이 PC 체급 S · GPU 없음

[공유] 사내 접속 http://192.168.0.10:8901

> 준비 완료. 인터넷이 끊겨도 계속 동작합니다.

문제

왜 만드는가

해외 AI 요금 = 외화 유출

AI가 전기·통신처럼 기업 운영의 기본 유틸리티가 될수록, 해외 API 지출은 일회성이 아니라 영구적 구조 비용이 됩니다.

중소기업은 AX에서 소외됩니다

중소기업 AI 활용률 28.7%, 대기업 48.8%. 종량요금이 무서워 시작을 못 합니다. 필요한 건 할인 쿠폰이 아니라 비용 구조 자체의 제거입니다.

— 대한상공회의소, 2026.6

회사 데이터가 밖으로 나갑니다

클라우드 LLM이 학습 데이터를 축어적으로 되뱉을 수 있다는 사실은 이미 실증됐습니다. 견적서·인사기록·거래처 정보를 남의 서버에 올리는 일입니다.

— Carlini et al., arXiv:2012.07805

세 문제의 답은 하나입니다 — 회사 규모에 맞는 AI를 회사가 가지는 것

대기업 수준의 거대 모델이 필요한 게 아닙니다. 견적서 요약하고, 통화 녹음 정리하고, 스캔한 서류에서 숫자 뽑는 일에는 그 일에 맞는 작은 모델이면 충분합니다. 그리고 그 정도는 지금 사무실에 있는 제일 좋은 PC 한 대로 돌아갑니다.

비용이 사라집니다

한 번 설치하면 몇 번을 부르든 한계비용은 전기요금뿐입니다. 직원이 늘어도, 쓰는 횟수가 늘어도 요금이 따라 오르지 않습니다.

데이터가 안 나갑니다

견적서·인사기록·거래처 정보가 회사 PC 안에서 처리되고 그 안에 남습니다. 어디에 올릴지 고민할 일이 없습니다.

AX가 퍼집니다

쓸 때마다 돈이 나가면 아껴 쓰게 되고, 아껴 쓰면 안 퍼집니다. 공짜여야 영업도 총무도 현장도 마음 놓고 씁니다.

도입 방식

한 대에 깔면, 회사 전체가 씁니다

직원 수만큼 설치할 필요가 없습니다. 사무실에서 제일 좋은 컴퓨터 한 대에 깔면, 그 PC가 사내 AI 서버가 됩니다.

STEP 1

제일 좋은 PC 한 대를 고릅니다

새 장비를 사지 않아도 됩니다. 지금 사무실에 있는 것 중 제일 나은 한 대면 시작할 수 있습니다.

STEP 2

그 PC 사양에 맞는 것만 깝니다

하시는 일을 고르면 RAM·코어·GPU를 실제로 재서 되는 모듈만 골라 켭니다. 안 되는 건 “설치해도 동작하지 않는다”고 밝히고 무엇이 얼마나 모자란지 적어줍니다 — 깔아놓고 안 돌아가는 일이 없도록.

STEP 3

사내 어디서든 불러 씁니다 — 공짜로

직원은 브라우저로 접속해 쓰고, 사내 프로그램은 API로 부릅니다. 로컬에서 도는 처리라 호출당 요금이 없습니다.

사내 프로그램에 붙이는 법

OpenAI 호환 규격이라 기존 코드에서 주소만 바꾸면 됩니다. ERP·그룹웨어·엑셀 매크로·직접 만든 스크립트 — 어디서든 같은 방식으로 부릅니다.

# 설치한 PC에서 — 인증 없이 바로
curl http://127.0.0.1:8901/llm/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"local","messages":[{"role":"user","content":"이 견적서 요약해줘"}]}'

# 같은 사무실 다른 PC에서 — 사내 로그인 토큰만 추가
curl http://192.168.0.10:8901/llm/v1/chat/completions \
  -H "Authorization: Bearer <사내 토큰>" ...

공인 인터넷에서는 항상 차단됩니다(사설망 전용). 사내 공유를 켜야 열리고, 허용 이메일과 패스워드 정책을 사장이 정합니다. 아직 준비 중: 개발 도구용 전용 CLI·SDK. 지금은 위 예시처럼 OpenAI 호환 규격으로 직접 부릅니다.

어떤 모듈이 있고 각각 뭐가 필요한지 보기 →

비용 구조

일상 AI는 공짜처럼, 큰 일만 돈 내고

모든 질문을 같은 값에 처리할 이유가 없습니다. 닭 잡는 데 소 잡는 칼을 쓰지 않습니다. 요청의 난도에 따라 아래에서 위로만 올라갑니다.

1계층

내 PC (로컬)

무료

일상 업무의 대부분. 설치한 PC에서 처리하니 한계비용은 전기요금뿐이고, 데이터는 사무실을 떠나지 않습니다.

2계층

urinara.ai 클라우드

저가 종량

로컬이 감당 못 하는 순간에만 넘어갑니다. 국내 정산이라 외화 유출이 없습니다.

3계층

해외 프리미엄

최후 수단

정말 최고 난도만. 그마저도 민감 데이터는 게이트가 먼저 막습니다.

민감도 게이트가 항상 먼저입니다. 개인정보·기밀로 지정한 데이터는 2·3계층으로 절대 올라가지 않고 로컬에서 처리합니다. 완전 폐쇄망(에어갭)은 아예 1계층만 켜고 씁니다.

소버린 AI가 정확히 무엇인지 — 4대 자유·다섯 함정·2026년 동향 정리 →

제품

우리나라AI — 데스크탑

받아서 설치하면 그 PC가 사무실의 AI 서버가 됩니다. 인터넷이 끊겨도 돌아갑니다.

추론 탭

회사를 아는 채팅

회사 지식과 웹검색을 함께 근거로 삼아 답합니다. 회사 규정과 일반 상식을 구분해 말하고, 근거가 없으면 "내부 학습자료 없음"이라고 밝힙니다.

코딩 탭

말로 만드는 업무 앱

"미수금 관리 만들어줘" 한 마디로 테이블을 설계하고 DB를 만들고 화면까지 띄웁니다. 만든 앱은 사내 링크로 공유합니다.

학습 탭

회사 문서를 지식으로

한글·워드·엑셀·PDF·스캔 이미지·회의 녹음·유튜브 영상을 넣으면 회사 지식이 됩니다. 원문 그대로 보존합니다.

사내 공유 — 한 대가 전체를 먹입니다

제일 좋은 PC 한 대에만 설치하면, 같은 사무실 직원들이 브라우저로 접속해 그 자원을 나눠 씁니다. 사설망 안에서만 열리고 공인 IP는 원천 차단합니다.

체급은 PC에 맞춰 고릅니다

설치할 때 하드웨어를 자동으로 살펴 최선 체급(CPU / S / M / L)을 추천합니다. 나중에 PC를 바꾸면 차액만 내고 올리면 됩니다.

모듈

쓸 것만 골라 씁니다

하나의 거대한 모델이 전부를 하지 않습니다. 일마다 그 일을 제일 잘하는 모델을 골라 붙이고, 안 쓰는 모듈은 꺼서 메모리를 돌려받습니다. 아래 숫자는 전부 직접 측정한 값입니다.

대화·요약·판단. 모듈이 아니라 본체라 항상 켜져 있습니다.

엔진
KT Midm-2.0-Mini 2.3B (생성) + Qwen3.5-4B (판단)
라이선스
MIT · Apache-2.0
필요 사양
CPU 8GB RAM부터

실측

  • · 혼종 조합 K-벤치 10/10 — 단일 모델 최고는 9/10
  • · Midm CPU 12.6 t/s · RTX 3090 245.8 t/s
  • · 정직한 한계: 혼종은 CPU에서 느립니다(최장 과제 271초)

라이선스에서 떨어뜨린 모델들 — 성능이 아니라 조건 때문에

설치해서 소유하는 제품이라, 재배포·상업 이용이 막힌 모델은 아무리 좋아도 쓸 수 없습니다. 라이선스 원문을 직접 확인해서 걸러냅니다 — 기사에 “Apache”라고 쓰인 모델이 원문은 아니었던 사례도 있었습니다.

  • ✕ LTX-2 — 커뮤니티 라이선스 — 매출 $10M 게이트·LoRA 파생 구속
  • ✕ HunyuanVideo — territory 조항에 한국 제외 이슈
  • ✕ EXAONE 4.0 — 연구용 제한 — 상업 배포 불가
  • ✕ kanana-2 — 온프레 납품에 별도 상업계약 + 표기 의무 — 1회 구매 모델과 충돌

모델

왜 하나가 아니라 여럿을 섞나

모델마다 잘하는 게 다릅니다. Midm은 한국어 생성이 좋고 판단이 약하며, Qwen은 수치 판단이 좋고 문체가 약합니다. 그래서 생성은 Midm이, 판단은 Qwen이 맡게 나눴더니 단일 모델로는 못 넘던 점수가 나왔습니다.

역할모델라이선스K-벤치생성 속도
혼종 조합

Midm-gen + Qwen-judge

2.3B + 4B

생성은 Midm, 판단은 Qwen이 맡는 역할 분담. 유일한 만점.

—10 / 10CPU
생성 엔진

KT Midm-2.0-Mini-Instruct

2.3B

전 체급 품질 동률 최고이면서 가장 빠름. 약점은 판단류 1문항.

MIT9 / 10CPU 12.6 t/s · 3090 245.8 t/s
판단 전문가

Qwen3.5-4B

4B

수치 판단에 강하고 생성(요약·문체)에 약하다. 그래서 판단만 맡긴다.

Apache-2.09 / 10CPU 8.5 t/s · 3090 169.8 t/s
judge (GPU 24GB)

Qwen3.5-9B

9B

GPU가 있는 회사용 상위 판단 슬롯.

Apache-2.09 / 103090 118.1 t/s
탈락

KT Midm-2.0-Base-Instruct

11.5B

체급을 5배 올려도 판단류 2문항 실패 — 계열 약점이 그대로 남았다.

MIT8 / 103090 97.0 t/s
탈락

SKT A.X-4.0-Light

7B

요약·존댓말 실패에 속도도 최저.

Apache-2.08 / 10CPU 6.0 t/s

K-벤치 v0 · 2026년 7월 10일 실측 · 10문항(회의 요약·공지 작성·사과 문자·수치 판단 등 실무 과제) · Q4_K_M 양자화 · CPU는 8스레드, GPU는 RTX 3090 기준. 정직한 한계: 혼종 조합은 CPU에서 느립니다(최장 과제 271초). SKT A.X-K1(519B MoE)은 노드급이라 미실측 상태로 상위 슬롯만 잡아두었습니다.

화면

실제 화면

아래는 개발 중인 앱을 지금 실행해서 그대로 캡처한 화면입니다. 목업이나 상상도가 아닙니다.

우리나라AI — 추론
우리나라AI 추론 탭 화면

물어보면 내 PC가 답합니다

“거래처가 대금을 자꾸 늦게 줍니다”에 대응 순서를 매겨 답한 실제 화면입니다. 회사 자료에 근거가 없으면 지어내지 않고 “내부 학습자료 없음”이라고 밝히고, 참고한 출처를 아래에 그대로 답니다.

가격

사는 것이지, 구독하는 것이 아닙니다

출시 초기

3개월 무료

  • · 사용자 수 무제한
  • · 음성·문서스캔·영상 전 모듈 개방
  • · 결제수단 등록 없음

이후

사용자 수 × 기간

  • · 음성·문서스캔·영상은 쓰는 것만 애드온
  • · 같은 체급 버전업은 무료 (적용 여부도 선택)
  • · 상위 체급은 차액만
  • · 로컬 처리분은 얼마를 쓰든 0원

락인이 없습니다. 떠나기로 하면 데이터는 이미 그쪽 PC에 있으니 가져갈 것도 없습니다.

진행 상황

지금 어디까지 왔는가

개발 중인 제품입니다. 되는 것과 안 되는 것을 그대로 적습니다 — 이걸 흐리면 소버린을 말할 자격이 없습니다.

실제로 동작합니다

  • · 용도를 고르면 이 PC 사양을 재서 되는 모듈만 켜주는 설치 마법사
  • · 사내 어디서든 부르는 OpenAI 호환 API (로컬이라 호출당 요금 0)
  • · 로컬 모델 대화 (실모델 검증 완료)
  • · 회사 문서·스캔 OCR·회의 녹음 전사
  • · 말로 만드는 업무 DB·관리 앱·홈페이지
  • · 사내 LAN 공유 — PC 한 대가 사무실 전체를 먹임
  • · 웹검색 결합 근거 답변
  • · MCP 커넥터 (파일·GitHub·Notion·Slack 등)

아직 안 됩니다

  • · Windows 설치본 — 패키징 준비 중 (지금은 개발 빌드만)
  • · 개발 도구용 전용 CLI·SDK — API는 되지만 편의 도구는 아직
  • · 홈페이지 결제·라이선스 자동 발급 — 개발 중
  • · 작은 모델의 답변 품질 편차 — 체급을 올려야 해결됩니다
  • · 클라우드 2계층 종량 API — 설계 완료, 미가동

FAQ

자주 묻는 질문

우리나라AI는 무엇인가요?

사무실 PC 한 대에 설치해서 회사 전체가 나눠 쓰는 기업용 AI입니다. 클라우드에 회사 데이터를 올리지 않고, 설치한 PC 안에서 처리하고 그 안에 남깁니다. 인터넷이 끊겨도 동작합니다.

직원 수만큼 설치해야 하나요?

아닙니다. 사무실에서 제일 좋은 컴퓨터 한 대에만 설치하면 그 PC가 사내 AI 서버가 됩니다. 직원은 브라우저로 접속해 쓰고, 사내 프로그램은 API로 부릅니다.

쓸수록 요금이 올라가나요?

1계층(로컬)에서 처리되는 일은 몇 번을 부르든 호출당 요금이 없습니다. 한계비용은 전기요금뿐입니다. 로컬이 감당하지 못하는 요청만 2계층(urinara.ai 클라우드·저가 종량)으로, 정말 최고 난도만 3계층(해외 프리미엄)으로 올라갑니다.

회사 데이터가 외부로 나가나요?

민감도 게이트가 항상 먼저 걸립니다. 개인정보·기밀로 지정한 데이터는 2·3계층으로 올라가지 않고 로컬에서만 처리됩니다. 완전 폐쇄망(에어갭)에서는 1계층만 켜고 씁니다.

GPU가 없는 PC에서도 되나요?

설치 마법사가 RAM·코어·GPU를 실제로 측정해 그 PC에서 되는 모듈만 켭니다. 안 되는 모듈은 설치하지 않고, 무엇이 얼마나 모자란지 알려줍니다. 예를 들어 GPU가 없으면 음성·문서스캔은 켜지고 이미지·영상 생성은 꺼집니다.

기존 사내 프로그램에 붙일 수 있나요?

OpenAI 호환 규격이라 기존 코드에서 주소만 바꾸면 됩니다. ERP·그룹웨어·엑셀 매크로·직접 만든 스크립트 모두 같은 방식으로 호출합니다. 사설망 전용이라 공인 인터넷에서는 항상 차단됩니다.

어떤 문서를 회사 지식으로 넣을 수 있나요?

한글·워드·엑셀·PDF·스캔 이미지·회의 녹음·유튜브 영상을 넣으면 회사 지식이 됩니다. 원문은 그대로 보존합니다. 답변할 때는 회사 규정과 일반 상식을 구분해 말하고, 근거가 없으면 "내부 학습자료 없음"이라고 밝힙니다.

가격은 어떻게 되나요?

출시 초기에는 3개월 무료이고 사용자 수 제한이 없으며 결제수단을 등록하지 않습니다. 이후에는 사용자 수 × 기간으로 과금하고, 음성·문서스캔·영상은 쓰는 것만 애드온으로 더합니다. 같은 체급의 버전업은 무료이고, 로컬에서 처리된 분량은 얼마를 쓰든 0원입니다.

지금 바로 설치할 수 있나요?

아직 아닙니다. Windows 설치본은 패키징 준비 중이고 현재는 개발 빌드만 있습니다. 사전등록을 해두시면 설치본이 나오는 대로 메일로 보내드리고, 초기 무료 3개월도 이 명단부터 열립니다.

사전등록

준비되면 가장 먼저 알려드릴게요

Windows 설치본이 나오면 메일로 보내드립니다. 초기 무료 3개월도 이 명단부터 열립니다.

출시·베타 안내 목적으로만 사용하고 제3자에게 제공하지 않습니다. 수신 거부 시 즉시 삭제합니다.