모두의 창업 메모 및 노트
아이디어 제출 및 신속 심사 합격
혁신은 바라지 않지만, HWP는 원하지 않았습니다.
- 실무 개선사항을 아이디어로 제출했습니다.
- 신속 심사 요건 검토 메일을 수신했습니다.
- HWP 파일로 작성을 요구하여, 노트북을 대여해 작성했습니다.
- HWP가 전면에 등장하는 것을 보고, macOS 및 Linux 사용자 앞에는 험난한 길이 펼쳐질 것이라 예상하여, 당근마켓에서 HWP와 CUDA 구동이 가능한 윈도우 노트북을 150만 원에 급히 공수했습니다.
1라운드 합격
빠른 MVP로 신속한 배포를 준비하겠습니다.
- 1라운드에 합격했습니다.
- 1차 심사 통과에 따라 프로필 등을 보완하고 MVP 모델 설계에 착수했습니다.
- 계획과 알파 버전을 빠르게 다듬어 주변에 피드백을 구했습니다.
개인정보 유출
회사는 망하지 않았고, 정부도 망하지 않습니다.
- 모두의 창업 사이트 서버 API의 JSON 응답을 통해 개인정보가 유출되었습니다.
- 개인정보 유출 시 회사를 망하게 하겠다던 대통령의 공언이 생각납니다만, 과연 중소벤처기업부는 어떻게 될지 의문입니다.
- 이 대통령 “개인정보 유출 기업, ‘회사 망한다’ 생각 들도록”
첫번째 킥오프
몇가지 개선사항을 논의 중에 발견했습니다.
- 첫 번째 멘토링에서 몇가지 의견 및 향후 과정을 논의했습니다.
- 창업 지원비를 신청했습니다.
- 신한카드에서 선불금 형태로 지원받았습니다.
창업지원금 사용 관련 애로사항
다소 아쉬운 부분입니다.
- MVP 제작 비용 200만 원을 신한 선불카드 형태로 지급받았습니다.
- 도서 및 재료비 지원 규정에 맞춰 개발 보드용 하드웨어와 TUI 모니터링 시스템을 구상했습니다.
- 필요 사양은 16GB RAM 이상에 NPU 6TOPS 이상을 충족하는 개발보드입니다.
- 도메인 및 호스팅, 기타 SW 비용으로 충분하리라 예상했습니다.
- PG사 결제가 승인되지 않아, 일반적인 온라인 쇼핑몰 결제가 차단되었습니다.
- 온라인으로 결제할 수 없어 오프라인 매장에 직접 방문해 결제를 시도해야 한다는 주관기관의 답변을 받았습니다. 오프라인 매장에 가더라도 카드가 정상 승인될지는 확신할 수 없는 상황입니다.
- 부품을 구매하려면 KTX 비용을 자비로 부담하며 용산 총판에 가야 하고, 결제조차 확실치 않은 카드를 들고 서울과 부산을 왕복해야 하는 실정입니다.
- 정부가 5극 3특을 추진하지만, 아직은 서울 거주자에게 유리한 지원금 정책으로 보입니다.
- 서울 강남 거주자는 50분 만에 오프라인 총판에 들러 결제 여부를 확인할 수 있지만, 지방 거주자는 왕복 6시간을 들여 결제 가능 여부를 확인해야 하는 현실입니다.
- 국민신문고에 민원을 제기했으나 답변 예정일이 7월 3일로 지정되어, 두 달의 짧은 수행 기간 중 행정 처리에 상당한 시간을 허비하고 있습니다.
- 이후 7월 14일로 답변이 연기되었습니다.
창업지원금으로 도서 구매
갓 구글! PG사를 거치지 않아 결제가 가능합니다.
- 사전 조사를 위해 도서를 구매하여 필요한 부분만 발췌하고 샘플 예제 및 문서를 작성했습니다.
- 보고서 등을 작성할 때 AI 생성 정보나 블로그 정보를 전적으로 신뢰하기 어려워 도서 발췌 내용으로 대체했습니다.
- 다만, 해당 도서가 AI로 작성되지 않았다는 점을 검증할 방안을 모색할 필요가 있습니다.
요청하신 도서 목록을 정리한 표입니다.
| 플랫폼 | 도서명 | 가격 |
|---|---|---|
| Google Play 도서 | 그림으로 배우는 생성형 AI | ₩23,760 |
| Google Play 도서 | 에이전트 시대의 AI 시스템 설계 | ₩30,240 |
| Google Play 도서 | AI 프로덕트는 어떻게 만들어지는가 | ₩20,160 |
| Google Play 도서 | 클린 아키텍처 with 파이썬 | ₩23,760 |
| Google Play 도서 | LLMOps 완벽 가이드 | ₩23,040 |
| Google Play 도서 | 트랜스포머 아키텍처로 배우는 AI 에이전트 with 랭체인 & 랭그래프 | ₩28,080 |
| Google Play 도서 | 다시 찾는 디지털 서비스를 만드는 8가지 법칙 | ₩12,600 |
| Google Play 도서 | SQL, 이렇게 하면 된다(제2판) | ₩19,530 |
| Google Play 도서 | Do it! 스프링 AI를 활용한 AI 에이전트 개발 입문 | ₩25,200 |
| Google Play 도서 | 피지컬 시스템 설계 | ₩21,600 |
| 영풍문고 | AI 에이전트 개발과 운영 올인원 가이드 | 33,000 |
| 영풍문고 | 바이브 엔지니어링 | 24,000 |
| 영풍문고 | 스프링 AI 인 액션 | 33,000 |
지원금으로 AI 서비스 사용 가능
국내 회사 서비스의 사용을 장려해야 하는 부분도 고려해 볼 만합니다.
- ChatGPT, ClaudeCode 등 일부 서비스의 사용이 허용되었습니다.
- 그러나 서류(HWP) 처리 과정이 필요합니다. 윈도우 노트북 구매가 유용한 결정이었습니다.
1차 테스트(성능) 지표
토큰, 시간, 결과를 비교하고 동일한 요청으로 재실행할 수 있도록 지원하는 도구입니다. 1차 테스트는 토큰 절감 효과와 실험 측정 방식에 중점을 두어 진행했습니다.
토큰 절감 지표
토큰 절감은 세 가지 계층으로 동작하며, 하위 계층으로 갈수록 절감 폭은 크지만 적용 범위가 제한적입니다.
- 출력 제어 (모든 요청 적용)
- 절감률: 20~40%
- 설명: stop 파라미터를 통해 답변 후 이어지는 불필요한 출력을 차단하고, response_format으로 JSON 구조를 강제하여 서두 및 마무리 요약을 제거합니다.
- 유의사항: 출력을 강제로 제한하므로 답변 품질과 상충할 수 있습니다. run-experiment의 expect 채점을 통해 품질이 유지되는지 반드시 확인 후 적용하시길 바랍니다.
- 파일 도구 (큰 컨텍스트 요청 시 적용)
- 설명: 대용량 파일 전체를 프롬프트에 입력하는 대신, 모델이 필요한 경로와 줄만 조회하도록 유도합니다.
- 효과: read_file 및 search_files 결과를 활용해 전체 파일 입력을 대체할 수 있는 경우 토큰 소모를 효과적으로 줄일 수 있습니다.
- 응답 캐시 (반복 요청 시 적용)
- 절감률: 100% (적중 시)
- 설명: 정확 일치 매칭뿐만 아니라 임베딩 유사도 기반의 의미(Semantic) 매칭을 지원합니다. 임베딩 모델은 로컬 서버에서 동작하므로 조회 과정에서 생성 토큰이 소모되지 않습니다.
- 효과: 캐시가 적중한 세션은 total_tokens=0, cache_hit=true로 처리되며, 절감된 비용은 tokens_avoided 항목에 기록되어 시도(Trial) 기록에서 바로 확인하실 수 있습니다.
실험 실행 및 검증 (run-experiment)
-
처치(Arm) 비교: 복구 전략(recovery), 파일 도구 사용 여부, 출력 제어의 세 가지 처치를 변경하며 체크포인트 부분 재실행의 효과를 검증합니다. 정확한 측정을 위해 프로필과 스트림 중단(interrupt_after_runes) 조건은 동일하게 유지합니다.
-
평가 방식 (json_field 채점): 출력 제어가 적용된 JSON 응답의 특정 필드 값을 추출해 평가합니다. 허용 오차(tolerance)를 통해 수치 해석의 유연성을 확보하였으며, 유효하지 않은 응답은 실패로 간주합니다.
-
실행 방식: 모델 서버의 경합을 방지하고 정확한 지연 시간을 측정하기 위해 각 실험은 순차적으로 실행합니다.
실험 측정 및 시도(Trial) 데이터 내보내기
-
기능: 작업을 완료할 때까지 누적된 토큰 소모량을 시도(trial) 단위로 CSV 파일로 추출합니다.
-
특징: 실패한 시도를 포함하여 최초 실행 및 파생된 모든 재실행 내역을 취합합니다.
-
로컬 추정치 확인: 중단된 시도의 경우 제공자(Provider)의 실제 사용량을 확인할 수 없으므로 estimated_tokens 항목의 로컬 추정치를 바탕으로 통계를 산출합니다.
도메인 템플릿 지원 (industrial-timeseries)
별도의 설정 파일이나 데이터베이스 없이 현장에 바로 적용 가능한 워크플로우 템플릿을 내장하여 제공합니다. 인터넷 연결이 어려운 폐쇄망 환경에서도 즉각적으로 활용할 수 있습니다.
- 활용 예시: 제조 현장의 설비 로그 시계열 요약 및 이상 탐지 파이프라인. 원본 로그 대신 스크립트를 거친 요약본만 모델에 제공함으로써 컨텍스트 길이를 축소합니다.