연구일지 428편 · 2026.10.09 기준

일은 줄이고,
알아낸 것은 쌓습니다

칼퇴공학연구소(KALTI)는 AI와 함께 일하는 방법을 직접 실험하는 독립 연구 모임입니다. 실험은 모두 연구일지로 남기고, 그중 계속 쓸 결론만 골라 지식으로 쌓습니다.

  • 종목
  • 일지
  • 발견
  • 가설
  • 결정
  • 개념
그래프는 우리 연구 기록을 그대로 이은 것입니다. 바깥 고리가 종목, 가운데가 여러 종목이 함께 닿은 결론입니다.
428편연구일지2025년 10월 첫 기록부터
493장지식 카드발견 264 · 가설 95 · 결정 77 외
37개연구 종목진행 30 · 보류 5 · 완료 2
3명연구원2026년 6월 8일 창립

About

AI와 함께 일하는 법을
직접 해 보고 기록합니다

칼퇴공학연구소는 개발과 공학을 함께 공부하려고 만든 연구 모임입니다. 2026년 6월 8일 창립총회에서 규약을 정하고 대표를 뽑았습니다. 이름은 제때 퇴근한다는 뜻의 '칼퇴'에서 왔습니다.

  • 직접 실험합니다

    연구원마다 자기 종목을 맡아 만들고 잽니다. AI 에이전트의 기억부터 손에 쥐는 기계까지 범위가 넓습니다.

  • 모두 기록합니다

    그날 한 실험·조사·결정은 연구일지로 남깁니다. 일지는 증거라서 쓴 사람 말고는 고치지 않습니다.

  • 결론만 쌓습니다

    계속 쓸 결론만 골라 카드로 올립니다. 틀린 생각도 지우지 않고 왜 버렸는지 남깁니다.

지금까지 쓴 연구일지

428편
2026.10.09 기준
42

막대 하나가 한 주입니다. 2026년 3월부터 주마다 쓴 연구일지 수이고, 가장 많이 쓴 주에 숫자를 달았습니다.

Research

다섯 갈래로 연구합니다

종목은 서로 남남이지만, 대부분 AI와 함께 일하는 방법에 닿아 있습니다.

프로젝트 전체 보기

AI 에이전트와 기억

에이전트가 세션을 넘어 기억을 쌓고, 지금 맞는 것만 꺼내 오게 합니다. 여러 에이전트를 한 화면에서 잇고 지켜보는 실행기도 만듭니다.

  • neuromem
  • mnemosure
  • numen
  • honcho-selfhost
  • 인간기억 기반 메모리
  • 기억시스템 통합

종목 6 · 연구일지 114편

LLM 측정과 평가

데이터를 어떤 꼴로 넣어야 모델이 잘 답하는지, 코드 구조가 AI 코딩을 돕는지 직접 잽니다. 재는 도구가 정직한지부터 의심합니다.

종목 3 · 연구일지 33편

개발 도구와 자동화

브라우저 제어, 디자인→코드 검증, 일관성 측정처럼 AI가 쓰거나 AI와 같이 쓰는 도구를 만듭니다.

종목 8 · 연구일지 71편

직접 만드는 것

받아쓰기 앱, 작곡 환경, 퍼즐 게임, 3D 프린팅, 손에 쥐는 음성 입력 장치까지 AI와 함께 실제로 쓰는 물건을 만듭니다.

  • wisp
  • aria
  • locogic
  • 3d-fabrication
  • toython
  • ride-draft
  • sulnote
  • ktheme-works

종목 13 · 연구일지 105편

같이 배우기

문서를 근거로 답하는 RAG 챗봇을 만들며 공부하고, 해커톤에 나가 기업 문제를 AI로 풀어 봅니다.

종목 2 · 연구일지 13편

Projects

지금 붙잡고 있는 프로젝트

카드 아래 막대는 2026년 3월부터 주마다 쓴 연구일지 수입니다. 기록이 쌓인 만큼 결론도 쌓입니다.

전체 32개 보기
AI 에이전트와 기억진행

neuromem

AI 에이전트가 자기가 누구인지와 겪은 일을 오래 쌓아 두고, 지금 상황에 맞는 기억을 연관으로 골라 꺼내는 장기기억 엔진입니다.

3월주별 연구일지10월
일지42카드48최근2026.09.26
AI 에이전트와 기억진행

mnemosure

여러 세션에 걸친 AI 코딩 협업에서 기억 누락과 환각을 줄이는 기억층입니다. 모르면 모른다고 하고, 아는 건 출처와 함께 답하게 합니다.

3월주별 연구일지10월
일지14카드30최근2026.09.07
AI 에이전트와 기억진행

numen

Claude Code·Codex·Gemini CLI를 고치지 않고 상자로 띄워 캔버스에서 잇고, 누가 언제 켜지고 실패하는지 다 보이게 하는 멀티에이전트 실행기입니다.

3월주별 연구일지10월
일지15카드22최근2026.08.09
LLM 측정과 평가진행

직렬화 포맷과 토큰 정확도

같은 데이터를 JSON·YAML·CSV·마크다운 표 등 일곱 가지로 바꿔 넣으며, LLM의 정답률과 토큰 수가 어떻게 달라지는지 원인부터 잽니다.

3월주별 연구일지10월
일지9카드11최근2026.08.21
개발 도구와 자동화진행

agrune

자체 LLM 없이 어떤 에이전트든 MCP로 붙여, 화면 좌표 대신 뜻 단위로 웹 페이지를 다루게 하는 브라우저 제어 층입니다.

3월주별 연구일지10월
일지21카드25최근2026.08.16
개발 도구와 자동화진행

dsforge

Figma 시안에서 디자인 시스템, 코드까지 옮기는 과정이 충실한지를 사람의 말이 아니라 기계 측정으로 검증합니다.

3월주별 연구일지10월
일지11카드14최근2026.09.11

Method

일지에서 지식까지,
한 줄로 이어집니다

무엇을 했는지는 그날 남기고, 무엇을 알아냈는지는 따로 모읍니다. 증거와 지식을 나눠 두면 몇 달 뒤에도 왜 그렇게 정했는지 찾아갈 수 있습니다.

  1. 01428편

    연구일지

    그날 한 실험·조사·결정을 각자 자기 폴더에 씁니다.

  2. 02493장

    지식 카드

    일지에서 발견·가설·결정을 뽑아 카드로 올립니다. 카드는 꼭 근거 일지를 가리킵니다.

  3. 0313개

    개념

    여러 종목이 따로 닿은 결론만 개념으로 묶습니다.

  4. 04매주· 매달

    연구 소식

    사람별 주간 보고서와 연구실 전체를 담은 월간 소식을 냅니다.

Claude Code 스킬 다섯 개로
연구실이 돌아갑니다

일지 쓰는 법, 카드로 정리하는 법, 보고서 만드는 법을 Claude Code 스킬로 만들었습니다. 연구원 모두가 같은 규칙으로 쓰고, 규칙이 바뀌면 스킬만 고치면 됩니다.

kalti-lab/claude-plugins
# 처음 한 번
❯ /plugin marketplace add kalti-lab/claude-plugins
❯ /plugin install kalti-lab-notes@kalti-lab
❯ /kalti-setup      # 볼트 위치·본인 폴더·동기화

# 매일
❯ /kalti-journal    # 오늘 한 일을 일지로
❯ /kalti-ontology   # 일지에서 결론을 뽑아 카드로
❯ /kalti-report     # 주간 보고서 · 월간 소식
❯ /kalti-context    # 이 주제로 이미 알아낸 것
❯ 

Findings

여러 종목이 따로 닿은 결론

서로 모르고 각자 하다가 같은 결론에 닿은 것만 개념으로 묶습니다. 점 하나가 종목 하나이고, 색이 든 점은 그 결론에 닿은 종목입니다.

01종목 16곳 · 발견 35건

평가 정직성

결론을 믿기 전에, 그 결론을 재는 도구가 먼저 정직해야 합니다.

02종목 16곳 · 발견 26건

조용한 실패

에러 없이 성공처럼 보이는 실패는 몇 주 뒤에야 드러납니다.

03종목 13곳 · 발견 22건

검증 게이트의 한계

초록불은 그 검사가 재는 것만 증명합니다.

04종목 11곳 · 발견 15건

교체 비용과 경계 설계

바뀔 것을 한 겹 뒤에 숨겨 두면 나중에 갈아 끼우기가 쌉니다.

05종목 7곳 · 발견 15건

장기기억 회상층

세션을 넘겨 기억을 쌓고, 지금 맞는 것만 꺼내 옵니다.

06종목 7곳 · 발견 9건

실행 환경 고정

무엇이 실제로 돌았는지 고정하지 않으면, 환경 탓을 대상 탓으로 알게 됩니다.

  • 겉모습 판정종목 5곳

    이름이나 형식으로 판정하면 같은 것을 못 알아봅니다.

  • 안 갈리는 축종목 5곳

    한 축을 끝까지 쓸어도 결과가 같은 범위에 머물면, 그 축은 손잡이가 아닙니다.

  • LLM 심판의 신뢰성종목 5곳

    정답지 없는 채점을 모델에게 맡길 때 어디까지 믿을 수 있는지 잽니다.

  • 고장은 주고받는 길에 있다종목 4곳

    성능이 모자라 보이는 증상이 실은 부품끼리 주고받는 방식에서 나옵니다.

  • 받는 쪽이 형식을 정한다종목 3곳

    내용은 만드는 쪽이 정하지만, 형식은 받는 앱과 기기가 정합니다.

  • 모델 등급이 설계를 가른다종목 3곳

    어떤 방법이 통한다는 결론은 그걸 돌린 모델과 묶여 있습니다.

  • 로컬 서비스 출처 검사종목 3곳

    개발용으로 띄운 서비스도 밖에서 열릴 수 있다고 보고 출처를 검사합니다.

News

월간 연구 소식

한 달에 한 번, 세 사람의 연구를 A4 두 장에 담습니다. 기사는 그 달에 달라진 것이 많은 종목 순서로 고르고, 숫자는 저장소를 세는 명령 하나에서만 가져옵니다.

칼퇴공학연구소 소식제2호 · 2026년 9월

검사가 조용하다고
깨끗한 건 아니었다

9월에 가장 많이 들여다본 것은 연구일지 저장소 자신이었습니다. 검사가 문제없다고 하던 곳에서 검사가 놓친 것이 계속 나왔고, 원인은 하나였습니다. 글로만 적은 규칙은 누가 기억해야만 지켜집니다.

  • 56건기계로 잡을 수 있는데 검사 코드가 확인하지 않던 규칙
  • 19건검사가 아예 안 보던 곳에 남아 있던 금지 낱말
  • 30 / 33편"뽑을 결론 없음"으로 넘겼다가 다시 읽어 보니 결론이 나온 일지
일지
31
새로 알아낸 것
51
새로 정한 것
25
결론 난 생각
2

2026.10.02 펴냄 · 이달의 연구: 연구일지 시스템

칼퇴공학연구소 소식창간호 · 2026년 8월

모델에게 생각을 시키면 포맷 차이가 없어질 줄 알았다

풀이 과정을 쓰게 하자 포맷 사이의 정답률 차이는 줄지 않고 오히려 커졌습니다. 8월에 결론 난 생각 열 건 가운데 다섯은 "아니었다"였습니다.

일지
49
새로 알아낸 것
44
새로 정한 것
1
결론 난 생각
10

2026.09.11 펴냄 · 이달의 연구: 직렬화 포맷과 토큰 정확도

주간 보고서 46편

매주 연구원마다 그 주의 하이라이트와 종목별로 한 일, 다음 주로 넘어가는 일을 정리합니다.

History

지나온 길

  1. 첫 연구일지

    지금 남아 있는 가장 오래된 기록입니다.

  2. 창립총회

    단체를 세우고 규약을 승인하고 대표를 뽑았습니다.

  3. 도메인 등록

    kalti.co.kr

  4. GitHub 조직 개설

    연구일지 저장소와 Claude Code 스킬 저장소를 만들었습니다.

  5. 월간 소식 창간

    창간호(8월호)를 펴냈습니다.

  6. 월간 소식 제2호

    9월호를 펴냈습니다.

  7. 홈페이지 공개

    연구일지 400편을 넘겼습니다.

People

연구원

세 사람이 각자 종목을 맡고, 결론은 함께 관리합니다. 아래는 각자 일지를 가장 많이 쓴 종목입니다.

aram

대표 · 연구원

  • neuromem
  • honcho-selfhost
  • llm-bench
  • agrune
  • ride-draft
  • numen

jinsik

연구원

  • locogic
  • mnemosure
  • 연구일지 시스템
  • dsforge
  • sulnote
  • dsmonitor

sunghyun

연구원

  • 직렬화 포맷과 토큰 정확도
  • 연구기록 체계
  • 인간기억 기반 메모리

FAQ

자주 묻는 질문

칼퇴공학연구소에 대해 먼저 궁금해할 만한 것을 짧게 답했습니다.

칼퇴공학연구소(KALTI)는 어떤 곳인가요?

칼퇴공학연구소(KALTI)는 AI와 함께 일하는 방법을 직접 실험하는 대한민국의 독립 연구 모임입니다. 2026년 6월 8일 창립총회에서 규약을 정하고 대표를 뽑았고, 연구원 세 명이 각자 맡은 종목을 실험해 모두 연구일지로 남깁니다.

이름의 '칼퇴'는 무슨 뜻인가요?

제때 퇴근한다는 뜻의 '칼퇴'에서 왔습니다. 영문 이름은 KALTI이고, 홈페이지 주소는 kalti.co.kr입니다.

무엇을 연구하나요?

AI 에이전트와 기억, LLM 측정과 평가, 개발 도구와 자동화, 직접 만드는 것, 같이 배우기의 다섯 분야에서 공개 종목 32개를 연구합니다. 예를 들어 AI 에이전트의 장기기억 엔진(neuromem), 데이터 포맷에 따라 LLM 정답률이 어떻게 달라지는지 재는 실험, MCP로 붙는 브라우저 제어 도구(agrune)가 있습니다.

연구는 어떻게 기록하고 정리하나요?

그날 한 실험·조사·결정을 연구일지로 쓰고, 일지에서 발견·가설·결정을 뽑아 지식 카드로 올립니다. 여러 종목이 따로 닿은 결론만 개념으로 묶고, 매주 주간 보고서와 매달 월간 연구 소식을 냅니다. 2026년 10월 9일 기준 연구일지 428편, 지식 카드 493장, 개념 13개입니다.

지금까지 무엇을 알아냈나요?

가장 많은 종목이 따로 닿은 결론은 세 가지입니다. 결론을 믿기 전에 그 결론을 재는 도구가 먼저 정직해야 한다(평가 정직성, 종목 16곳). 에러 없이 성공처럼 보이는 실패는 몇 주 뒤에야 드러난다(조용한 실패, 종목 16곳). 초록불은 그 검사가 재는 것만 증명한다(검증 게이트의 한계, 종목 13곳).

연구 기록과 도구를 볼 수 있나요?

연구일지 원본은 연구원끼리 쓰는 비공개 저장소에 있고, 이 홈페이지에 종목별 요약과 숫자를 공개합니다. 연구일지를 쓰고 정리하는 Claude Code 스킬은 GitHub(github.com/kalti-lab/claude-plugins)에 공개되어 있습니다.

홈페이지의 숫자는 어디서 나오나요?

모두 연구일지 저장소에서 직접 센 값입니다. 사이트를 만들 때마다 새로 세며, 지금 숫자는 2026년 10월 9일 기준입니다.

연락은 어떻게 하나요?

메일(aram@kalti.co.kr)로 받습니다. 연구 내용, 협업, 자료 요청 모두 괜찮습니다.

함께 연구하고 싶거나
묻고 싶은 것이 있다면

연구 내용, 협업, 자료 요청 모두 메일로 받습니다.