AI 에이전트와 기억
에이전트가 세션을 넘어 기억을 쌓고, 지금 맞는 것만 꺼내 오게 합니다. 여러 에이전트를 한 화면에서 잇고 지켜보는 실행기도 만듭니다.
- neuromem
- mnemosure
- numen
- honcho-selfhost
- 인간기억 기반 메모리
- 기억시스템 통합
연구일지 428편 · 2026.10.09 기준
칼퇴공학연구소(KALTI)는 AI와 함께 일하는 방법을 직접 실험하는 독립 연구 모임입니다. 실험은 모두 연구일지로 남기고, 그중 계속 쓸 결론만 골라 지식으로 쌓습니다.
About
칼퇴공학연구소는 개발과 공학을 함께 공부하려고 만든 연구 모임입니다. 2026년 6월 8일 창립총회에서 규약을 정하고 대표를 뽑았습니다. 이름은 제때 퇴근한다는 뜻의 '칼퇴'에서 왔습니다.
연구원마다 자기 종목을 맡아 만들고 잽니다. AI 에이전트의 기억부터 손에 쥐는 기계까지 범위가 넓습니다.
그날 한 실험·조사·결정은 연구일지로 남깁니다. 일지는 증거라서 쓴 사람 말고는 고치지 않습니다.
계속 쓸 결론만 골라 카드로 올립니다. 틀린 생각도 지우지 않고 왜 버렸는지 남깁니다.
막대 하나가 한 주입니다. 2026년 3월부터 주마다 쓴 연구일지 수이고, 가장 많이 쓴 주에 숫자를 달았습니다.
Research
종목은 서로 남남이지만, 대부분 AI와 함께 일하는 방법에 닿아 있습니다.
에이전트가 세션을 넘어 기억을 쌓고, 지금 맞는 것만 꺼내 오게 합니다. 여러 에이전트를 한 화면에서 잇고 지켜보는 실행기도 만듭니다.
데이터를 어떤 꼴로 넣어야 모델이 잘 답하는지, 코드 구조가 AI 코딩을 돕는지 직접 잽니다. 재는 도구가 정직한지부터 의심합니다.
브라우저 제어, 디자인→코드 검증, 일관성 측정처럼 AI가 쓰거나 AI와 같이 쓰는 도구를 만듭니다.
받아쓰기 앱, 작곡 환경, 퍼즐 게임, 3D 프린팅, 손에 쥐는 음성 입력 장치까지 AI와 함께 실제로 쓰는 물건을 만듭니다.
문서를 근거로 답하는 RAG 챗봇을 만들며 공부하고, 해커톤에 나가 기업 문제를 AI로 풀어 봅니다.
Projects
카드 아래 막대는 2026년 3월부터 주마다 쓴 연구일지 수입니다. 기록이 쌓인 만큼 결론도 쌓입니다.
AI 에이전트가 자기가 누구인지와 겪은 일을 오래 쌓아 두고, 지금 상황에 맞는 기억을 연관으로 골라 꺼내는 장기기억 엔진입니다.
여러 세션에 걸친 AI 코딩 협업에서 기억 누락과 환각을 줄이는 기억층입니다. 모르면 모른다고 하고, 아는 건 출처와 함께 답하게 합니다.
Claude Code·Codex·Gemini CLI를 고치지 않고 상자로 띄워 캔버스에서 잇고, 누가 언제 켜지고 실패하는지 다 보이게 하는 멀티에이전트 실행기입니다.
같은 데이터를 JSON·YAML·CSV·마크다운 표 등 일곱 가지로 바꿔 넣으며, LLM의 정답률과 토큰 수가 어떻게 달라지는지 원인부터 잽니다.
자체 LLM 없이 어떤 에이전트든 MCP로 붙여, 화면 좌표 대신 뜻 단위로 웹 페이지를 다루게 하는 브라우저 제어 층입니다.
Figma 시안에서 디자인 시스템, 코드까지 옮기는 과정이 충실한지를 사람의 말이 아니라 기계 측정으로 검증합니다.
Method
무엇을 했는지는 그날 남기고, 무엇을 알아냈는지는 따로 모읍니다. 증거와 지식을 나눠 두면 몇 달 뒤에도 왜 그렇게 정했는지 찾아갈 수 있습니다.
그날 한 실험·조사·결정을 각자 자기 폴더에 씁니다.
일지에서 발견·가설·결정을 뽑아 카드로 올립니다. 카드는 꼭 근거 일지를 가리킵니다.
여러 종목이 따로 닿은 결론만 개념으로 묶습니다.
사람별 주간 보고서와 연구실 전체를 담은 월간 소식을 냅니다.
일지 쓰는 법, 카드로 정리하는 법, 보고서 만드는 법을 Claude Code 스킬로 만들었습니다. 연구원 모두가 같은 규칙으로 쓰고, 규칙이 바뀌면 스킬만 고치면 됩니다.
kalti-lab/claude-plugins# 처음 한 번
❯ /plugin marketplace add kalti-lab/claude-plugins
❯ /plugin install kalti-lab-notes@kalti-lab
❯ /kalti-setup # 볼트 위치·본인 폴더·동기화
# 매일
❯ /kalti-journal # 오늘 한 일을 일지로
❯ /kalti-ontology # 일지에서 결론을 뽑아 카드로
❯ /kalti-report # 주간 보고서 · 월간 소식
❯ /kalti-context # 이 주제로 이미 알아낸 것
❯
Findings
서로 모르고 각자 하다가 같은 결론에 닿은 것만 개념으로 묶습니다. 점 하나가 종목 하나이고, 색이 든 점은 그 결론에 닿은 종목입니다.
결론을 믿기 전에, 그 결론을 재는 도구가 먼저 정직해야 합니다.
에러 없이 성공처럼 보이는 실패는 몇 주 뒤에야 드러납니다.
초록불은 그 검사가 재는 것만 증명합니다.
바뀔 것을 한 겹 뒤에 숨겨 두면 나중에 갈아 끼우기가 쌉니다.
세션을 넘겨 기억을 쌓고, 지금 맞는 것만 꺼내 옵니다.
무엇이 실제로 돌았는지 고정하지 않으면, 환경 탓을 대상 탓으로 알게 됩니다.
이름이나 형식으로 판정하면 같은 것을 못 알아봅니다.
한 축을 끝까지 쓸어도 결과가 같은 범위에 머물면, 그 축은 손잡이가 아닙니다.
정답지 없는 채점을 모델에게 맡길 때 어디까지 믿을 수 있는지 잽니다.
성능이 모자라 보이는 증상이 실은 부품끼리 주고받는 방식에서 나옵니다.
내용은 만드는 쪽이 정하지만, 형식은 받는 앱과 기기가 정합니다.
어떤 방법이 통한다는 결론은 그걸 돌린 모델과 묶여 있습니다.
개발용으로 띄운 서비스도 밖에서 열릴 수 있다고 보고 출처를 검사합니다.
News
한 달에 한 번, 세 사람의 연구를 A4 두 장에 담습니다. 기사는 그 달에 달라진 것이 많은 종목 순서로 고르고, 숫자는 저장소를 세는 명령 하나에서만 가져옵니다.
9월에 가장 많이 들여다본 것은 연구일지 저장소 자신이었습니다. 검사가 문제없다고 하던 곳에서 검사가 놓친 것이 계속 나왔고, 원인은 하나였습니다. 글로만 적은 규칙은 누가 기억해야만 지켜집니다.
2026.10.02 펴냄 · 이달의 연구: 연구일지 시스템
풀이 과정을 쓰게 하자 포맷 사이의 정답률 차이는 줄지 않고 오히려 커졌습니다. 8월에 결론 난 생각 열 건 가운데 다섯은 "아니었다"였습니다.
2026.09.11 펴냄 · 이달의 연구: 직렬화 포맷과 토큰 정확도
매주 연구원마다 그 주의 하이라이트와 종목별로 한 일, 다음 주로 넘어가는 일을 정리합니다.
History
지금 남아 있는 가장 오래된 기록입니다.
단체를 세우고 규약을 승인하고 대표를 뽑았습니다.
kalti.co.kr
연구일지 저장소와 Claude Code 스킬 저장소를 만들었습니다.
창간호(8월호)를 펴냈습니다.
9월호를 펴냈습니다.
연구일지 400편을 넘겼습니다.
People
세 사람이 각자 종목을 맡고, 결론은 함께 관리합니다. 아래는 각자 일지를 가장 많이 쓴 종목입니다.
대표 · 연구원
연구원
연구원
FAQ
칼퇴공학연구소에 대해 먼저 궁금해할 만한 것을 짧게 답했습니다.
칼퇴공학연구소(KALTI)는 AI와 함께 일하는 방법을 직접 실험하는 대한민국의 독립 연구 모임입니다. 2026년 6월 8일 창립총회에서 규약을 정하고 대표를 뽑았고, 연구원 세 명이 각자 맡은 종목을 실험해 모두 연구일지로 남깁니다.
제때 퇴근한다는 뜻의 '칼퇴'에서 왔습니다. 영문 이름은 KALTI이고, 홈페이지 주소는 kalti.co.kr입니다.
AI 에이전트와 기억, LLM 측정과 평가, 개발 도구와 자동화, 직접 만드는 것, 같이 배우기의 다섯 분야에서 공개 종목 32개를 연구합니다. 예를 들어 AI 에이전트의 장기기억 엔진(neuromem), 데이터 포맷에 따라 LLM 정답률이 어떻게 달라지는지 재는 실험, MCP로 붙는 브라우저 제어 도구(agrune)가 있습니다.
그날 한 실험·조사·결정을 연구일지로 쓰고, 일지에서 발견·가설·결정을 뽑아 지식 카드로 올립니다. 여러 종목이 따로 닿은 결론만 개념으로 묶고, 매주 주간 보고서와 매달 월간 연구 소식을 냅니다. 2026년 10월 9일 기준 연구일지 428편, 지식 카드 493장, 개념 13개입니다.
가장 많은 종목이 따로 닿은 결론은 세 가지입니다. 결론을 믿기 전에 그 결론을 재는 도구가 먼저 정직해야 한다(평가 정직성, 종목 16곳). 에러 없이 성공처럼 보이는 실패는 몇 주 뒤에야 드러난다(조용한 실패, 종목 16곳). 초록불은 그 검사가 재는 것만 증명한다(검증 게이트의 한계, 종목 13곳).
연구일지 원본은 연구원끼리 쓰는 비공개 저장소에 있고, 이 홈페이지에 종목별 요약과 숫자를 공개합니다. 연구일지를 쓰고 정리하는 Claude Code 스킬은 GitHub(github.com/kalti-lab/claude-plugins)에 공개되어 있습니다.
모두 연구일지 저장소에서 직접 센 값입니다. 사이트를 만들 때마다 새로 세며, 지금 숫자는 2026년 10월 9일 기준입니다.
메일(aram@kalti.co.kr)로 받습니다. 연구 내용, 협업, 자료 요청 모두 괜찮습니다.