← AI Engineer
컨텍스트 그래프 · 에이전트 메모리

문서가 아니라 결정의 흔적이 필요하다 — 컨텍스트 그래프로 에이전트에 선례 붙이기

지식 베이스는 물음에 답하게 하고 컨텍스트 그래프는 승인·거절과 그 까닭까지 대게 한다는 갈림점. 금융 에이전트 데모에서 지난 판단을 끌어와 선례를 그래프 구조로 찾는 순서가 나오고, 명령 한 줄로 미리 만들어 둔 도메인 하나를 골라 그래프와 앞단과 뒷단을 통째로 짓는 도구를 시연함. 다만 새 결정 흔적을 언제 써넣을지는 아직 못 풀었다고 질의응답에서 인정한다.

Zach Blumenfeld Neo4j발표 2026-06-2619분 57초AI Engineer

한줄 코멘트. 지식 베이스에 컨텍스트 그래프가 더하는 것은 지난 판단이 왜 그렇게 났는지다. 승인할지 거절할지를 대게 하려면 사실만으로 모자라고 선례가 함께 와야 한다는 것이 발표의 뼈대다. 그런데 그 흔적을 누가 언제 써넣느냐는 아직 못 풀었다고 질의응답에서 인정한다 — 지금 데모는 저장하라고 시켜야만 저장한다. 잰 값은 하나도 없고, 앞의 데모는 인터넷 탓에 녹화로 대체됐다.

1. 물음에 답하는 것으로는 모자란 자리

그래프 데이터베이스 회사에서 일하는 사람이 발표한다. 기술 마케팅에 있다가 최근 연구 엔지니어링 쪽으로 옮겼다고 밝힌다. 회사 소개는 정보를 잇고 추려서 AI 시스템이 더 정확해지고 왜 그렇게 답했는지 짚을 수 있게 돕는다는 것이다.

청중에게 두 번 손을 들게 한다. 컨텍스트 그래프를 들어 봤는지, 그런 그래프로 직접 코드를 짜 봤는지다. 둘 다 절반쯤이었다.

세우는 갈림점이 이렇다. 검색해서 붙이는 지식 베이스는 물음에 정확히 답하도록 돕는다. 컨텍스트 그래프가 거기 더하는 것은 더 나은 결정을 내리는 데 필요한 것이다.

같은 요청, 두 가지 답

같은 요청을 두고 무엇을 답하나

고객·거래·정책만 줬을 때위험 점수를 매기고검토해 보라고 권하고위험 요인을 짚는다
지난 판단까지 줬을 때승인할지 거절할지 답하고왜 그런지까지 붙인다선례를 함께 끌어온다
발표가 세우는 갈림점이다. 왼쪽은 발표자가 「대개 이렇게 나온다」고 그려 놓은 답이지 그 자리에서 돌려 본 것이 아니다. 오른쪽만 녹화로 보인다.

예로 드는 것은 금융 분석 에이전트다. 고객이 얼마를 요청한 사안을 두고 고객 정보와 거래 내역과 정책만 쥐여 주면, 위험 점수를 매기고 검토해 보라고 권하고 위험 요인을 짚는 정도로 답한다. 여기에 지난 결정 흔적과 선례가 붙으면 승인할지 거절할지와 그 까닭까지 답한다는 것이다.

이 말이 어디서 나왔는지도 밝힌다. 어느 벤처캐피털이 지난 12월쯤 꺼냈고, 그 뒤로 결정 흔적과 추론을 남겨 두자는 논의가 시끄러웠다고 말한다.

2. 사실 위에 무엇을 얹나

*시스템 오브 레코드가 다루는 것은 사실과 개체와 지금 상태다. 컨텍스트 그래프는 거기에 선례와 인과 사슬과 예상되는 결과를 얹어, 에이전트가 그 분야를 아는 사람처럼 움직이게 한다는 것이다.

컨텍스트 그래프에 담는 세 갈래

갈래무엇이 들어가나
개체존재하는 것들
사건결정·거래·승인
맥락정책, 그리고 지난 판단이 남긴 추론과 기억

세 번째 갈래에 두 종류가 함께 든다고 짚는다. AI가 남긴 추론과, 예전에 결정을 내린 직원들이 남긴 것이다.

3. 데모가 도는 순서

데모에 쓴 자료는 고객관리 시스템과 고객지원 시스템 같은 데서 자료를 받아 오는 상황을 흉내 내 지어낸 것이라고 밝힌다. 돌리는 쪽은 클로드, 임베딩은 오픈AI, 자료와 벡터는 자기 회사 데이터베이스, 앞단은 넥스트js다. 인터넷 연결을 못 믿겠다며 이 데모는 녹화로 대신 보인다.

물음에서 거절까지

고객이 얼마를 요청한다한도를 두고 묻는 상황이다
도구를 잇달아 부른다그래프에서 자료를 끌어온다
지난 판단이 딸려 온다결정 흔적을 여러 개 모은다
선례를 찾는다그래프 구조를 보고 고른다
거절로 간다왜 그런지가 함께 나온다
녹화로 보인 금융 에이전트 데모의 순서다. 선례 찾기는 닮은 말이 아니라 그래프에서 서로 이어진 자리를 본다.

선례 찾기 단계만 따로 이름을 붙여 설명한다. 그래프 안의 구조를 살펴 인과 사슬로 서로 이어진 자리를 끌어온다는 것이다. 결정 흔적들이 그 사슬로 겹겹이 쌓인다고 말한다.

여기서 두 가지를 함께 쓴다. 벡터 인덱스로 「사기 거절」 같은 말을 뜻으로 찾고, 거기에 그래프 안에서 얼마나 비슷한 자리에 있는지를 겹쳐 본다. 뒤쪽을 가능하게 하는 것이 *그래프 임베딩이다. 앞서 보여 준 마디들이 서로 이어진 모양을 통째로 벡터로 만든 것이고, 그래서 닮은 결정 흔적을 벡터 유사도로 찾을 수 있다고 말한다. 이 임베딩은 회사의 그래프 데이터 사이언스 도구로 만든다.

4. 명령 한 줄로 뼈대를 짓는다

정작 오늘 보이고 싶었던 것은 한 달쯤 전에 나온 다른 도구라고 말한다. 사내 프로덕트 매니저 한 사람이 만들었고, 터미널에서 명령 한 줄로 컨텍스트 그래프와 앞단과 뒷단을 갖춘 앱을 통째로 만들어 준다. 리액트나 넥스트의 뼈대 생성기에 견준다.

시연에서 지정한 것은 앱 이름과 도메인과 쓸 프레임워크다. 그러면 더미 자료가 담긴 픽스처 파일들과 함께 폴더가 만들어지고, 설치하고 자료를 심어 띄우기까지 몇 분 걸린다. 그 몇 분을 기다리는 중에 소리가 끊겨 청중에게 들리느냐고 되묻는 대목이 그대로 남아 있다.

완성된 화면에서는 처방약을 물어 답을 받아 오고, 스키마 그림과 여러 흔적을 함께 볼 수 있다. 물음이 들어오면 *사이퍼로 자료를 찾아 온다.

미리 만들어 둔 도메인이 스물두 개고, 시연한 헬스케어 말고 금융서비스도 있다. 직접 도메인을 만들면 *온톨로지를 대신 지어 준다. 지원하는 프레임워크로 파이단틱 AI 외에 오픈AI·랭그래프·크루·스트랜즈·구글 ADK를 든다. 깃허브·노션·지라·슬랙에서 자료를 끌어오는 연결 도구가 있어 데모 자료가 아닌 실제 자료도 넣을 수 있다고 말한다. *MCP 서버를 만들어 주고 앱 안에서 여러 차례 주고받는 대화도 된다. 이제 막 시작한 오픈소스라 누구나 기여할 수 있다고 덧붙인다.

여기부터 발표 끝까지는 자기 회사 것을 권하는 자리다. 블로그와 안내 사이트와 저장소 링크 셋을 잇달아 소개한다.

5. 밑에 깔린 메모리 패키지

이 도구를 떠받치는 큰 의존 하나로 자기 회사 에이전트 메모리 패키지를 든다. 컨텍스트 그래프에는 셋이 다 필요한데 그 패키지가 셋을 맡는다는 것이다.

메모리 패키지가 맡는 셋

갈래무엇을 담나
단기 기억대화 이력과 세션 맥락
장기 기억거기서 뽑혀 나와 되풀이되는 개체를 하나로 추린 것
추론컨텍스트 그래프 안의 흔적

글을 그래프로 바꾸는 일은 단계 몇을 거친다고 말한다. 스페이시에서 글라이너로, 더 정교한 쪽으로, 마지막에는 거대언어모델이 받는다. 각 단계가 무엇을 하는지는 발표가 설명하지 않는다. 그 뒤에 병합과 중복 제거와 보강이 따로 붙는다.

스키마는 대화가 있고 거기서 뽑힌 개체들이 추론 흔적으로 이어지는 모양이라고 말한다. 이 패키지가 마이크로소프트 에이전트 프레임워크와 구글 ADK를 비롯한 여러 곳과 붙는다고 덧붙인다.

6. 새 흔적은 누가 써넣나

질의응답이 이 발표에서 가장 정직한 대목이다.

시간 정보를 붙이면 벌어진 순서대로 「원인이 됨」이나 「다음」 같은 관계로 이어진다고 답하면서도, 지금 그렇게까지 되는지는 모르겠다고 그 자리에서 물러선다. 기술이 익으면 될 일이라고 말한다.

미리 만들어 둔 도메인들은 온톨로지가 이미 준비돼 있고, 정해 둔 개체와 관계 종류가 뽑아내기와 맞붙이기를 이끈다고 답한다. 자료가 CSV나 표처럼 이미 짜여 있으면 사이퍼 문으로 그대로 옮기면 되고, 글을 다루는 쪽은 새 프로젝트라 아직 거칠다고 인정한다.

새 결정 흔적을 어떻게 써넣느냐는 물음에는 답이 없다. 지금 데모에서는 저장하라고 시켜야 저장하고, 시키지 않으면 알아서 남기지 않는다. 도구 쪽도 아직 작업 중이라고 밝히면서, 결정에 감정이나 품질 점수 같은 것을 매기는 방식이 필요할지 모르겠다는 생각을 덧붙인다.

7. 발표가 밝히지 않은 것

잰 값이 하나도 없다. 지식 베이스만 줬을 때와 컨텍스트 그래프를 줬을 때의 답을 나란히 놓고 견주는데, 정확도도 지연도 값도 나오지 않는다.

왼쪽 답은 돌려 본 것이 아니다. 지식 베이스만 있을 때 나올 답은 발표자가 대개 이렇게 나온다고 그려 놓은 것이다. 두 벌을 실제로 만들어 같은 것을 물어본 대조가 아니다.

앞의 데모가 녹화다. 인터넷 연결을 못 믿겠다며 녹화로 대신했고, 뒤의 시연에서는 소리가 끊겼다.

그래프를 만드는 값이 없다. 글에서 개체를 뽑아내는 단계가 얼마나 걸리고 얼마나 틀리는지, 손보는 품이 얼마인지가 나오지 않는다.

선례를 잘못 고르면 어떻게 되는지가 없다. 지난 판단을 근거로 승인·거절을 대게 하는 구조인데, 그 판단이 애초에 틀렸을 때 무엇으로 걸러 내는지를 다루지 않는다.

자막이 몇 군데 뭉갠다. 개념을 처음 꺼낸 곳으로 댄 회사 이름과, 미리 정해 둔 개체·관계 틀을 부르는 말이 어긋나 있어 정확한 표기는 원문에서 갈린다.

용어

*시스템 오브 레코드
사실과 현재 상태를 담아 두는 기존 업무 시스템. 영어로 system of record
*그래프 임베딩
서로 이어진 그래프 마디들의 모양을 숫자 벡터로 바꿔 둔 것
*사이퍼
그래프 데이터베이스에 묻는 데 쓰는 질의 언어. 영어로 Cypher
*온톨로지
어떤 개체와 어떤 관계가 있을 수 있는지 미리 정해 둔 그래프 틀
*MCP
모델이 바깥 도구·자료에 붙는 방식을 맞춰 놓은 규약. 영어로 model context protocol