Files
obsidian-vault/wiki/concepts/agent-memory-architecture.md
T

76 lines
3.8 KiB
Markdown

---
namespace: work
tags: [system, agent, memory, architecture, ai]
created: '2026-05-18'
updated: '2026-05-18'
last_synced: '2026-05-18'
confidence: 0.85
sources:
- arXiv 2603.07670 (Memory for Autonomous LLM Agents, март 2026)
- zylos.ai AI Agent Memory Architectures survey (апрель 2026)
- wiki/raw/inbox/research-vault-strategy-memory-20260516.md
---
# Agent Memory Architecture
Когнитивная таксономия памяти для LLM-агентов, основанная на arXiv 2603.07670. Применительно к personal-os (Hermes).
## Три уровня памяти
| Уровень | Определение | Реализация в Hermes |
|---------|-------------|----------------------|
| **Episodic** | Сессионные логи — что произошло в конкретных взаимодействиях | SQLite + `session_search` ✅ |
| **Semantic** | Факты, предпочтения, постоянное знание | `MEMORY.md` + `USER.md` (нужна curation) |
| **Procedural** | Навыки, workflows, пошаговые паттерны | `skills/` ✅ |
## Ключевые выводы из arXiv 2603.07670
- **Gap между "есть память" и "нет памяти"** > gap между разными LLM backbone. Выбор памяти важнее выбора модели.
- **Без рефлексии агент деградирует:** в Generative Agents эксперименте — 48 ч без memory reflection → repetitive behavior.
- **Summarization drift:** после 3+ циклов сжатия критические инструкции теряются. Решение: vault как immutable store, не только MEMORY.md.
## Overflow Rule (MEMORY.md)
Запись в MEMORY.md — только короткие стабильные факты:
- Длина > 150 символов → перенести в vault, оставить pointer
- Содержит пошаговые инструкции → в `skills/`
- Детальный технический контекст → в `wiki/tech/`
```
MEMORY.md: "media-pipeline питфолы → wiki/tech/media-pipeline-pitfalls.md"
wiki/tech/media-pipeline-pitfalls.md: (полный разбор)
```
## 4-tier pipeline (LLM Wiki v2 / rohitg00)
Расширенная модель:
```
Working Memory → сырые наблюдения текущей сессии
Episodic Memory → сжатые саммари сессий
Semantic Memory → кросс-сессионные факты (wiki)
Procedural Memory → паттерны, workflows, skills
```
**Confidence scoring:** каждый факт имеет score (кол-во источников, свежесть, противоречия). Устаревает со временем.
**Event-driven automation:**
- New source → auto-ingest
- Session end → compress into observations
- On query → check if answer worth filing back
- On schedule → periodic lint
## Правило разграничения (Alex's personal-os)
```
MEMORY.md → SSH хосты, namespace rules, токены, конфиги (≤150 chars)
USER.md → предпочтения, стиль (редко меняется)
wiki/tech/ → технические питфолы, баг-паттерны (длинные, с контекстом)
personal/projects/ → статус проектов, дебаггинг-логи
skills/ → процедуры и workflows пошагово
```
## Связанные страницы
- [[personal-os-architecture]] — как память встроена в общий стек
- [[wiki-ingest-process]] — как сессии кристаллизуются в wiki
- [[personal-os-self-modification]] — как система эволюционирует