[2026-09-17] eagle: family/how-to/home-automation.md family/how-to/zont-config-compiler.md family/tech/local-ustreamer-addon.md family/tech/t610-hang-investigation.md family/tech/t610-hw-metrics-addon.md family/tech/zont-config-object-types.md family/tech/zont-scenario-logic-11109.md

This commit is contained in:
Alexey Martemyanov
2026-09-17 12:34:55 +06:00
parent 46f48ff909
commit 5df98798b8
7 changed files with 299 additions and 40 deletions
+19
View File
@@ -8,6 +8,9 @@ updated: 2026-09-17b
# 🔴 t610 — зависания: состояние расследования
> **Статус: ПРИЧИНА НЕ УСТАНОВЛЕНА.** BIOS **прошит до K30 v01.20** (2026-09-17) — следующий замер памяти покажет, помогло ли.
> ✅ **2026-09-17: следы больше не теряются** — заведён сбор метрик аддоном `local_hw_metrics`:
> 11 датчиков в HA + строка на диск со `sync` каждые 60 с → **[[family/tech/t610-hw-metrics-addon]]**.
> Каждый следующий инцидент оставит данные за последнюю минуту жизни хоста.
> **Три кандидата:** (A) 🔴 **память** — стоит 4 ГБ, оба слота заняты, видно 1.44 ГБ
> (§3.1.0) + 🔑 **UMA Frame Buffer в BIOS** как документированный механизм потери (§3.1.3)
> + 🔑 **батарейка CMOS** (§3.1.4) · (B) деградация носителя → SQLite disk I/O (§5).
@@ -109,6 +112,21 @@ Alex перезапустил t610 вручную (сброс питанием)
### 3.1. Хост видит **1.44 ГБ**, не 3.31 ГБ — расхождение с докой
> 🔄 **ПОДТВЕРЖДЕНО КОЛЕБАНИЕ ОБЪЁМА (2026-09-17, позже в тот же день).**
> Снято с живого хоста после очередной перезагрузки (аптайм 6 мин):
> ```
> MemTotal: 3 470 776 kB ← 3.31 ГБ
> MemFree: 1 472 856 kB
> MemAvailable: 2 582 092 kB
> temp1_input: 60875 (60.9 °C)
> ```
> **То есть `MemTotal` МЕНЯЕТСЯ МЕЖДУ ЗАГРУЗКАМИ: 1.44 ГБ ↔ 3.31 ГБ.** Это ровно тот
> «прямой признак нестабильности планки/слота», который был предсказан в **§3.1.1** ниже.
> **Не два разных дефекта, а один: ступенчатый отвал объёма.** Подтверждает §3.1.0 и §3.1.2.
> ✅ **Мониторинг заведён** — `sensor.t610_ram_total` + лог на диск каждые 60 с:
> **[[family/tech/t610-hw-metrics-addon]]**. Следующий отвал будет виден фактом.
> ⚠️ **Причину этой перезагрузки (13:05) я не выяснял** — отдельная задача.
```
MemTotal: 1475788 kB ← 1.44 ГБ ← ЖИВОЙ ФАКТ 2026-09-17
MemFree: 18620 kB ← 18 МБ
@@ -484,6 +502,7 @@ ssh root@192.168.2.176 'smartctl -t long /dev/sda' # затем -l selftest
`MemTotal`/`MemAvailable`/`MemFree`, load, `pressure/io`+`pressure/memory`, `k10temp`,
размер БД+WAL, аптайм. **Это то, что даст версию к следующему зависанию** — сейчас каждый
инцидент стирает свои следы (§2).
> ✅ **СДЕЛАНО 2026-09-17** — но путь другой: **`/share`**, а не `/mnt/data` (последнего на t610 **не существует**). Реализовано локальным аддоном `local_hw_metrics`: 11 датчиков в HA через `POST /api/states/` + строка в `/share/ha-metrics/hw-YYYY-MM.log` со `sync`. Список: **[[family/tech/t610-hw-metrics-addon]]**. Ложный путь `/mnt/data` исправлен (питфолл 77).
4. **`recorder:` с `exclude`** — исключить `sensor.*_summary`, `at2_*_summary`, `update.*`,
`button.*_identify`, `event.*`. Снижает нагрузку на БД. **Не «фикс зависания»** — отдельное улучшение.
5. **Включить watchdog `local_ustreamer`** — единственный аддон без watchdog (§3.7 родительской доки).