8(800) 222 32 56
Панель управления

Инфраструктура

pgvector HNSW после UPDATE и DELETE: VACUUM, REINDEX и recall в RAG
Инфраструктура

pgvector HNSW после UPDATE и DELETE: VACUUM, REINDEX и recall в RAG

Production runbook для pgvector HNSW после UPDATE/DELETE: version gate, dead tuples, REINDEX CONCURRENTLY, VACUUM, iterative scans и exact-vs-approx recall.

Андрей Минин, автор блога Андрей Минин, автор блога
NVMe/TCP TLS и DH-HMAC-CHAP: защищаем хранилище весов LLM
AI

NVMe/TCP TLS и DH-HMAC-CHAP: защищаем хранилище весов LLM

Production-runbook по защите удалённых весов LLM: NVMe/TCP TLS, DH-HMAC-CHAP, kernel keyring, canary, negative controls, vLLM gate и rollback.

Андрей Минин, автор блога Андрей Минин, автор блога
Resizable BAR и Above 4G для multi-GPU LLM: production-runbook
GPU

Resizable BAR и Above 4G для multi-GPU LLM: production-runbook

Как проверить Above 4G Decoding, Resizable BAR и NVIDIA BAR1 на multi-GPU сервере: evidence bundle, PCIe/CUDA gates, LLM readiness и безопасный rollback.

Андрей Минин, автор блога Андрей Минин, автор блога
I/O-изоляция LLM-узла: cgroup v2 и systemd против штормов NVMe
AI

I/O-изоляция LLM-узла: cgroup v2 и systemd против штормов NVMe

Практический runbook по I/O-изоляции LLM-узла: cgroup v2 io.max, systemd slices, PSI, два gate, canary rollout и rollback.

Андрей Минин, автор блога Андрей Минин, автор блога
FS-Cache для LLM: как снять шторм загрузки весов с NFS на GPU-узлах
AI

FS-Cache для LLM: как снять шторм загрузки весов с NFS на GPU-узлах

Практический runbook по NFSv4.2 и FS-Cache для весов LLM: локальный NVMe-кэш, прогрев, два уровня gates, rollout, наблюдаемость и rollback.

Андрей Минин, автор блога Андрей Минин, автор блога
Kubernetes DRA для GPU: ResourceClaim, DeviceClass и безопасный rollout
AI

Kubernetes DRA для GPU: ResourceClaim, DeviceClass и безопасный rollout

Практический гид по Kubernetes DRA для GPU: ResourceClaim, DeviceClass, NVIDIA DRA Driver, canary-rollout, RBAC, наблюдаемость и безопасный откат.

Андрей Минин, автор блога Андрей Минин, автор блога
Кэш весов LLM на NVMe: OCI-артефакты и быстрый старт в Kubernetes
Инфраструктура

Кэш весов LLM на NVMe: OCI-артефакты и быстрый старт в Kubernetes

Практическая схема доставки и кэширования весов LLM: OCI-артефакты, Kubernetes ImageVolume, KServe LocalModel и локальный NVMe без повторных загрузок.

King Servers
CXL Memory Expansion для AI inference: больше RAM без иллюзии «дополнительной VRAM»
AI

CXL Memory Expansion для AI inference: больше RAM без иллюзии «дополнительной VRAM»

Как использовать CXL Type-3 memory expansion в AI inference: Linux, NUMA, vLLM offload, memory pooling, ограничения и практический чек-лист.

Андрей Минин, автор блога Андрей Минин, автор блога
Proxmox VE на выделенном сервере: как собрать частное облако для бизнеса в 2026 году
Proxmox

Proxmox VE на выделенном сервере: как собрать частное облако для бизнеса в 2026 году

Практический гид по Proxmox VE на выделенном сервере: выбор железа, ZFS и Ceph, сеть, кластер, HA, backup и безопасность.

Андрей Минин, автор блога Андрей Минин, автор блога