AI-дайджест · 8 сентября
Safety-тюнинг: отказ не по теме, а по подмножеству
Hugging Face опубликовали разбор narrow-boundary safety: один и тот же base model в разных деплоях требует противоположного поведения внутри одной темы. LlamaGuard-3 кодирует только topic-level таксономию и не может выразить такой сплит.
Почему важно: если строите guardrails для продукта — отказ по категории «политика» или «оружие» ломает легитимные сценарии. Нужен boundary-aware self-distillation, который учит модель отказывать не всей теме, а конкретному подмножеству под политику деплоя.
Читать →
Bluebox: агент смотрит OTel и сам несёт фиксы в GitHub
Bluebox подключается к production-телеметрии и GitHub-репозиторию, непрерывно мониторит runtime-сервисы и при инциденте автоматически трассирует проблему до root cause. Затем отдаёт кодинг-агенту evidence-backed план фикса — без ручного поиска по логам и перевода алертов в промпты.
Почему важно: замыкает цикл «продакшен → расследование → код» без человека в середине. Если у вас уже есть OpenTelemetry и агентный пайплайн — это готовый шаблон автономной обсервабилити-петли.
Читать →
Google DeepMind выпустили AlphaGenome Atlas с предвычисленными предсказаниями молекулярного эффекта и AVI-скорами для 9 миллиардов вариантов человеческой ДНК.
AI От веб-кодинга к вайб-кодингу 🔥
8 сен 2026 22:47
Комментариев пока нет.