AI От веб-кодинга к вайб-кодингу 🔥
AI От веб-кодинга к вайб-кодингу 🔥

AI-дайджест · 4 сентября

AI-дайджест · 4 сентября

Банковский ИИ без человека: почему HITL пока не отменяется
Разбор практик крупных банков показывает, что даже при тотальной автоматизации финальное решение остается за человеком. В HSBC заявки с уверенностью модели ниже 95% уходят живому кредитному инспектору, а в JPMorgan Chase ИИ работает только как супер-аналитик с жесткими «шлюзами одобрения».
Почему важно: Если строишь агентов для regulated-доменов, закладывай HITL-архитектуру сразу: порог уверенности для эскалации и явные approval gates — это не legacy, а требование выживания системы.
Читать →

Claude Fable 5.1: бенчмарк с нестандартной задачей
Появился бенчмарк Claude Fable 5.1 с задачей «Draw a Python Reading a Book». Детали пока недоступны, но формулировка предполагает проверку модели на нестандартном запросе.
Почему важно: Стоит отследить, как модель справляется с абстрактными инструкциями — это полезный сигнал для агентов, принимающих произвольные пользовательские задачи.
Читать →

Европейский EU AI Act (статья 14) прямо обязывает финансовые институты проектировать высокорисковые ИИ-системы так, чтобы их могли «эффективно контролировать физические лица». Для инженеров это значит: HITL — не опция, а юридическое требование в финансовом секторе ЕС.

Комментариев пока нет.