RU

[Перевод] Сколько автономности должно быть у ИИ‑агента

ИИ‑агент не должен получать больше автономности только потому, что выглядит компетентным. Автономность должна расти тогда, когда система в…

ии-агентыавтономные агентыАвтономность ииверификация ИИevalsai safety
Habr
RU

GuardRate: как мы построили независимую арену для guardrail-моделей (часть 1)

Всем привет, на связи команда  HiveTrace! Мы уделяем много времени разработке собственных моделей и часто задаемся вопросом: "какой из двух гар…

llmguardrailsguardrail metricsleaderboardevaluationguardrail areanaai safetyprompt-injectionbenchmarkingopen-source
Habr
RU

Как заставить ИИ соблюдать закон, не трогая веса. Выкладываем в открытый доступ внешний фильтр для LLM

В прошлом году я уже рассказывал об AVI (Aligned/Agreement Validation Interface) — концепции внешнего, гибкого и независимого от модели фильтра, кот…

aiai safetyllmфильтралайнментискусственный интеллектгенеративные моделиопенсорскорпоративный иибезопасность ии
Habr
RU

Как заставить ИИ соблюдать закон, не трогая веса. Выкладываем в открытый доступ внешний фильтр для LLM

В прошлом году я уже рассказывал об AVI (Aligned/Agreement Validation Interface) — концепции внешнего, гибкого и независимого от модели фильтра, кот…

aiai safetyllmфильтралайнментискусственный интеллектгенеративные моделиопенсорскорпоративный иибезопасность ии
Habr
RU

Привет, кожаные мешки

Промпт меняет не только тон — он меняет то, кем модель является. У нас было 2 платы Arduino Leonardo, Arduino Pro Micro, маленькая тележка на четырё…

искусственный интеллектllmробототехникаopusвосстание машинсамосознание ииробопсихологияalignmentalignment aiai safety
Habr