RU

Сравниваем LLM, 12 тестов для среднего класса: три Sonnet против GigaChat 2 MAX и YandexGPT Pro 5.1

В первой статье цикла мы гоняли по 12 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro. В …

сравнение нейросетейLLMClaude SonnetGigaChatYandexGPTтестирование ИИискусственный интеллектязыковые моделироссийские нейросетибенчмарки
Habr
RU

Насколько стабильны ответы нейросетей и почему нам стало это интересно

Мы задались вопросом: насколько стабильны ответы нейросетей? Чтобы ответить, собрали по 100 генераций от 5 моделей на один и тот ж…

искусственный интеллектнейросетигенеративный ИИAI SearchAI OverviewАлиса AIGoogle AI Overviewоценка качества нейросетейтестирование нейросетейсравнение нейросетей