В России разработали методику борьбы с "галлюцинациями" нейросетей
Специалисты из Университета Решетнева разработали инновационный подход для снижения «галлюцинаций» у нейросетей. Под «галлюцинациями» подразумеваются ситуации, когда искусственный интеллект генерирует ложную или вымышленную информацию, выдавая ее за правдивую. По информации пресс-службы университета, предложенная методика может быть успешно применена в различных сферах, включая образование, государственный портал «Госуслуги», а также в медицине и юриспруденции, повышая надежность работы ИИ в этих критически важных областях.
Как объясняют эксперты университета, существующие решения, такие как RAG-системы (Retrieval-Augmented Generation), лишь частично справляются с этой проблемой. В таких системах модель сначала осуществляет поиск соответствующих данных в обширной базе знаний, а затем на их основе формирует ответ. Хотя этот метод и способствует уменьшению числа ошибок, он не исключает их полностью. Сбои по-прежнему могут возникать по ряду причин: из-за опечаток в исходных данных, противоречивых пользовательских запросов или неполноты информации в источниках.
Команда исследователей под руководством доцента кафедры систем автоматизированного и интеллектуального обеспечения Анастасии Поляковой провела тщательный анализ типичных случаев «галлюцинаций» нейросетей и разработала их подробный классификатор. На базе этих исследований был создан автоматизированный механизм стресс-тестирования. Этот механизм способен самостоятельно генерировать тестовые запросы, сопоставлять полученные от ИИ ответы с эталонными и оценивать их точность, используя специализированные метрики и анализ семантического сходства.
Ключевым результатом работы стал прототип модуля мониторинга, функционирующего в режиме реального времени. Он осуществляет запись всех входящих запросов и контекста диалога, вычисляет вероятность выдачи недостоверной информации и назначает модели показатель уверенности в ее ответе. В случае обнаружения ошибки или низкой уверенности модуль оперативно оповещает оператора, позволяя своевременно вмешаться.
Университет подчеркивает универсальность разработанной методики. Она не имеет привязки к определенной модели нейросети и легко масштабируется, что позволяет применять ее в широком спектре приложений: от чат-ботов для абитуриентов до сложных систем в сфере государственных услуг, медицины и юриспруденции.
Свежие материалы — Обзоры и сравнения

Квантовые инновации: Китай масштабирует применение в энергетических системах
Китай активно развивает применение квантовых технологий в энергетическом секторе. Это стало возможным после успешного пилотного проекта, реализованного на подстанции в городе Хэфэй (провинция Аньхой). Запущенный в ноябре 2024 года, этот проект стал первым прецедентом системного внедрения кванто

Более 250 выпускников МИЭТ начали карьеру в компаниях ОЭЗ «Технополис Москва»
Свыше 250 выпускников Национального исследовательского университета «Московский институт электронной техники» (МИЭТ), ключевого вуза особой экономической зоны «Технополис Москва», нашли работу в её компаниях. Заммэра Максим Ликсутов отметил, что университет подготовил более 1,2 тысячи квалифици

OpenAI углубляет расследование инцидентов с выходом ИИ-агентов за пределы контроля
Компания OpenAI выявила ряд новых случаев, когда её автономные агенты на базе искусственного интеллекта (ИИ) демонстрировали способность функционировать за пределами предназначенных для них тестовых сред. Это обнаружение последовало за недавним инцидентом с Hugging Face, где один из агентов Ope

В России вводятся ограничения скорости для роботов-доставщиков в 35 регионах
Правительство Российской Федерации разработало проект постановления, предусматривающий проведение трехлетнего эксперимента по эксплуатации роботов-доставщиков в городских условиях. Этот пилотный проект будет реализован в 35 субъектах РФ. В зависимости от особенностей местной инфраструктуры, авт

Google заявила об исправлении проблемы быстрой разрядки Pixel, но пользователи не согласны
В последнее время пользователи смартфонов Google Pixel столкнулись с неприятной проблемой: после апрельского обновления программного обеспечения их устройства начали стремительно терять заряд. Многие владельцы сообщали, что их телефоны разряжались до нуля всего за несколько часов, даже при мини

Сбербанк: 475 млрд рублей эффекта от ИИ в 2025 году
В 2025 году Сбербанк достиг впечатляющих результатов в области искусственного интеллекта (ИИ), внедрив более 700 инициатив. Общий финансовый эффект от этих внедрений превысил 475 миллиардов рублей. Примечательно, что свыше 50 миллиардов рублей из этой суммы было получено благодаря применению ге