<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Journal Publishing DTD v1.3 20210610//EN" "JATS-journalpublishing1-3.dtd">
<article article-type="research-article" dtd-version="1.3" xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xml:lang="ru"><front><journal-meta><journal-id journal-id-type="publisher-id">surguvest</journal-id><journal-title-group><journal-title xml:lang="ru">Вестник Сургутского государственного университета</journal-title><trans-title-group xml:lang="en"><trans-title>Surgut State University Journal</trans-title></trans-title-group></journal-title-group><issn pub-type="epub">2949-3455</issn><publisher><publisher-name>Сургутский государственный университет</publisher-name></publisher></journal-meta><article-meta><article-id pub-id-type="doi">10.35266/2949-3455-2025-3-1</article-id><article-id custom-type="elpub" pub-id-type="custom">surguvest-1272</article-id><article-categories><subj-group subj-group-type="heading"><subject>Research Article</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="ru"><subject>ЭКОНОМИЧЕСКИЕ НАУКИ</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="en"><subject>ECONOMICS</subject></subj-group></article-categories><title-group><article-title>Модели машинного обучения как инструмент обнаружения  подозрительных банковских транзакций</article-title><trans-title-group xml:lang="en"><trans-title>Machine learning models as tool for detecting suspicious bank operations</trans-title></trans-title-group></title-group><contrib-group><contrib contrib-type="author" corresp="yes"><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Аркадьева</surname><given-names>О. Г.</given-names></name><name name-style="western" xml:lang="en"><surname>Arkadeva</surname><given-names>O. G.</given-names></name></name-alternatives><bio xml:lang="ru"><p>кандидат экономических наук, доцент</p></bio><bio xml:lang="en"><p>Candidate of Sciences (Economics), Docent</p></bio><email xlink:type="simple">knedlix@yandex.ru</email><xref ref-type="aff" rid="aff-1"/></contrib><contrib contrib-type="author" corresp="yes"><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Петров</surname><given-names>А. В.</given-names></name><name name-style="western" xml:lang="en"><surname>Petrov</surname><given-names>A. V.</given-names></name></name-alternatives><bio xml:lang="ru"><p>интернет-маркетолог</p></bio><bio xml:lang="en"><p>Internet Marketing Specialist</p></bio><xref ref-type="aff" rid="aff-2"/></contrib></contrib-group><aff-alternatives id="aff-1"><aff xml:lang="ru"><institution>Чувашский государственный университет имени И. Н. Ульянова, Чебоксары</institution><country>Россия</country></aff><aff xml:lang="en"><institution>I. N. Ulianov Chuvash State University, Cheboksary</institution><country>Russian Federation</country></aff></aff-alternatives><aff-alternatives id="aff-2"><aff xml:lang="ru"><institution>ООО «Гарден СПА Отель», Чебоксары</institution><country>Россия</country></aff><aff xml:lang="en"><institution>Garden Hotel &amp; SPA, Cheboksary</institution><country>Russian Federation</country></aff></aff-alternatives><pub-date pub-type="collection"><year>2025</year></pub-date><pub-date pub-type="epub"><day>08</day><month>10</month><year>2025</year></pub-date><volume>13</volume><issue>3</issue><fpage>8</fpage><lpage>21</lpage><permissions><copyright-statement>Copyright &amp;#x00A9; Аркадьева О.Г., Петров А.В., 2025</copyright-statement><copyright-year>2025</copyright-year><copyright-holder xml:lang="ru">Аркадьева О.Г., Петров А.В.</copyright-holder><copyright-holder xml:lang="en">Arkadeva O.G., Petrov A.V.</copyright-holder><license license-type="creative-commons-attribution" xlink:href="https://creativecommons.org/licenses/by/4.0/" xlink:type="simple"><license-p>This work is licensed under a Creative Commons Attribution 4.0 License.</license-p></license></permissions><self-uri xlink:href="https://www.surguvest.ru/jour/article/view/1272">https://www.surguvest.ru/jour/article/view/1272</self-uri><abstract><p>В условиях цифровой трансформации банковской системы и расширения доступности финансовых услуг проблема обеспечения безопасности банковских транзакций приобретает стратегическое значение. Актуальность темы обусловлена необходимостью изучения проблемы эффективности методов прогнозирования и предотвращения мошенничества, которые являются важными составляющими комплексной системы экономической безопасности в банковском секторе. В данном исследовании сделан акцент на формировании моделей обнаружения мошенничества с банковскими картами. В результате исследования предложены конкретные рекомендации по совершенствованию систем антифрод-защиты в банковском секторе с использованием моделей машинного обучения. В рамках этого исследования были разработаны и протестированы модели XGBoost и ANN для выявления мошеннических транзакций, реализованные на языке Python. Эксперименты продемонстрировали их высокую эффективность, а также гибкость и способность адаптироваться к новым данным. Использование этих моделей позволяет банкам оперативно обнаруживать подозрительные операции, что снижает риски потерь и улучшает общую защищенность финансовой системы. Обеспечение безопасного функционирования системы совершения банковских транзакций требует комплексного подхода, включающего не только внедрение современных аналитических инструментов, но и постоянное обучение и обновление моделей для выявления новых способов мошенничества. Реализация предложенных мер позволит кредитным организациям повысить эффективность защиты от мошенничества, снизить финансовые потери от мошеннических действий и укрепить доверие клиентов.</p></abstract><trans-abstract xml:lang="en"><p>Given the digital transformation of the banking system and the expanding availability of financial services, the problem of ensuring the security of banking operations becomes strategically important. The importance of the issue lies in studying the effectiveness of fraud prediction and prevention methods, which are key components of a complete economic security system in the banking sector.  Authors focus on the formation of bank card fraud detection models. The research proposes specific recommendations for improving anti-fraud systems in the banking sector using machine learning models. The researchers implemented and tested XGBoost and ANN models in Python to detect fraudulent transactions. The experiments substantiate their high performance and their flexibility and ability to adapt to new data. Using these models enabled banks for quick detection of suspicious operations, which reduces the risk of losses and improves the overall financial system security. Ensuring the secure functioning of the banking transaction system requires a comprehensive approach that includes not only the introduction of modern analytical tools but also continuous training and updating models to identify new methods of fraud. Implementation of the proposed measures will enable credit organizations to improve the effectiveness of fraud protection, reduce financial losses from fraudulent actions and strengthen client confidence.</p></trans-abstract><kwd-group xml:lang="ru"><kwd>искусственный интеллект</kwd><kwd>типология моделей</kwd><kwd>метрики качества моделей</kwd><kwd>ограничения методов</kwd><kwd>градиентный бустинг</kwd><kwd>нейронная сеть</kwd></kwd-group><kwd-group xml:lang="en"><kwd>artificial intelligence</kwd><kwd>models typology</kwd><kwd>model quality metrics</kwd><kwd>limitations of methods</kwd><kwd>gradient boosting</kwd><kwd>neural network</kwd></kwd-group></article-meta></front><body><sec><title>ВВЕДЕНИЕ</title><p>Цифровизация финансовых услуг открыла клиентам коммерческих банков новые возможности для удобного управления средствами, но параллельно увеличила риск финансовых преступлений, включая мошеннические действия. Масштабы мошеннических операций становятся значительной угрозой для финансовых институтов и их клиентов по всему миру, а экономический ущерб от финансового мошенничества измеряется миллиардами долларов в год. В этих условиях возникает необходимость в развитии высокоэффективных инструментов для защиты от мошенничества.</p><p>Методы машинного обучения (далее – МО) и в целом искусственного интеллекта (далее – ИИ) в последние годы стали важными компонентами защиты от мошенничества. Используя автоматизированные алгоритмы, эти технологии позволяют выявлять аномалии в поведении пользователей, обнаруживать подозрительные транзакции и реагировать на потенциальные угрозы в реальном времени. Благодаря этому внедрение ИИ и МО предоставляет мощные инструменты для своевременного и точного выявления мошеннических операций, минимизируя финансовые риски.</p><p>Каждый случай мошенничества не только приводит к финансовым потерям, но и негативно сказывается на репутации банков, что может вызвать отток клиентов, поэтому разработка и внедрение эффективных мер защиты становятся приоритетом для финансового сектора. Управление рисками, мониторинг транзакций в реальном времени и повышение осведомленности клиентов о способах мошенничества – ключевые элементы, способствующие снижению количества преступлений в этой области.</p><p>Правильное и эффективное использование инструментов обнаружения и предотвращения мошенничества оказывает положительное влияние на банковскую систему, поскольку позволяет:</p><p>− выявлять подозрительную активность и финансовые махинации;</p><p>− идентифицировать клиентов и проверять их платежеспособность;</p><p>− автоматизировать анализ финансовых операций и обнаруживать аномалии с использованием технических средств;</p><p>− защищать аккаунты клиентов от несанкционированного доступа и взлома с помощью биометрических технологий и двухфакторной аутентификации;</p><p>− повышать уровень кибербезопасности и обучать персонал;</p><p>− сотрудничать с правоохранительными органами и развивать корпоративную культуру.</p><p>В данном исследовании сделан акцент на формировании моделей обнаружения мошенничества с банковскими картами, поскольку это одна из наиболее распространенных сфер совершения мошеннических действий [<xref ref-type="bibr" rid="cit1">1</xref>].</p></sec><sec><title>МАТЕРИАЛЫ И МЕТОДЫ</title><p>Для сопоставления возможностей различных моделей МО использован метод описания. В ходе подготовки к апробации практической части в программной среде разработки и выполнения программного кода на языке Python в облаке – Google Colab – были импортированы библиотеки pandas, numpy, matplotlib, seaborn, xgboost, tensorflow. Основным прикладным методом исследования выступило формирование моделей машинного обучения XGBoost и нейронной сети ANN и сравнение результатов их работы по метрикам качества. Для проверки гипотезы об эффективности данных моделей машинного обучения в целях обнаружения подозрительных транзакций использовался набор данных creditcard.csv платформы Kaggle.</p></sec><sec><title>РЕЗУЛЬТАТЫ И ИХ ОБСУЖДЕНИЕ</title><p>В банковском секторе широко распространены технологии ИИ (в особенности МО) [<xref ref-type="bibr" rid="cit2">2</xref>]. Бóльшая часть прикладных проблем, которые решаются с их помощью, связана с деятельностью вокруг поиска и удовлетворения потребностей клиентов, включая привлечение, удержание, отток, улучшение клиентского опыта и легкости взаимодействия, а также формирование лояльности клиентов [<xref ref-type="bibr" rid="cit3">3</xref>]. Вторая область применения ИИ (МО), в которой сконцентрировано большое количество научных исследований – автоматизированные методы кредитного скоринга [<xref ref-type="bibr" rid="cit4">4</xref>][<xref ref-type="bibr" rid="cit5">5</xref>], третья – прогнозирование банковских кризисов [<xref ref-type="bibr" rid="cit6">6</xref>]. В последнее время возрастает научный и практический интерес к проблеме обнаружения и предотвращения мошенничества [<xref ref-type="bibr" rid="cit7">7</xref>]. В сферу внимания исследователей попадают и разные нефинансовые аспекты изучаемой проблемы – так, P. K. Rajani и соавт. рассматривали использование людьми масок при пользовании банковскими услугами как угрозу безопасности в период пандемии COVID-19 и вне ее [<xref ref-type="bibr" rid="cit8">8</xref>]. Исследование регуляторных практик не выявило единообразия в подходах к использованию ИИ в финансовом секторе, однако подтвердило необходимость развития технологий ИИ, в том числе в целях противодействия мошенничеству [<xref ref-type="bibr" rid="cit9">9</xref>].</p><p>МО предлагает более динамичный и адаптивный подход к обнаружению подозрительных операций. Основные преимущества использования МО в задачах борьбы с мошенничеством включают:</p><p>− адаптацию к новым паттернам мошенничества. Алгоритмы МО могут обучаться на новых данных и адаптироваться к изменяющимся стратегиям мошенников;</p><p>− обнаружение скрытых закономерностей. МО позволяет анализировать большой объем данных и находить сложные взаимосвязи, которые трудно выявить с помощью простых аналитических правил;</p><p>− автоматизация и скорость. Алгоритмы могут анализировать транзакции в режиме реального времени, мгновенно выявляя аномалии и отправляя их на проверку;</p><p>− снижение уровня ложных срабатываний. За счет обучения на исторических данных и их анализа МО-системы способны более точно выявлять реальные случаи мошенничества, минимизируя ложные тревоги.</p><p>Эти подходы классифицируются на основе их ключевых тактик, которые включают контролируемое обучение, неконтролируемое обучение и обучение с подкреплением [<xref ref-type="bibr" rid="cit10">10</xref>][<xref ref-type="bibr" rid="cit11">11</xref>]. Для выявления мошенничества используются несколько типов моделей машинного обучения, среди которых наиболее распространены следующие:</p><p>Сравнительная характеристика методов ИИ и моделей МО приведена в табл. 1.</p><table-wrap id="table-1"><caption><p>Таблица 1</p><p>Сравнительная таблица методов ИИ и моделей МО</p><p>Примечание: составлено авторами.</p></caption><table><tbody><tr><td>Тип модели МО /направление ИИ</td><td>Описание</td><td>Примеры методов</td><td>Преимущества</td><td>Ограничения</td></tr><tr><td>Супервизорные модели МО</td><td>Модели обучаются на размеченных данных, где транзакции помечены как мошеннические или немошеннические</td><td>Логистическая регрессия, деревья решений, случайный лес, метод опорных векторов (SVM)</td><td>Высокая точность на размеченных данных, возможность точной классификации</td><td>Зависимость от объема и качества размеченных данных</td></tr><tr><td>Модели МО без учителя</td><td>Модели используют неразмеченные данные для выявления аномалий</td><td>Кластеризация (например, метод K-средних), Isolation Forest, методы на основе плотности (DBSCAN, HDBSCAN, OPTICS)</td><td>Не требует размеченных данных, что полезно для поиска неизвестных угроз</td><td>Менее точные результаты, возможны ложные срабатывания</td></tr><tr><td>Гибридные методы МО</td><td>Совмещение супервизорного и безнадзорного подходов для повышения эффективности</td><td>Сочетание кластеризации и классификации</td><td>Высокая адаптивность, сочетание преимуществ двух подходов</td><td>Более сложная реализация и настройка</td></tr><tr><td>Обработка естественного языка (NLP)</td><td>Анализ текстовой и речевой информации для выявления признаков мошенничества</td><td>NLP для анализа текстов и речи, классификация</td><td>Автоматизация анализа, высокая точность на текстовых данных</td><td>Зависит от объема обучающей выборки языковых моделей</td></tr><tr><td>Глубокое обучение для сложных данных</td><td>Использование глубоких нейронных сетей для анализа многомерных и сложных данных</td><td>Глубокие нейронные сети (DNN)</td><td>Высокая эффективность для сложных данных, адаптация к новым данным</td><td>Высокая вычислительная стоимость, необходимость обработки больших данных</td></tr><tr><td>Адаптивные алгоритмы для персонализации и самообучения</td><td>Алгоритмы обучаются и корректируются на основе новых данных</td><td>LR FTRL-Proximal (Google)</td><td>Адаптация к изменениям, точность классификации</td><td>Сложность настройки и управления</td></tr><tr><td>Распознавание биометрических данных</td><td>Использование биометрических данных для идентификации клиентов</td><td>Распознавание лиц, голоса, отпечатков пальцев</td><td>Высокая надежность и безопасность</td><td>Ограничения по точности, зависимость от качества данных</td></tr><tr><td>Прогнозирование и профилактика мошенничества</td><td>Прогнозирование мошеннических действий на основе анализа поведения и истории клиента</td><td>Предсказательные модели (ARIMA, GARCH)</td><td>Возможность предотвращения мошенничества до его совершения</td><td>Сложность интерпретации, необходимость в большом объеме данных</td></tr></tbody></table></table-wrap><p>ИИ в банковской сфере применяется для повышения точности и адаптивности. ИИ имеет важное значение для эффективности действий финансовых организаций, направленных на предупреждение случаев мошенничества в банковской сфере. Также ИИ используется для повышения качества и актуализации систем обнаружения кибератак. Применение ИИ улучшает процессы идентификации совершаемых операций, снижает различные финансовые риски и укрепляет безопасность банков. Кроме того, технологии ИИ постоянно адаптируются к новым методам и формам мошенничества, оперативно маркируют подозрительные операции, совершаемые мошенниками в целях обмана клиентов.</p><p>ИИ (в частности, МО) применяется по следующим основным направлениям:</p><p>Прогностические модели, основанные на ИИ, позволяют не только выявлять мошеннические действия в процессе их совершения, но и предсказывать возможные риски. Анализ исторических данных и поведения клиентов с помощью ИИ помогает определить, когда и какие действия могут привести к мошенничеству, и принимать превентивные меры. Применение ИИ для повышения точности и адаптивности систем борьбы с мошенничеством значительно укрепляет стабильность и безопасность банковской системы, снижая вероятность финансовых потерь. Внедрение технологий ИИ позволяет банкам быстро реагировать на изменения, успешно противостоять новым видам мошенничества и укреплять доверие клиентов к финансовому сектору.</p><p>Для создания модели обнаружения мошенничества важно использовать соответствующий набор данных, включающий как нормальные, так и мошеннические транзакции. Как правило, такие наборы данных содержат обезличенные транзакции с информацией о суммах операций, времени их осуществления, клиентах и других сведениях, которые помогают выявлять аномалии.</p><p>В данном исследовании использовался набор данных «creditcard.csv», содержащий транзакции по кредитным картам держателей из стран Европы [<xref ref-type="bibr" rid="cit12">12</xref>]. Всего за два дня выявлено 492 случая мошенничества из 284 807 транзакций. Положительный класс (мошенничество) составил 0,172 % от указанного количества транзакций. Набор данных несбалансирован, в нем имеются только числовые переменные, которые были получены в результате преобразования методом главных компонент (PCA). В результате были получены признаки V1, V2, …, V28, являющиеся основными компонентами, в то же время признаки «Время» и «Сумма» этим методом не были преобразованы.</p><p>Признак «Время» содержит секунды, которые произошли между доступом и первой транзакцией в наборе данных. Признак «Сумма» содержит общую сумму транзакций, он может быть использован для обучения с учетом объема транзакции. Признак «Класс» является переменной ответа. В случае положительного ответа он принимает значение 1, в случае отсутствия мошеннических действий – 0.</p><p>Перед началом моделирования был проведен анализ данных, основные этапы анализа включали:</p><p>− исследование описания полей;</p><p>− анализ дисбаланса классов. Определено, что доля мошеннических транзакций составляет лишь небольшой процент от общего числа. Из-за дисбаланса классов дальнейшие этапы потребуют специальных методов для повышения точности распознавания меньшего класса;</p><p>− исследование распределения признаков. Построены графики распределения транзакционных характеристик, таких как сумма и время, чтобы выявить возможные закономерности или аномалии, отличающие мошеннические операции (рис. 1, 2).</p><fig id="fig-1"><caption><p>Рис. 1. Распределение времени операций в наборе данных</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g001.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/AnhufBs5bU3UB6yfqnLQun0f7Bh0DpHsBImvCojI.jpeg</uri></graphic></fig><fig id="fig-2"><caption><p>Рис. 2. Распределение суммы операций в наборе данных</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g002.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/CJQ88r0MNKhV2li9HIpY7nS5e108y2jIMgnkdkxF.jpeg</uri></graphic></fig><p>Традиционные аналитические действия не позволяют установить связь времени транзакции и мошеннических действий, несмотря на наличие явно выраженных экстремумов распределения транзакций по времени. Анализ распределения транзакций по сумме также непоказателен, что требует применения моделей МО для более глубокого анализа.</p><p>Проводя анализ распределений, можно получить представление об искажении этих признаков; кроме того, определяется дальнейшее распределение других признаков и определение методов, которые могут сделать распределения менее искаженными.</p><p>Для выявления возможных связей между признаками была построена корреляционная матрица. Это может помочь модели по распознаванию мошеннических транзакций (рис. 3). Самые высокие корреляции получены от: время и V3 (-0,42), сумма и V2 (-0,53), сумма и V4 (0,4).</p><fig id="fig-3"><caption><p>Рис. 3. Корреляционная матрица по набору данных</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g003.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/uN0BzCnP4luetAcLIVxOTIwwsCOlm87F3EkrwX8G.jpeg</uri></graphic></fig><p>Несмотря на то что эти корреляции являются достаточно высокими, связь не настолько выраженная, чтобы считать эти переменные подверженными риску мультиколлинеарности.</p><p>Ни один из компонентов PCA V1–V28, как показывает матрица корреляции, не имеет никакой выраженной корреляции друг с другом. Однако класс имеет некоторую форму положительной и отрицательной корреляции с компонентами V и не имеет корреляции с временем операций и их суммами.</p><p>Полученные результаты анализа помогают уточнить гипотезы о паттернах, характеризующих мошеннические операции, и определить оптимальный подход к обработке данных, но сами по себе не могут служить базой для формирования четких критериев мошеннических действий.</p><p>Предварительная обработка данных в наборе состоит из нескольких этапов, необходимых для подготовки данных в целях обучения модели для дальнейшего обнаружения мошеннических транзакций.</p><p>Работа включает следующие этапы:</p><p>− нормализация признаков;</p><p>− разделение данных на признаки и целевую переменную;</p><p>− разделение на обучающую и тестовую выборки;</p><p>− расчет весов классов;</p><p>− вывод формы массивов данных.</p><p>XGBoost (Extreme Gradient Boosting) представляет собой алгоритм градиентного бустинга, показывающий высокую эффективность в задачах классификации. Это особенно хорошо проявляется на дисбалансных данных, таких как наборы данных с мошенническими транзакциями. Популярность алгоритма объясняется высокой точностью и способностью эффективно работать с большими объемами данных, хотя и за счет потерь в скорости вычислений.</p><p>Этапами построения модели являются:</p><p>− инициализация и обучение модели. Для тонкой настройки модели XGB Classifier можно дополнительно оптимизировать гиперпараметры learning_rate, max_depth, estimators вместо применения параметров по умолчанию;</p><p>− прогнозирование и оценка точности. Обучение модели происходит на тренировочных данных X_train и y_train. После окончания обучения модель может прогнозировать значения как на тренировочной, так и на тестовой выборках.</p><p>Искусственная нейронная сеть (ANN) использует библиотеку Tensor Flow (модуль keras). ANN обрабатывает сложные и нелинейные зависимости в данных, адаптируется к признакам для более успешного выполнения задач по обнаружению мошенничества.</p><p>Структура модели:</p><p>− модель содержит несколько полносвязных слоев (Dense). Каждый из них состоит из 256 нейронов с функцией активации ReLU, что помогает моделировать нелинейные зависимости;</p><p>− batch normalization применяется после каждого слоя, стабилизируя и ускоряя процесс обучения;</p><p>− dropout с вероятностью 0,3 помогает исключить переобучение, случайным образом «отключая» нейроны во время обучения;</p><p>− выходной слой с функцией активации sigmoid и одним нейроном используется для бинарной классификации (мошенническая операция или нет).</p><p>Модель компилируется с использованием оптимизатора Adam и низкой скоростью обучения (learning_rate=1e-4), что способствует более точной настройке параметров. В качестве функции потерь используется binary_crossentropy, так как задача – бинарная классификация. В список метрик включены показатели precision и recall, а также True/FalsePositives и True/FalseNegatives для глубокого анализа результатов.</p><p>Обучение модели:</p><p>− параметр class_weight: Веса классов {0: w_p, 1: w_n} используются для борьбы с дисбалансом классов, так как мошеннических транзакций в выборке меньше;</p><p>− CallbackModelCheckpoint: используется для сохранения модели после каждой эпохи, чтобы в случае успешного результата можно было выбрать лучшую версию;</p><p>− обучение проводится на 300 эпохах и с большим размером батча (2048), что снижает вариативность обновлений весов и стабилизирует обучение;</p><p>− валидационные данные помогают контролировать, как модель обучается и не переобучается ли она.</p><p>Визуализируются метрики на каждом этапе обучения (например, Loss, FalseNegatives, Precision, Recall). Эти графики позволяют оценить, как модель улучшала свои показатели, и увидеть, на какой эпохе она достигла наилучшего результата (рис. 4).</p><fig id="fig-4"><caption><p>Рис. 4. Обучение XGBoost-модели</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g004.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/VoI0JbbC6gfytileeYDu3oO9RJPAqAmulczQgFx9.jpeg</uri></graphic></fig><p>Для оценки точности моделей XGBoost и искусственной нейронной сети ANN использовались метрики классификации, такие как точность (accuracy), точность классификации (precision), полнота (recall), F1-меры (рис. 5), а также матрицы ошибок (рис. 6). Эти метрики помогают оценить, насколько хорошо модели справляются с задачей выявления мошеннических транзакций на тренировочных и тестовых данных.</p><fig id="fig-5"><caption><p>Рис. 5. Метрики качества XGBoost-модели</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g005.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/RXWEE4a5sZmnQT5IZXn86Ix1SqVMGgfvDBvhCQO0.jpeg</uri></graphic></fig><fig id="fig-6"><caption><p>Рис. 6. Матрицы ошибок XGBoost-модели</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g006.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/tNA8pvJ88Bj2pVqBIuj8ZOWfDPOBhoHOWOR8tmKG.jpeg</uri></graphic></fig><p>Матрица ошибок на тренировочной выборке не имеет ошибок (все мошеннические и немошеннические транзакции были правильно классифицированы). Точность модели на тестовой выборке составила 99,96 %, что также свидетельствует о высокой способности модели обучаться на новых данных. Модель достигла F1-score = 0,88 для класса «мошенничество» и 1,00 для не мошеннического класса, что говорит о хорошей точности, но несколько сниженной полноте для класса «мошенничество» (метрика recall для этого класса составила 0,82).</p><p>Матрица ошибок на тестовой выборке показывает, что модель допустила 6 ошибок при классификации немошеннических транзакций и 25 ошибок для мошеннических, что является приемлемым уровнем ошибок, учитывая общий дисбаланс данных.</p><p>Оценка модели ANN представлена на рис. 7, 8.</p><fig id="fig-7"><caption><p>Рис. 7. Метрики качества ANN-модели</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g007.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/5kZM2gV2mK5IoiNL7CJSnprCKoV60VOiTpQxCm7H.jpeg</uri></graphic></fig><fig id="fig-8"><caption><p>Рис. 8. Матрицы ошибок ANN-модели</p><p>Примечание: составлено авторами.</p></caption><graphic xlink:href="surguvest-13-3-g008.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/surguvest/2025/3/ITTQCWV1UvUh8IzYQIadn1mUCmVTj9ajmY6nal6n.jpeg</uri></graphic></fig><p>Точность на тренировочной выборке для ANN составила 99,99 %, что немного ниже по сравнению с XGBoost, но все еще свидетельствует о высокой точности. Модель также показала высокий уровень F1-score для обоих классов, однако для класса «мошенничество» F1-score составил 0,97, что отражает небольшие ошибки в классификации. В матрице ошибок на тренировочных данных видно, что модель допустила 1 ошибку для не мошеннического класса и 15 ошибок для мошеннического, что допустимо и свидетельствует о высокой обучаемости сети. Точность на тестовой выборке для ANN составила 99,96 %, что аналогично точности XGBoost. Метрика F1-score для класса «мошенничество» составила 0,86, что немного ниже, чем у XGBoost, в то время как для не мошеннического класса она сохранила значение 1,00. Матрица ошибок показывает 9 ошибок для не мошеннического класса и 26 ошибок для мошеннического. Хотя модель ANN также справляется с задачей, ее precision, F1-score и recall-метрики немного уступают модели XGBoost (табл. 2).</p><table-wrap id="table-2"><caption><p>Таблица 2</p><p>Сравнительная таблица метрик</p><p>Примечание: составлено авторами.</p></caption><table><tbody><tr><td>Модель</td><td>Данные</td><td>Точность (%)</td><td>F1-scoreFraud</td><td>F1-scoreNon-fraud</td><td>ОшибкаFraud</td><td>ОшибкиNon-fraud</td></tr><tr><td>XGBoost</td><td>Тренировочные</td><td>100</td><td>1,00</td><td>1,00</td><td>0</td><td>0</td></tr><tr><td>Тестовые</td><td>99,96</td><td>0,88</td><td>1,00</td><td>25</td><td>6</td></tr><tr><td>ANN</td><td>Тренировочные</td><td>99,99</td><td>0,97</td><td>1,00</td><td>15</td><td>1</td></tr><tr><td>Тестовые</td><td>99,96</td><td>0,86</td><td>1,00</td><td>26</td><td>9</td></tr></tbody></table></table-wrap><p>Обе модели продемонстрировали достаточно хорошие результаты на задаче обнаружения мошенничества с высокой точностью классификации. Однако модель XGBoost показала чуть более высокую эффективность в плане метрик F1-score и общего числа ошибок. Это позволяет сделать вывод, что XGBoost является предпочтительной моделью для решения данной задачи. Однако в случае использования любой из моделей остаются проблемы, связанные с такими явлениями, как дрейф концепций и дисбаланс классов, которые ставят задачи усовершенствования моделирования МО [<xref ref-type="bibr" rid="cit13">13</xref>].</p></sec><sec><title>ЗАКЛЮЧЕНИЕ</title><p>Банковское мошенничество – серьезная проблема, с которой сталкиваются финансовые институты по всему миру. Технологический прогресс и рост онлайн-активности добросовестных экономических субъектов делают преступников более изобретательными и агрессивными, создавая новые вызовы для банков и их клиентов. Для обеспечения безопасности финансовых операций, защиты персональных данных и поддержания доверия клиентов к банковским услугам необходим комплексный подход к предотвращению мошеннических действий с использованием моделей машинного обучения для анализа банковских транзакций.</p><p>По причине того что риск потери репутации для банков зачастую превышает риски финансовых потерь, некоторые кредитные организации не раскрывают сведения о произошедших случаях мошенничества. Хотя эксперты в области банковской безопасности хорошо осведомлены о способах хищения средств, методах расследования и масштабах краж, внутренние инциденты, как правило, остаются поводами для внутренних расследований и последующих действий своими силами или с привлечением правоохранительных органов, но не банковского сообщества в целом. Между тем проблема мошенничества при совершении банковских транзакций для российского банковского сектора исключительно актуальна. Основные предпосылки роста такого мошенничества включают увеличение количества совершаемых финансовых операций, доступность персональных данных граждан, развитие интернет-торговли и технологических инноваций. В связи с этим банки и другие финансовые институты должны совершенствовать методы защиты данных, активно работать в направлении повышения осведомленности клиентов о мерах безопасности, сотрудничать с правоохранительными органами и развивать собственную корпоративную культуру. При этих условиях грамотное и высококвалифицированное использование инструментов обнаружения и предотвращения мошенничества на основе технологий МО позволит банкам точечно и безошибочно выявлять подозрительную активность, точнее идентифицировать клиентов, эффективнее проводить аудит и контролировать свои процессы и операции, а также защищать аккаунты клиентов от несанкционированного доступа и взлома.</p></sec></body><back><ref-list><title>References</title><ref id="cit1"><label>1</label><citation-alternatives><mixed-citation xml:lang="ru">Hernandez Aros L., Bustamante Molano L. X., Gutierrez-Portela F. et al. Financial fraud detection through the application of machine learning techniques: A literature review // Humanities and Social Sciences Communications. 2024. Vol. 11. https://doi.org/10.1057/s41599-024-03606-0.</mixed-citation><mixed-citation xml:lang="en">Hernandez Aros L., Bustamante Molano L. X., Gutierrez-Portela F. et al. Financial fraud detection through the application of machine learning techniques: A literature review // Humanities and Social Sciences Communications. 2024. Vol. 11. https://doi.org/10.1057/s41599-024-03606-0.</mixed-citation></citation-alternatives></ref><ref id="cit2"><label>2</label><citation-alternatives><mixed-citation xml:lang="ru">Kalyani S., Gupta N. Is artificial intelligence and machine learning changing the ways of banking: A systematic literature review and meta analysis // Discover Artificial Intelligence. 2023. Vol. 3. https://doi.org/10.1007/s44163-023-00094-0.</mixed-citation><mixed-citation xml:lang="en">Kalyani S., Gupta N. Is artificial intelligence and machine learning changing the ways of banking: A systematic literature review and meta analysis // Discover Artificial Intelligence. 2023. Vol. 3. https://doi.org/10.1007/s44163-023-00094-0.</mixed-citation></citation-alternatives></ref><ref id="cit3"><label>3</label><citation-alternatives><mixed-citation xml:lang="ru">Курносова В. В. Технологии искусственного интеллекта в банкинге // Экономика и менеджмент инновационных технологий. 2022. № 8. URL: https://ekonomika.snauka.ru/2022/08/23330 (дата обращения: 06.02.2025).</mixed-citation><mixed-citation xml:lang="en">Курносова В. В. Технологии искусственного интеллекта в банкинге // Экономика и менеджмент инновационных технологий. 2022. № 8. URL: https://ekonomika.snauka.ru/2022/08/23330 (дата обращения: 06.02.2025).</mixed-citation></citation-alternatives></ref><ref id="cit4"><label>4</label><citation-alternatives><mixed-citation xml:lang="ru">Трусова А. Ю., Ильина А. И. Методология внедрения машинного обучения в банковской сфере // Вестник Самарского университета. Экономика и управление. 2023. Т. 14, № 4. С. 186–201. https://doi.org/10.18287/2542-0461-2023-14-4-186-201.</mixed-citation><mixed-citation xml:lang="en">Трусова А. Ю., Ильина А. И. Методология внедрения машинного обучения в банковской сфере // Вестник Самарского университета. Экономика и управление. 2023. Т. 14, № 4. С. 186–201. https://doi.org/10.18287/2542-0461-2023-14-4-186-201.</mixed-citation></citation-alternatives></ref><ref id="cit5"><label>5</label><citation-alternatives><mixed-citation xml:lang="ru">Шебалков М. П. Современные методы машинного обучения в банковской отрасли // Экономика и управление: проблемы, решения. 2022. Т. 3, № 9. С. 9–14. https://doi.org/10.36871/ek.up.p.r.2022.09.03.002.</mixed-citation><mixed-citation xml:lang="en">Шебалков М. П. Современные методы машинного обучения в банковской отрасли // Экономика и управление: проблемы, решения. 2022. Т. 3, № 9. С. 9–14. https://doi.org/10.36871/ek.up.p.r.2022.09.03.002.</mixed-citation></citation-alternatives></ref><ref id="cit6"><label>6</label><citation-alternatives><mixed-citation xml:lang="ru">Виноградов А. С. Использование машинного обучения в финансовом прогнозировании в банках // Актуальные вопросы современной экономики. 2022. № 5.</mixed-citation><mixed-citation xml:lang="en">Виноградов А. С. Использование машинного обучения в финансовом прогнозировании в банках // Актуальные вопросы современной экономики. 2022. № 5.</mixed-citation></citation-alternatives></ref><ref id="cit7"><label>7</label><citation-alternatives><mixed-citation xml:lang="ru">Аркадьева О. Г. Использование методов машинного обучения для отслеживания социальной инженерии в банковских транзакциях // Oeconomia et Jus. 2024. № 4. С. 1–14. https://doi.org/10.47026/2499-9636-2024-4-1-14.</mixed-citation><mixed-citation xml:lang="en">Аркадьева О. Г. Использование методов машинного обучения для отслеживания социальной инженерии в банковских транзакциях // Oeconomia et Jus. 2024. № 4. С. 1–14. https://doi.org/10.47026/2499-9636-2024-4-1-14.</mixed-citation></citation-alternatives></ref><ref id="cit8"><label>8</label><citation-alternatives><mixed-citation xml:lang="ru">Rajani P. K., Khaparde A., Bendre V. et al. Fraud detection and prevention by face recognition with and without mask for banking application // Multimedia Tools and Applications. 2025. Vol. 84. P. 781–804. https://doi.org/10.1007/s11042-024-19021-1.</mixed-citation><mixed-citation xml:lang="en">Rajani P. K., Khaparde A., Bendre V. et al. Fraud detection and prevention by face recognition with and without mask for banking application // Multimedia Tools and Applications. 2025. Vol. 84. P. 781–804. https://doi.org/10.1007/s11042-024-19021-1.</mixed-citation></citation-alternatives></ref><ref id="cit9"><label>9</label><citation-alternatives><mixed-citation xml:lang="ru">Аркадьева О. Г., Березина Н. В. Формирование модели государственного регулирования развития технологий искусственного интеллекта в финансовом секторе // Oeconomia et Jus. 2023. № 4. С. 12–21. https://doi.org/10.47026/2499-9636-2023-4-12-21.</mixed-citation><mixed-citation xml:lang="en">Аркадьева О. Г., Березина Н. В. Формирование модели государственного регулирования развития технологий искусственного интеллекта в финансовом секторе // Oeconomia et Jus. 2023. № 4. С. 12–21. https://doi.org/10.47026/2499-9636-2023-4-12-21.</mixed-citation></citation-alternatives></ref><ref id="cit10"><label>10</label><citation-alternatives><mixed-citation xml:lang="ru">Лихоузов К. И. Применение задач машинного обучения на платформе распределенных вычислений больших данных в банковской сфере // Цифровая трансформация управления: проблемы и решения : материалы V Всерос. науч.-практич. конф., 11 мая 2023 г., г. Москва. М. : Государственный университет управления, 2023. С. 127–129.</mixed-citation><mixed-citation xml:lang="en">Лихоузов К. И. Применение задач машинного обучения на платформе распределенных вычислений больших данных в банковской сфере // Цифровая трансформация управления: проблемы и решения : материалы V Всерос. науч.-практич. конф., 11 мая 2023 г., г. Москва. М. : Государственный университет управления, 2023. С. 127–129.</mixed-citation></citation-alternatives></ref><ref id="cit11"><label>11</label><citation-alternatives><mixed-citation xml:lang="ru">Gandhar A., Gupta K., Pandey A. K. et al. Fraud detection using machine learning and deep learning // SN Computer Science. 2024. Vol. 5. https://doi.org/10.1007/s42979-024-02772-x.</mixed-citation><mixed-citation xml:lang="en">Gandhar A., Gupta K., Pandey A. K. et al. Fraud detection using machine learning and deep learning // SN Computer Science. 2024. Vol. 5. https://doi.org/10.1007/s42979-024-02772-x.</mixed-citation></citation-alternatives></ref><ref id="cit12"><label>12</label><citation-alternatives><mixed-citation xml:lang="ru">Credit Card Fraud Detection. URL: https://www.kaggle.com/datasets/mlg-ulb/creditcardfraud/data (дата обращения: 06.02.2025).</mixed-citation><mixed-citation xml:lang="en">Credit Card Fraud Detection. URL: https://www.kaggle.com/datasets/mlg-ulb/creditcardfraud/data (дата обращения: 06.02.2025).</mixed-citation></citation-alternatives></ref><ref id="cit13"><label>13</label><citation-alternatives><mixed-citation xml:lang="ru">Wang S., Chen B. Credit card attrition: An overview of machine learning and deep learning techniques // Informatics. Economics. Management. 2023. Vol. 2, no. 4. P. 134–144. https://doi.org/10.47813/2782-5280-2023-2-4-0134-0144.</mixed-citation><mixed-citation xml:lang="en">Wang S., Chen B. Credit card attrition: An overview of machine learning and deep learning techniques // Informatics. Economics. Management. 2023. Vol. 2, no. 4. P. 134–144. https://doi.org/10.47813/2782-5280-2023-2-4-0134-0144.</mixed-citation></citation-alternatives></ref></ref-list><fn-group><fn fn-type="conflict"><p>The authors declare that there are no conflicts of interest present.</p></fn></fn-group></back></article>
