<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Journal Publishing DTD v1.3 20210610//EN" "JATS-journalpublishing1-3.dtd">
<article article-type="research-article" dtd-version="1.3" xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xml:lang="ru"><front><journal-meta><journal-id journal-id-type="publisher-id">donstu</journal-id><journal-title-group><journal-title xml:lang="ru">Advanced Engineering Research (Rostov-on-Don)</journal-title><trans-title-group xml:lang="en"><trans-title>Advanced Engineering Research (Rostov-on-Don)</trans-title></trans-title-group></journal-title-group><issn pub-type="epub">2687-1653</issn><publisher><publisher-name>Don State Technical University</publisher-name></publisher></journal-meta><article-meta><article-id pub-id-type="doi">10.23947/2687-1653-2026-26-3-2619</article-id><article-id custom-type="edn" pub-id-type="custom">QSBFGG</article-id><article-id custom-type="elpub" pub-id-type="custom">donstu-2824</article-id><article-categories><subj-group subj-group-type="heading"><subject>Research Article</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="ru"><subject>ИНФОРМАТИКА, ВЫЧИСЛИТЕЛЬНАЯ ТЕХНИКА И УПРАВЛЕНИЕ</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="en"><subject>INFORMATION TECHNOLOGY, COMPUTER SCIENCE AND MANAGEMENT</subject></subj-group></article-categories><title-group><article-title>Интеллектуальная модель прогнозирования технологических нарушений электролиза алюминия типа «конус» на основе методов ансамблевого обучения</article-title><trans-title-group xml:lang="en"><trans-title>An Intelligent Model for Predicting Spike Type Technological Process Disturbances in Aluminum Electrolysis Based on Ensemble Learning Technologies</trans-title></trans-title-group></title-group><contrib-group><contrib contrib-type="author" corresp="yes"><contrib-id contrib-id-type="orcid">https://orcid.org/0000-0002-8986-5953</contrib-id><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Михалев</surname><given-names>А. С.</given-names></name><name name-style="western" xml:lang="en"><surname>Mikhalev</surname><given-names>A. S.</given-names></name></name-alternatives><bio xml:lang="ru"><p>Антон Сергеевич Михалев, программист 1-й категории</p><p>660036, г. Красноярск, ул. Академгородок, 50/44</p><p>ResearcherID: JAO-0694-2023</p><p>Scopus Author ID: 57189996049</p><p>SPIN-код: 7980-2691</p></bio><bio xml:lang="en"><p>Anton S. Mikhalev, First-category Programmer</p><p>50/44, Akademgorodok, Krasnoyarsk, 660036</p><p>ResearcherID: JAO-0694-2023</p><p>Scopus Author ID: 57189996049</p><p>SPIN-code: 7980-2691</p></bio><email xlink:type="simple">asmikhalev@yandex.ru</email><xref ref-type="aff" rid="aff-1"/></contrib><contrib contrib-type="author" corresp="yes"><contrib-id contrib-id-type="orcid">https://orcid.org/0000-0002-0057-0535</contrib-id><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Пенькова</surname><given-names>Т. Г.</given-names></name><name name-style="western" xml:lang="en"><surname>Penkova</surname><given-names>T. G.</given-names></name></name-alternatives><bio xml:lang="ru"><p>Татьяна Геннадьевна Пенькова, кандидат технических наук, доцент, заведующий отделом «Прикладная информатика», старший научный сотрудник</p><p>660036, г. Красноярск, ул. Академгородок, 50/44</p><p>ResearcherID: JWO-2888-2024</p><p>Scopus Author ID: 36718130500</p><p>SPIN-код: 2281-3852</p></bio><bio xml:lang="en"><p>Tatiana G. Penkova, Cand.Sci. (Eng.), Associate Professor, Head of the Applied Informatics Department, Senior Research Fellow</p><p>50/44, Akademgorodok, Krasnoyarsk, 660036</p><p>ResearcherID: JWO-2888-2024</p><p>Scopus Author ID: 36718130500</p><p>SPIN-code: 2281-3852</p></bio><email xlink:type="simple">penkova_tg@icm.krasn.ru</email><xref ref-type="aff" rid="aff-1"/></contrib><contrib contrib-type="author" corresp="yes"><contrib-id contrib-id-type="orcid">https://orcid.org/0000-0002-9277-8981</contrib-id><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Ноженкова</surname><given-names>Л. Ф.</given-names></name><name name-style="western" xml:lang="en"><surname>Nozhenkova</surname><given-names>L. F.</given-names></name></name-alternatives><bio xml:lang="ru"><p>Людмила Федоровна Ноженкова, доктор технических наук, профессор, главный научный сотрудник</p><p>660036, г. Красноярск, ул. Академгородок, 50/44</p><p>ResearcherID: P-8196-2015</p><p>Scopus Author ID: 49561698200</p><p>SPIN-код: 8354-3536</p></bio><bio xml:lang="en"><p>Ludmila F. Nozhenkova, Dr.Sci. (Eng.), Professor, Chief Research Fellow</p><p>50/44, Akademgorodok, Krasnoyarsk, 660036</p><p>ResearcherID: P-8196-2015</p><p>Scopus Author ID: 49561698200</p><p>SPIN-code: 8354-3536</p></bio><email xlink:type="simple">expert@icm.krasn.ru</email><xref ref-type="aff" rid="aff-1"/></contrib></contrib-group><aff-alternatives id="aff-1"><aff xml:lang="ru"><institution>Институт вычислительного моделирования Сибирского отделения Российской академии наук</institution><country>Россия</country></aff><aff xml:lang="en"><institution>Institute of Computational Modelling of the Siberian Branch of the Russian Academy of Sciences</institution><country>Russian Federation</country></aff></aff-alternatives><pub-date pub-type="collection"><year>2026</year></pub-date><pub-date pub-type="epub"><day>06</day><month>10</month><year>2026</year></pub-date><volume>26</volume><issue>3</issue><fpage>2619</fpage><lpage>2619</lpage><permissions><copyright-statement>Copyright &amp;#x00A9; Михалев А.С., Пенькова Т.Г., Ноженкова Л.Ф., 2026</copyright-statement><copyright-year>2026</copyright-year><copyright-holder xml:lang="ru">Михалев А.С., Пенькова Т.Г., Ноженкова Л.Ф.</copyright-holder><copyright-holder xml:lang="en">Mikhalev A.S., Penkova T.G., Nozhenkova L.F.</copyright-holder><license license-type="creative-commons-attribution" xlink:href="https://creativecommons.org/licenses/by/4.0/" xlink:type="simple"><license-p>This work is licensed under a Creative Commons Attribution 4.0 License.</license-p></license></permissions><self-uri xlink:href="https://www.vestnik-donstu.ru/jour/article/view/2824">https://www.vestnik-donstu.ru/jour/article/view/2824</self-uri><abstract><sec><title>Введение</title><p>Введение. Обеспечение высоких технико-экономических показателей выпуска алюминия — актуальная производственная задача. Использование искусственного интеллекта позволяет ограничить влияние таких технологических нарушений, как деформация подошвы анода с формированием конусов. Достаточно хорошо изучены причины и последствия образования конусов. Названы десятки параметров, которые сигнализируют о нарушении. Однако известные решения фиксируют уже возникшие отклонения или предсказывают смежные состояния. Производственные реалии требуют адекватного заблаговременного уведомления о проблеме. Цель представленной работы — создание и апробация интеллектуальной модели для раннего прогнозирования нарушений типа «конус» при производстве алюминия.</p></sec><sec><title>Материалы и методы</title><p>Материалы и методы. Исследовались более 70 технологических параметров, данные среднесуточного мониторинга восьми электролизеров опытного участка (2020–2025 гг.). Положительный класс сформирован по предаварийному интервалу 72–24 ч до регистрации нарушения. Для прогнозирования применялись ансамблевые методы:– градиентный бустинг (XGBoost, CatBoost, LightGBM); – автоматизированный конвейер FEDOT; – нейросетевые ансамбли (RTDL-RM, RTDL-NE, TabM).</p></sec><sec><title>Метрики качества</title><p>Метрики качества: Accuracy, Precision, Recall, F1.</p></sec><sec><title>Результаты исследования</title><p>Результаты исследования. Оптимальной признана модель LightGBM: Accuracy — 0,88; Recall — 0,79; F1 — 0,79. В категории событий без нарушений она корректно классифицировала состояние «норма» в 95 % случаев (900 наблюдений). В 5 % случаев (46 наблюдений) ошибочно распознано «нарушение». В категории событий с нарушениями верно распознаны 62,5 % состояний (10 наблюдений), в 37,5 % случаев (6 наблюдений) нарушения пропущены. Апробация на данных реального технологического процесса доказала способность модели выявлять конусы за 24–72 ч до фактической регистрации. При апробации зарегистрировано шесть событий обнаружения конуса, модель выявила признаки развития нарушения для пяти (83,3 %).</p></sec><sec><title>Обсуждение</title><p>Обсуждение. Результаты согласуются с физико-технологическими особенностями возникновения конуса. Предложенное решение дополняет методы локального контроля анодов и электролизеров благодаря анализу параметров среднесуточного мониторинга. Апробация подтвердила известные проблемы прогностических моделей в условиях промышленного электролиза: сложность регистрации событий, дисбаланс классов, изменение характеристик. Данных мониторинга восьми электролизеров опытного участка недостаточно, и для подтверждения универсальности модели нужна дополнительная проверка — с другой продолжительностью, на других участках.</p></sec><sec><title>Заключение</title><p>Заключение. Подтвердились способность модели прогнозировать нарушение за 24–72 часа до регистрации конуса и ее достаточная эффективность при ограничениях, обусловленных объемом выборки и изменчивостью технологических условий. Дальнейшие исследования предполагают аугментацию данных, проверку модели на других участках производства, комплексный анализ параметров среднесуточного и мгновенного мониторинга для локализации нарушения.</p></sec></abstract><trans-abstract xml:lang="en"><sec><title>Introduction</title><p>Introduction. Maintaining high technical and economic performance in aluminum production is a pressing operational challenge. The use of artificial intelligence makes it possible to mitigate the impact of process irregularities such as the deformation of the anode bottom resulting in spike formation. The causes and consequences of spike formation have been thoroughly studied. Dozens of parameters signaling this disturbance are identified. However, existing solutions typically detect deviations only after they have occurred or predict related states. Industrial realities demand adequate, advance warning of the problem. The objective of this study is to develop and validate an intelligent model for the early prediction of spike type disturbances under aluminum production.</p></sec><sec><title>Materials and Methods</title><p>Materials and Methods. The study has analyzed over 70 process parameters based on average daily monitoring data from eight electrolyzers at a pilot site (2020–2025). The positive class was defined based on the pre-failure interval spanning 72 to 24 hours prior to the recorded disturbance. Ensemble methods were used for prediction: – gradient boosting (XGBoost, CatBoost, LightGBM); – FEDOT automated pipeline; – neural network ensembles (RTDL-RM, RTDL-NE, TabM).</p></sec><sec><title>Quality metrics</title><p>Quality metrics: Accuracy, Precision, Recall, F1.</p></sec><sec><title>Results</title><p>Results. The LightGBM model was identified as optimal, with the following metrics: Accuracy — 0.88; Recall — 0.79; F1 — 0.79. For events without disturbances, it correctly classified the “normal” state in 95% of cases (900 observations), while incorrectly identifying “disturbance” in 5% of cases (46 observations). For events involving disturbances, 62.5% of states were correctly identified (10 observations), whereas disturbances were missed in 37.5% of cases (6 observations). Validation using data from an actual technological process showed the model ability to detect spikes 24–72 hours prior to their actual registration. During the validation, six spike formation events were recorded, and the model detected signs of the developing disturbance in five of them (83.3%).</p></sec><sec><title>Discussion</title><p>Discussion. The research results are consistent with the physical and technological characteristics of spike formation. The proposed solution complements existing methods for the local monitoring of anodes and electrolyzers through analyzing parameters derived from daily monitoring data. Validation confirms known challenges for predictive models in industrial electrolysis: difficulty in event detection, class imbalance, and changing process characteristics. The monitoring data from eight electrolyzers at the pilot site are insufficient. Further testing is required to confirm the model generalizability — over longer periods and at other sites.</p></sec><sec><title>Conclusion</title><p>Conclusion. The ability of the model to predict a disturbance 24–72 hours prior to the detection of a spike formation was confirmed, as was its sufficient effectiveness given the constraints imposed by sample size and the variability of process conditions. Future research will involve data augmentation, model validation at other production sites, and a comprehensive analysis of average daily and instantaneous monitoring parameters to localize the disturbance.</p></sec></trans-abstract><kwd-group xml:lang="ru"><kwd>технологические нарушения при производстве алюминия</kwd><kwd>прогнозирование нарушений типа «конус»</kwd><kwd>модель LightGBM</kwd><kwd>деформация подошвы анода</kwd><kwd>контроль анодов и электролизеров</kwd></kwd-group><kwd-group xml:lang="en"><kwd>process disturbances in aluminum production</kwd><kwd>prediction of spike defects</kwd><kwd>LightGBM model</kwd><kwd>anode bottom deformation</kwd><kwd>monitoring of anodes and electrolyzers</kwd></kwd-group><funding-group><funding-statement xml:lang="ru">Авторы выражают благодарность ведущим специалистам автоматизации производства ООО «РУСАЛ Инженерно-технологический центр» за экспертную оценку и возможность апробации моделей. Работа выполнена в рамках проекта «Математическое и информационное моделирование сложных физических и производственных процессов и систем» (код (шифр) проекта FWES-2024-0013) из государственного задания ИВМ СО РАН — обособленного подразделения ФИЦ КНЦ СО РАН (номер государственного учета НИР 124012900550-1), https://gisnauka.ru/nioktr/detail/B5CV3ILS5GQHT0KT8Y7VHDA6</funding-statement><funding-statement xml:lang="en">The authors would like to thank the lead technicians of production automation at RUSAL Engineering and Technology Center LLC for their expert assessment and the opportunity to test the developed models. The research was done within the framework of the project “Mathematical and information modeling of complex physical and industrial processes and systems” (FWES-2024-0013 project code) from the state assignment of the Institute of Computational Modelling, the Siberian Branch of the Russian Academy of Sciences (124012900550-1 state registration number of the R&amp;D project), https://gisnauka.ru/nioktr/detail/B5CV3ILS5GQHT0KT8Y7VHDA6</funding-statement></funding-group></article-meta></front><body><p>Введение. Развитие алюминиевой промышленности требует наращивания объемов производства первичного алюминия [<xref ref-type="bibr" rid="cit1">1</xref>]. Для достижения высоких технико-экономических показателей необходимы передовые методы управления сложными технологическими процессами. Их задача — обеспечить своевременную оценку состояния всего производственного комплекса [<xref ref-type="bibr" rid="cit2">2</xref>] и его элементов [<xref ref-type="bibr" rid="cit3">3</xref>]. Основные сдерживающие факторы — технологические нарушения, возникающие в процессе электролиза [<xref ref-type="bibr" rid="cit4">4</xref>], в том числе деформация подошвы анода с формированием характерных выступов, так называемых «конусов» [<xref ref-type="bibr" rid="cit5">5</xref>] (рис. 1).</p><fig id="fig-1"><caption><p>Рис. 1. Деформация поверхности анода: а — типичный конус; б — конус «отставание»</p></caption><graphic xlink:href="donstu-26-3-g001.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/donstu/2026/3/GHcpklZCcyZTxXUosGjYyxDiqVpGNqJc6F2XUVIG.jpeg</uri></graphic><graphic xlink:href="donstu-26-3-g001.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/donstu/2026/3/tnuwncNGZXOPXwXJZWNWVB1A7ZG2p4CiP33efaeq.jpeg</uri></graphic></fig><p>Возможные причины образования конусов:</p><p>Нарушение ведет к изменению анодно-катодного расстояния и токораспределения в электролизере. Соответственно, образование конуса может стать причиной короткого замыкания анода и катода, роста флуктуаций тока, интенсивного пенообразования, повышения уровня шумов [<xref ref-type="bibr" rid="cit8">8</xref>].</p><p>Проблему образования конусов следует признать системной, существенно влияющей на технологические и энергетические показатели электролиза. Развитие конуса приводит к резкому перераспределению тока, локальным перегревам, коротким замыканиям и снижению выхода по току, которое при массовом развитии нарушений может достигать нескольких процентов. Даже небольшое снижение частоты таких событий в промышленном масштабе может существенно увеличить энергоэффективность, стабильность процесса и объем выпуска алюминия.</p><p>Исследования значений технологических параметров в различных режимах работы при производстве алюминия показали, что образование конусов сопровождается экстремальными значениями десятка параметров [<xref ref-type="bibr" rid="cit9">9</xref>]. Из-за жестких условий и сложности технологического процесса своевременная диагностика данного нарушения крайне затруднена, и отклонение выявляется на критической стадии. Кроме того, автоматизацию существенно осложняют многочисленные взаимозависимые параметры, ручные методы измерения и инерционность процесса. В этих условиях особую значимость приобретает анализ накопленных данных для выявления косвенных признаков развития нарушения. Благодаря интеллектуальным методам и технологиям обработки больших данных можно извлекать нетривиальные, ранее неизвестные и поддающиеся интерпретации знания. Такой подход позволяет объяснять снижение производительности, своевременно обнаруживать и прогнозировать отклонения в технологическом процессе [<xref ref-type="bibr" rid="cit10">10</xref>].</p><p>Методы машинного обучения стали одним из основных инструментов анализа [<xref ref-type="bibr" rid="cit11">11</xref>], оптимизации производственных процессов [<xref ref-type="bibr" rid="cit12">12</xref>] и широко применяются для задач диагностики технологических нарушений в алюминиевой промышленности [<xref ref-type="bibr" rid="cit13">13</xref>]:</p><p>Особое внимание уделяется виртуальному измерению важнейших для технологии электролиза параметров, которые сложно или невозможно напрямую контролировать в реальном времени:</p><p>Такие модели решают задачу оценки текущего состояния технологии, но не позволяют заблаговременно выявить момент формирования нарушений.</p><p>Отдельное направление исследований связано с прогнозированием технологических нарушений и нештатных режимов. Статистический анализ производственных данных, экспертные знания и интеллектуальные модели стали базой для обзора методов обнаружения неисправностей и технологических отклонений в работе алюминиевых электролизеров [<xref ref-type="bibr" rid="cit15">15</xref>]. Основная задача изысканий в этой сфере — идентификация отклонений. Отметим, что прогнозирование конкретного нарушения требует анализа его предшествующей динамики. Сложность диагностики обусловлена многомерностью процесса электролиза, взаимным влиянием технологических параметров и изменчивостью условий эксплуатации.</p><p>Для обнаружения анодов с развивающимся конусом в [<xref ref-type="bibr" rid="cit16">16</xref>] предложен анализ анодных токов методами машинного обучения. Решение позволяет выявлять значительную часть нарушений за несколько суток до того, как признаки конуса становятся очевидными для технологического персонала. Анодные токи обеспечивают высокую чувствительность к локальным изменениям конкретного анода, однако такой подход требует соответствующей системы измерения индивидуальных токов и анализа локальных электрических характеристик.</p><p>В [<xref ref-type="bibr" rid="cit17">17</xref>] предложена промышленная модель прогнозирования конусов с помощью скрытых моделей Маркова. Авторы выделяют характерные для данной задачи проблемы:</p><p>Полученные результаты демонстрируют возможность прогнозирования конусов средствами машинного обучения. При этом необходимо повышать устойчивость моделей к изменению технологических режимов, сокращать количество ложных срабатываний и учитывать динамику производственных параметров.</p><p>Известные решения главным образом фиксируют уже возникшие отклонения или прогнозируют смежные состояния. Пока недостаточно внимания уделяется построению интеллектуальных моделей раннего прогнозирования нарушений. Есть определенные успехи в прогнозировании нарушений с четко выраженными изменениями отдельных технологических параметров [<xref ref-type="bibr" rid="cit18">18</xref>]. Это, например, анодный эффект [<xref ref-type="bibr" rid="cit19">19</xref>], нарушение концентрации глинозема, различные проблемы механической и электрической неисправности [<xref ref-type="bibr" rid="cit20">20</xref>]. Однако нерешенной остается задача раннего прогнозирования конусов. Здесь необходим комплексный анализ многомерных данных мониторинга, который по доступным технологическим параметрам выявляет скрытые закономерности возникновения и развития такого нарушения. Помимо высокой точности прогнозирования с учетом особенностей производственного объекта необходима интерпретируемость прогностической модели. Для ее применения в промышленных условиях недостаточно классифицировать состояние электролизера. Важно определить, какие технологические параметры вносят наибольший вклад в прогноз, какие признаки предвещают нарушения и насколько полученные зависимости согласуются с физико-технологической природой процесса. Требуются модели для анализа значимости признаков и выявления аномальных паттернов.</p><p>Цель представленной работы — создание интеллектуальной модели для раннего прогнозирования технологических нарушений типа «конус» при производстве алюминия. Предложенная модель базируется на комплексном анализе технологических параметров с применением методов ансамблевого обучения. Для достижения цели решаются три задачи.</p><p>Материалы и методы. В 2020–2025 гг. проводился мониторинг на опытном участке комплекса производства алюминия. Отслеживалась работа восьми электролизеров с обожженными анодами технологии РА-550. Данные контроля и автоматизированной системы управления технологическим процессом предоставили для анализа более 70 параметров, которые характеризуют работу отдельных единиц (электролизеров, корпусов) в различных режимах функционирования. Назовем некоторые из этих индикаторов: уровень металла, уровень электролита, температура электролита, длительность выливки металла, параметры химического состава электролита, параметры системы подачи глинозема и фтористого алюминия, режимы питания, параметры регулирования межполюсного расстояния между металлом и подошвой углеродного анода, параметры напряжения, тока, шума, характеристики зарегистрированных технологических нарушений, показатели срока службы электролизеров и технологических операций.</p><p>Для формализации построения модели прогнозирования определили последовательность этапов обработки и анализа данных (рис. 2).</p><fig id="fig-2"><caption><p>Рис. 2. Схема построения интеллектуальной модели прогнозирования нарушения типа «конус»</p></caption><graphic xlink:href="donstu-26-3-g002.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/donstu/2026/3/gtEZpc72uanQZ1mJZhJN9jMh2xnXSmaMnt0vSupr.jpeg</uri></graphic></fig><p>На начальном этапе формируется массив данных производственного мониторинга. Далее они очищаются и предварительно обрабатываются: устраняются пропуски, проверяется корректность записей, готовится признаковое пространство. После этого проводится разметка наблюдений по классам «норма» и «нарушение». Результаты машинного обучения во многом зависят от качества и полноты входных данных, корректности их разметки: чем полнее и точнее исходная информация, тем выше достоверность прогнозов. Затем данные разделяются на обучающую, валидационную и тестовую выборки с учетом временно́й структуры процесса. Для технологического процесса характерны выраженная временна́я зависимость, инерционность и повторяемость состояний в смежные периоды. В связи с этим целесообразно использовать временно́е разделение, при котором обучение выполняется на более ранних наблюдениях, а проверка — на последующих. Такой подход позволяет оценить способность модели не просто воспроизводить известные закономерности, но и прогнозировать развитие технологического нарушения в условиях, приближенных к реальным. На следующем этапе обучается и настраивается прогностическая модель, подбираются оптимальные параметры. Далее — валидация и сравнительная оценка результатов прогнозирования по выбранным метрикам качества. Заключительный этап предполагает апробацию модели. Это проверка ее способности заблаговременно прогнозировать конус на реальных технологических данных.</p><p>Конус может формироваться довольно быстро: с момента появления дефекта до замыкания анода с катодом иногда проходит около трех суток [<xref ref-type="bibr" rid="cit21">21</xref>]. Рост напряжения и шумов тока отмечается уже на 2–3-й день [<xref ref-type="bibr" rid="cit22">22</xref>]. В связи с этим трехдневный интервал, предшествующий регистрации нарушения, рассматривается в данной работе как значимый предаварийный период для анализа параметров мониторинга и построения модели раннего прогнозирования.</p><p>При формировании обучающей выборки учитывался день фактической регистрации нарушения, т.е. день, когда конус обнаруживался при визуальном осмотре анода, извлеченного из электролизера. Данные в день регистрации нарушения исключались из обучающей выборки. Для каждого события, зарегистрированного в момент T, к положительному классу относились наблюдения, попадающие в предаварийный интервал от T-72 ч до T-24 ч включительно.</p><p>На этапе предварительной обработки мониторинговых данных пропущенные значения восстанавливались с помощью алгоритма множественной итеративной импутации (multiple imputation by chained equations, MICE) [<xref ref-type="bibr" rid="cit23">23</xref>]. Каждый параметр, содержащий пропущенные значения, поочередно рассматривался как целевая переменная, а остальные выступали в роли признаков. В качестве базовой модели, применяемой для оценки пропусков, используется Bayesian Ridge регрессия. Перед запуском итераций начальные значения пропусков заполняются медианой соответствующего признака. Далее параметры с пропущенными значениями последовательно обрабатываются: модель обучается на наблюдениях с известными значениями, после чего используется для прогнозирования пропусков в соответствующих записях.</p><p>Для построения интеллектуальной прогностической модели исследовались две группы методов: ансамбли на основе деревьев решений и ансамбли нейронных сетей. Ансамблевые методы основаны на объединении нескольких базовых моделей, что позволяет повысить точность и устойчивость прогнозирования. В данной работе для прогнозирования нарушений выбраны следующие реализации градиентного бустинга над деревьями решений [<xref ref-type="bibr" rid="cit24">24</xref>]: XGBoost, CatBoost и LightGBM. Указанные алгоритмы относятся к классу индустриальных. Они используются для работы с разнородными признаковыми пространствами и демонстрируют устойчивые результаты в задачах классификации. Алгоритм XGBoost (extreme gradient boosting) представляет собой оптимизированную реализацию градиентного бустинга, в которой минимизация функции потерь сочетается с регуляризацией сложности модели. Такой подход направлен на повышение обобщающей способности алгоритма и снижение риска переобучения. Особенность алгоритма CatBoost (categorical boosting) — специальная схема обработки категориальных переменных и построения последовательных оценок, уменьшающая вероятность появления смещений, связанных с кодированием признаков. Алгоритм LightGBM (light gradient-boosting machine) ориентирован на эффективную обработку больших массивов данных и обеспечивает высокую скорость обучения при сохранении приемлемой точности. Наряду с отдельными алгоритмами градиентного бустинга в работе применяется библиотека FEDOT. Она использует эволюционные методы и предназначена для автоматизированного построения составных конвейеров машинного обучения. С помощью библиотеки выполняется поиск структуры модели, подбираются способы предварительной обработки и объединения результатов. При этом можно исследовать не только заранее заданные модели, но и автоматически сформированные комбинации методов, а также сопоставить их качество в одинаковых условиях обучения и тестирования.</p><p>В дополнение к ансамблевым алгоритмам на основе деревьев решений исследуются подходы глубокого обучения, основанные на ансамблях нейронных сетей [<xref ref-type="bibr" rid="cit25">25</xref>]: RTDL-RM, RTDL-NE, TabM. Подход RTDL-RM (RTDL-revisiting-models) предполагает применение стандартных архитектур нейронных сетей для табличных данных. Можно достичь высокой производительности благодаря ансамблированию, настройке функций активации, нормализации и регуляризации. При модификации RTDL-NE (RTDL-num-embeddings) применяются специальные представления числовых признаков. Каждый числовой параметр преобразуется в вектор. Эмбеддинг позволяет моделям более эффективно учитывать сложные нелинейные зависимости между признаками и целевой переменной. Подход TabM реализует объединение нескольких моделей-экспертов, совместно формирующих итоговый прогноз. Для уменьшения вычислительной сложности используются общие параметры и отдельные низкоранговые адаптеры, построенные по принципу LoRA (low-rank adaptation). Это позволяет увеличить число моделей в ансамбле без значительного роста количества обучаемых параметров.</p><p>Наиболее эффективные алгоритмы и оптимальные параметры настройки интеллектуальных моделей выбираются на основе метрик оценки качества классификации: достоверность (ассuracy), точность (precision), полнота (recall) и F1-мера (F1-score) [<xref ref-type="bibr" rid="cit26">26</xref>].</p><p>Для построения и оценки интеллектуальных моделей исходный набор данных среднесуточного мониторинга разделен с учетом временно́й структуры производственного процесса (рис. 3).</p><fig id="fig-3"><caption><p>Рис. 3. Схема временно́го разбиения данных на обучающую, валидационную, тестовую выборки и апробацию</p></caption><graphic xlink:href="donstu-26-3-g003.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/donstu/2026/3/5SpZPQ9bzj8z4u5nLd6Qw12SF6iPRMGs1Gg7T5vg.jpeg</uri></graphic></fig><p>В качестве обучающей выборки используются данные с 01.01.2020 по 31.12.2023 (17768 записей). Валидационная выборка сформирована по данным с 01.01.2024 по 31.12.2024 (2230 записей). Тестовая включает данные с 01.01.2025 по 30.06.2025 (1342 записи). Дополнительно для проверки работоспособности прогностической модели выделен апробационный период — с 01.07.2025 по 28.10.2025 (962 записи).</p><p>Такое временно́е разделение позволяет снизить риск утечки информации между выборками и оценить способность модели прогнозировать нарушение на данных, не участвовавших в обучении и настройке. Обучающая выборка предназначена для построения моделей, валидационная — для подбора гиперпараметров и выбора порога классификации, тестовая — для независимого сравнения качества алгоритмов, апробационная — для проверки модели в условиях, приближенных к промышленной эксплуатации.</p><p>В таблице 1 представлено распределение записей по классам «норма» и «нарушение» для каждой выборки.</p><table-wrap id="table-1"><caption><p>Таблица 1</p><p>Распределение наблюдений по классам в выборках</p></caption><table><tbody><tr><td>Класс</td><td>Обучение</td><td>Валидация</td><td>Тестирование</td><td>Апробация</td></tr><tr><td>Норма</td><td>16429</td><td>1902</td><td>1234</td><td>946</td></tr><tr><td>Нарушение</td><td>1339</td><td>328</td><td>108</td><td>16</td></tr></tbody></table></table-wrap><p>Очевиден дисбаланс: число примеров нормального режима работы электролизеров значительно превышает количество случаев предаварийного состояния, предшествующего обнаружению конуса. Такое распределение влияет на обучение и оценку моделей. Распознавание преобладающего класса дает высокую точность, при этом плохо выявляются редкие предаварийные состояния.</p><p>Для компенсации дисбаланса в работе применяются весовые коэффициенты классов, позволяющие увеличить вклад ошибок на объектах положительного класса в функцию потерь и снизить смещение модели в сторону нормального режима. Качество моделей оценивается по метрикам Precision, Recall и F1-score, которые в условиях редкого целевого события значительно информативнее Accuracy.</p><p>Вычисления выполнялись на рабочей станции под управлением операционной системы Windows 11, оснащенной графическим процессором GeForce RTX 4080, 12 Гб. Программная реализация выполнена на языке Python 3.13 в среде разработки PyCharm. Для обработки и анализа данных использовались библиотеки NumPy, pandas, scikit-learn. Модели градиентного бустинга реализованы с помощью библиотек XGBoost, CatBoost, LightGBM. Автоматизированное построение моделей выполнялось средствами библиотеки FEDOT. Нейросетевые модели реализованы с использованием PyTorch, RTDL, TabM. Во всех вычислениях, содержащих стохастические операции, использовалось фиксированное значение генератора псевдослучайных чисел.</p><p>Результаты исследования. Вычислительные эксперименты позволили выбрать параметры, обеспечивающие максимальные значения метрик оценки качества. Эти данные стали базой для разработки интеллектуальной прогностической модели. Гиперпараметры с диапазонами и оптимальными значениями для каждого типа модели приводятся в таблицах 2–4.</p><table-wrap id="table-2"><caption><p>Таблица 2</p><p>Гиперпараметры бустинг-модели XGBoost</p></caption><table><tbody><tr><td>№</td><td>Гиперпараметр</td><td>Диапазон</td><td>Значение</td></tr><tr><td>1</td><td>Estimators (количество деревьев)</td><td>[ 50, 5000]</td><td>4500</td></tr><tr><td>2</td><td>Max depth (максимальная глубина дерева)</td><td>[ 3, 25]</td><td>18</td></tr><tr><td>3</td><td>Learning rate (шаг обучения)</td><td>[ 1e-5, 1]</td><td>0,008</td></tr><tr><td>4</td><td>Subsample (доля выборки)</td><td>[ 0,5, 1]</td><td>0,701</td></tr><tr><td>5</td><td>Col sample by level (доля признаков на уровень)</td><td>[ 0,5, 1]</td><td>0,623</td></tr><tr><td>6</td><td>Col sample by tree (доля признаков на дерево)</td><td>[ 0,5, 1]</td><td>0,714</td></tr><tr><td>7</td><td>Alpha (альфа — коэффициент L1-регуляризации)</td><td>[ 1e-8, 10]</td><td>3,302</td></tr><tr><td>8</td><td>Lambda (лямбда — коэффициент L2-регуляризации)</td><td>[ 1e-8, 10]</td><td>8,654</td></tr><tr><td>9</td><td>Gamma (гамма — порог разделения)</td><td>[ 1e-8, 10]</td><td>0,067</td></tr></tbody></table></table-wrap><table-wrap id="table-3"><caption><p>Таблица 3</p><p>Гиперпараметры бустинг-модели CatBoost</p></caption><table><tbody><tr><td>№</td><td>Гиперпараметр</td><td>Диапазон</td><td>Значение</td></tr><tr><td>1</td><td>Learning rate (шаг обучения)</td><td>[ 1e-5, 1]</td><td>0,031</td></tr><tr><td>2</td><td>Depth (глубина дерева)</td><td>[ 3, 16]</td><td>10</td></tr><tr><td>3</td><td>RSM (доля случайно выбираемых признаков)</td><td>[ 0,5, 1]</td><td>0,752</td></tr><tr><td>4</td><td>L2 leaf reg (коэффициент L2-регуляризации)</td><td>[ 1, 10]</td><td>2,511</td></tr><tr><td>5</td><td>Leaf estimation iterations (число итераций оценки листьев)</td><td>[ 1, 10]</td><td>1</td></tr></tbody></table></table-wrap><table-wrap id="table-4"><caption><p>Таблица 4</p><p>Гиперпараметры бустинг-модели LightGBM</p></caption><table><tbody><tr><td>1</td><td>Estimators (количество деревьев)</td><td>[ 50, 5000]</td><td>4000</td></tr><tr><td>2</td><td>Max depth (максимальная глубина дерева)</td><td>[ 3, 10]</td><td>10</td></tr><tr><td>3</td><td>Learning rate (шаг обучения)</td><td>[ 1e-5, 1]</td><td>0,011</td></tr><tr><td>4</td><td>Num leaves (количество листьев)</td><td>[ 1, 100]</td><td>75</td></tr><tr><td>5</td><td>Feature fraction (доля признаков)</td><td>[ 0.5, 1]</td><td>0,561</td></tr><tr><td>6</td><td>Min data in leaf (минимальное количество данных в листе)</td><td>[ 10, 500]</td><td>25</td></tr><tr><td>7</td><td>Min child weight (минимальный вес разбиения)</td><td>[ 1e-3, 50]</td><td>0,038</td></tr><tr><td>8</td><td>Reg lambda1 (коэффициент L1-регуляризации)</td><td>[ 1e-8, 10]</td><td>0,452</td></tr><tr><td>9</td><td>Reg lambda2 (коэффициент L2-регуляризации)</td><td>[ 1e-8, 10]</td><td>7,022</td></tr></tbody></table></table-wrap><p>С помощью конвейера FEDOT определена структура алгоритма, включающего модели машинного обучения XGBoost, «Случайный лес» и «Логистическая регрессия». Для модели «Случайный лес» определены гиперпараметры:</p><p>Для модели XGBoost определены гиперпараметры:</p><p>Для модели «Логистическая регрессия» использовалась конфигурация по умолчанию. Дополнительно применялись нормализация стандартным масштабированием (StandardScaler) и ресемплинг данных с параметрами по умолчанию.</p><p>В таблице 5 представлены результаты оценки качества прогностических моделей для рассматриваемых архитектур на тестовой выборке. Для нее взяли данные мониторинга работы опытного участка. В квадратных скобках приводятся 95-процентные доверительные интервалы, рассчитанные бутстрэп-методом на тестовой выборке. Интервалы позволяют сравнивать модели не только по точечным оценкам метрик, но и по устойчивости полученных результатов.</p><table-wrap id="table-5"><caption><p>Таблица 5</p><p>Результаты оценки качества прогностических моделей</p></caption><table><tbody><tr><td>XGBoost</td><td>0,87</td><td>[ 0,85; 0,89]</td><td>0,78</td><td>[ 0,72; 0,83]</td><td>0,69</td><td>[ 0,62; 0,75]</td><td>0,72</td><td>[ 0,66; 0,77]</td></tr><tr><td>CatBoost</td><td>0,87</td><td>[ 0,85; 0,90]</td><td>0,77</td><td>[ 0,71; 0,82]</td><td>0,76</td><td>[ 0,70; 0,82]</td><td>0,77</td><td>[ 0,72; 0,82]</td></tr><tr><td>LightGBM</td><td>0,88</td><td>[ 0,86; 0,90]</td><td>0,78</td><td>[ 0,73; 0,84]</td><td>0,79</td><td>[ 0,73; 0,85]</td><td>0,79</td><td>[ 0,74; 0,84]</td></tr><tr><td>FEDOT</td><td>0,87</td><td>[ 0,84; 0,89]</td><td>0,80</td><td>[ 0,74; 0.86]</td><td>0,74</td><td>[ 0,68; 0,80]</td><td>0,77</td><td>[ 0,71; 0,82]</td></tr><tr><td>RTDL-RM</td><td>0,86</td><td>[ 0,84; 0,88]</td><td>0,76</td><td>[ 0,70; 0,82]</td><td>0,76</td><td>[ 0,69; 0,82]</td><td>0,76</td><td>[ 0,70; 0,81]</td></tr><tr><td>RTDL-NE</td><td>0,86</td><td>[ 0,84; 0,89]</td><td>0,76</td><td>[ 0,71; 0,82]</td><td>0,78</td><td>[ 0,72; 0,84]</td><td>0,77</td><td>[ 0,71; 0,82]</td></tr><tr><td>TabM</td><td>0,84</td><td>[ 0,82; 0,87]</td><td>0,74</td><td>[ 0,68; 0,80]</td><td>0,78</td><td>[ 0,71; 0,84]</td><td>0,76</td><td>[ 0,70; 0,81]</td></tr></tbody></table></table-wrap><p>Анализ данных таблицы 5 позволяет судить об эффективности моделей для исследуемых данных.</p><p>LightGBM демонстрирует наилучшую общую производительность среди всех исследуемых алгоритмов, лидируя по метрикам Accuracy (0,88), Recall (0,79) и F1 (0,79). Высокие значения меры параметра Recall указывают на способность эффективно выявлять нарушения (низкий уровень ложноотрицательных событий), что крайне важно для раннего оповещения.</p><p>XGBoost и CatBoost показывают сопоставимый уровень — Accuracy (0,87). Тем не менее по метрикам Recall (0,76 против 0,69) и F1 (0,77 против 0,72) CatBoost заметно опережает XGBoost. Это говорит о том, что CatBoost надежнее выявляет нарушения, а XGBoost чаще их пропускает.</p><p>Алгоритм, автоматически построенный с помощью библиотеки FEDOT, демонстрирует точность Accuracy 0,87. Этот результат сопоставим с LightGBM. К тому же значение Precision (0,80) — наилучшее среди всех рассмотренных моделей, т.е. в данном случае фиксируется меньше всего ложных срабатываний. Это определяет доверие к выдаваемым прогнозам и снижает нагрузку на персонал, вынужденный реагировать на ложные события. По F1-мере (0,77) алгоритм выходит на один уровень с CatBoost.</p><p>Нейросетевые модели в виде ансамблей также показали конкурентоспособные результаты. В этой группе RTDL-NE демонстрирует лучшую F1-меру (0,77) и высокий Recall (0,78), что подчеркивает значимость качественного кодирования числовых признаков при работе с табличными данными. У TabM при высоком Recall (0,78) самый низкий уровень Accuracy (0,84) и Precision (0,74). Скорее всего, это связано с особенностями его архитектуры — parameter-efficient ensembling, требующей дополнительной настройки для исходного набора данных.</p><p>Таким образом, модель архитектуры LightGBM оптимальна для прогнозирования технологических нарушений типа «конус» при исходном наборе мониторинговых данных. Она демонстрирует наилучший баланс между полнотой обнаружения (Recall) и общей точностью (F1).</p><p>Для апробации на реальных данных опытного участка предложенную интеллектуальную модель интегрировали в информационно-аналитическую систему оперативного управления процессом производства алюминия [<xref ref-type="bibr" rid="cit27">27</xref>]. Система может предупреждать о возможных нарушениях при превышении заданного порога вероятности. Сигнал передается дежурному оператору или технологу, который на основе текущих параметров работы электролизеров решает, нужны ли проверка и корректирующие воздействия.</p><p>Эффективность модели оценивается на апробационной выборке путем сопоставления прогнозов с фактами нарушений. Выборка содержит 962 суточные записи, из которых 946 относятся к нормальному состоянию технологического процесса, а 16 — к предаварийному, сформированному для шести зарегистрированных событий обнаружения конуса. Результаты оценки представлены в матрице ошибок (рис. 4), содержащей возможные комбинации предсказанных и реальных значений.</p><fig id="fig-4"><caption><p>Рис. 4. Матрица ошибок по данным апробации модели прогнозирования технологических нарушений типа «конус»</p></caption><graphic xlink:href="donstu-26-3-g004.jpeg"><uri content-type="original_file">https://cdn.elpub.ru/assets/journals/donstu/2026/3/gVLjbyHhgJ1jrUIllLyzoVMQaxA3fcXySt7f1FUN.jpeg</uri></graphic></fig><p>Класс 0 обозначает отсутствие нарушения, класс 1 — наличие нарушения. При совпадении прогнозируемого и фактического классов результат классификации считается истинным, а при несовпадении — ложным. Таким образом, матрица ошибок отображает результаты:</p><p>Применительно к модели прогнозирования результат считается положительным при пороге вероятности 0,4. Он установлен по результатам анализа качества классификации и рассматривается как компромисс между полнотой выявления нарушений и допустимым числом ложных предупреждений (таблица 6).</p><table-wrap id="table-6"><caption><p>Таблица 6</p><p>Оценка качества модели при различных порогах вероятности</p></caption><table><tbody><tr><td>F1</td><td>0,55</td><td>0,65</td><td>0,72</td><td>0,78</td><td>0,63</td><td>0,58</td><td>0,52</td><td>0,48</td><td>0,46</td></tr></tbody></table></table-wrap><p>Исходя из значений матрицы ошибок, сформированной по результатам апробации модели, следует, что в категории событий без нарушений (верхняя строка матрицы) предложенная модель корректно классифицировала состояние «норма» в 95 % случаев (900 наблюдений), тогда как в 5 % случаев (46 наблюдений) было ошибочно определено состояние «нарушение». В категории событий с нарушениями (нижняя строка матрицы) доля верно распознанных состояний составила 62,5 % (10 наблюдений), а в 37,5 % случаев (6 наблюдений) нарушения остались незамеченными.</p><p>В таблице 7 показаны прогнозы по отдельным событиям при апробации. Результаты прогнозирования рассматривались в период предаварийного состояния — трехдневный интервал, предшествующий дню обнаружения (регистрации) конуса. Из-за близости событий на одном и том же электролизере для события 04.08.2025 учитывается только один день предаварийного состояния.</p><table-wrap id="table-7"><caption><p>Таблица 7</p><p>Результаты прогнозирования конуса в апробационный период</p></caption><table><tbody><tr><td>№&#13;
п/п</td><td>№&#13;
электролизера</td><td>Дата обнаружения конуса</td><td>Дата предаварийного состояния</td><td>Результат прогнозирования</td></tr><tr><td>вероятность</td><td>класс</td></tr><tr><td>1</td><td>7</td><td>27.07.2025</td><td>24.07.2025</td><td>0,27</td><td>0</td></tr><tr><td>25.07.2025</td><td>0,62</td><td>1</td></tr><tr><td>26.07.2025</td><td>0,74</td><td>1</td></tr><tr><td>2</td><td>6</td><td>02.08.2025</td><td>01.08.2025</td><td>0,56</td><td>1</td></tr><tr><td>31.07.2025</td><td>0,68</td><td>1</td></tr><tr><td>30.07.2025</td><td>0,82</td><td>1</td></tr><tr><td>3</td><td>6</td><td>04.08.2025</td><td>03.08.2025</td><td>0,74</td><td>1</td></tr><tr><td>4</td><td>8</td><td>11.08.2025</td><td>08.08.2025</td><td>0,31</td><td>0</td></tr><tr><td>09.08.2025</td><td>0,57</td><td>1</td></tr><tr><td>10.08.2025</td><td>0,76</td><td>1</td></tr><tr><td>5</td><td>5</td><td>31.08.2025</td><td>28.08.2025</td><td>0,25</td><td>0</td></tr><tr><td>29.08.2025</td><td>0,65</td><td>1</td></tr><tr><td>30.08.2025</td><td>0,72</td><td>1</td></tr><tr><td>6</td><td>5</td><td>12.09.2025</td><td>09.09.2025</td><td>0,18</td><td>0</td></tr><tr><td>10.09.2025</td><td>0,26</td><td>0</td></tr><tr><td>11.09.2025</td><td>0,30</td><td>0</td></tr></tbody></table></table-wrap><p>Итак, при апробации оптимальной для прогнозирования модели LightGBM зарегистрировано шесть событий обнаружения конуса. Модель выявила признаки развития нарушения для пяти событий, что составляет 83,3 %. Время упреждения для выявленных нарушений — от суток до трех. В одном случае предупреждение формировалось за трое суток до регистрации нарушения, в трех случаях — за двое суток и в одном случае — за сутки. Горизонт упреждения определялся как максимальное число суток между первым положительным прогнозом и датой регистрации конуса.</p><p>Обсуждение. Таким образом, результаты сопоставления прогнозных значений с зарегистрированными нарушениями на электролизерах опытного участка подтверждают способность модели выявлять технологические нарушения типа «конус» до момента их фактической регистрации с практическим горизонтом раннего прогнозирования 24–72 ч.</p><p>Полученные результаты согласуются с физико-технологическими особенностями возникновения нарушения типа «конус» [<xref ref-type="bibr" rid="cit5">5</xref>]. От начала формирования дефекта до выраженного изменения режима работы электролизера может пройти несколько суток. Изменение ключевых параметров наблюдается на 2–3 день [<xref ref-type="bibr" rid="cit22">22</xref>]. Поэтому применяемый в работе горизонт прогнозирования — от 24 до 72 ч следует признать технологически обоснованным интервалом, в пределах которого изменения контролируемых параметров могут быть предвестниками развития нарушения.</p><p>Кроме того, результаты апробации модели, как и в [<xref ref-type="bibr" rid="cit16">16</xref>], подтвердили возможность прогнозирования нарушения за несколько суток до критического изменения состояния технологии. Однако есть и отличие. В [<xref ref-type="bibr" rid="cit16">16</xref>] прогноз строился по индивидуальным токам анодов, а в представленной работе сопоставимое по горизонту предупреждение («за несколько дней до того, как конус становится очевидным») получено без использования специализированной системы измерения токов. Предложенное авторами решение может рассматриваться как дополнение к методам локального контроля анодов и состояния электролизеров на основе анализа параметров среднесуточного производственного мониторинга.</p><p>Результаты апробации отражают известные проблемы применения прогностических моделей в условиях промышленного электролиза, в том числе: сложность регистрации событий [<xref ref-type="bibr" rid="cit17">17</xref>], дисбаланс классов, изменение статистических характеристик [<xref ref-type="bibr" rid="cit15">15</xref>]. Снижение качества прогнозирования при переходе от тестовой выборки к промышленной проверке может быть связано еще и с изменчивостью реального технологического процесса и редкостью рассматриваемого типа нарушений. Так, доля наблюдений предаварийного состояния в апробационной выборке — менее 2 %, поэтому даже при высоком проценте правильно распознанных нормальных состояний относительно небольшое число ложноположительных решений существенно снижает прогностическую ценность модели.</p><p>Ложноположительные предупреждения отчасти объясняются человеческим фактором. Например, при признаках образования конуса технологи перемещают (подергивают) аноды, проверяют и устраняют непробои в точках подачи глинозема. Все это существенно меняет динамику параметров, предотвращает развитие нарушения и его фактическую регистрацию. В таких случаях модель выявляет признаки предаварийного состояния, однако событие не попадает в журнал регистрации нарушений, и предупреждение классифицируется как ложноположительное. Данная интерпретация требует отдельной проверки и сопоставления времени формирования предупреждений с записями о технологических операциях и последующей динамикой контролируемых параметров.</p><p>Ложноотрицательные результаты объясняются:</p><p>Поэтому несмотря на использование временно́го разделения данных, необходима внешняя временна́я валидация модели.</p><p>На результаты апробации существенно влияет изменение условий ведения технологии. Со временем меняются управленческие настройки, состояние анодов, состав сырья, режимы анодного питания и регламенты обслуживания. Это значит, что признаки распределяются иначе, чем было при обучении модели. К тому же исследование выполнено на данных мониторинга небольшого числа электролизеров опытного участка, и для подтверждения обобщающей способности модели требуется дополнительная проверка на других участках производства и временны́х периодах.</p><p>В практическом плане полученные результаты открывают возможность применения интеллектуальной модели для раннего прогнозирования нарушений типа «конус» в реальных промышленных условиях. Благодаря этому образуется временной резерв для дополнительной проверки и выполнения превентивных технологических воздействий. Отметим, что для внедрения интеллектуальных средств недостаточно общей точности классификации. Серьезную роль играет баланс между чувствительностью модели и нагрузкой на технологический персонал при ложноположительных и ложноотрицательных решениях. Следует подчеркнуть важность журналирования предупреждений и значений вероятности, а также действий персонала и фактов подтверждения нарушений. Это позволит контролировать качество прогноза и уровень ложных срабатываний, уточнять порог активации модели и формировать репрезентативный набор подтвержденных случаев для дообучения.</p><p>Заключение. Предложена интеллектуальная модель для раннего прогнозирования технологических нарушений типа «конус» при производстве алюминия. В ходе исследования сформирован массив технологических данных по восьми электролизерам РА-550 за период 2020–2025 гг. Выполнена предварительная обработка мониторинговых данных, включающая очистку, восстановление пропусков, разметку и разделение данных на выборки с учетом временно́й структуры производственного процесса.</p><p>Для прогнозирования конуса применялись ансамблевые методы: градиентный бустинг (XGBoost, CatBoost, LightGBM), автоматизированный конвейер FEDOT и нейросетевые ансамбли (RTDL-RM, RTDL-NE, TabM). По результатам вычислительных экспериментов определены гиперпараметры моделей, обеспечивающие максимальные значения метрик оценки качества. Самой эффективной оказалась LightGBM с лучшими метриками Accuracy (0,88), Recall (0,79) и F1 (0,79).</p><p>Предложенную интеллектуальную модель интегрировали в информационно-аналитическую систему оперативного контроля производства алюминия и апробировали на данных реального технологического процесса. Сопоставление прогнозов с фактами нарушений показало, что при пороге чувствительности 0,4 модель корректно классифицировала состояние «норма» в 95 % случаев. Доля верно распознанных состояний «нарушение» — 63 %. Уровень ложноположительных срабатываний — 5 %, ложноотрицательных — 37,5 %. Ложные результаты возникают, в частности, из-за действий персонала для предотвращения развития нарушения до его официальной регистрации. Другие причины: некорректная производственная разметка нарушений, изменение условий технологии и ограниченность выборки.</p><p>Исследование позволило установить, что модель может выявить технологические нарушения за 24–72 ч до их фактической регистрации.</p><p>Результаты апробации и экспертная оценка технологов подтверждают достаточную эффективность и применимость предложенной модели в реальных условиях эксплуатации.</p><p>В перспективных исследованиях предполагается расширение обучающей выборки, проверка модели для других участков производства алюминия, а также комплексный анализ параметров среднесуточного и мгновенного мониторинга для определения места возникновения нарушения.</p></body><back><ref-list><title>References</title><ref id="cit1"><label>1</label><citation-alternatives><mixed-citation xml:lang="ru">Сизяков В.М., Поляков П.В., Бажин В.Ю. Современные тенденции и стратегические задачи в области производства алюминия и его сплавов в России. Цветные металлы. 2022;7:16–23. URL: https://www.rudmet.ru/journal/2131/article/35492 (дата обращения: 04.08.2026).</mixed-citation><mixed-citation xml:lang="en">Sizyakov VM, Polyakov PV, Bazhin VYu. Current Trends and Strategic Objectives in the Production of Aluminum and Its Alloys in Russia. Non-ferrous Metals. 2022;7:16–23. (In Russ.) https://www.rudmet.ru/journal/2131/article/35492 (accessed: 04.08.2026).</mixed-citation></citation-alternatives></ref><ref id="cit2"><label>2</label><citation-alternatives><mixed-citation xml:lang="ru">Heli Liu, Dhawan Saksham, Merrill Shen, Kangan Chen, Vincent Wu, Liliang Wang. Industry 4.0 in Metal Forming Industry Towards Automotive Applications: A Review. International Journal of Automotive Manufacturing and Materials. 2022;1(1):16–27. URL: https://www.sciltp.com/journals/ijamm/articles/2504000083 (accessed: 04.08.2026).</mixed-citation><mixed-citation xml:lang="en">Heli Liu, Dhawan Saksham, Merrill Shen, Kangan Chen, Vincent Wu, Liliang Wang. Industry 4.0 in Metal Forming Industry Towards Automotive Applications: A Review. International Journal of Automotive Manufacturing and Materials. 2022;1(1):16–27. URL: https://www.sciltp.com/journals/ijamm/articles/2504000083 (accessed: 04.08.2026).</mixed-citation></citation-alternatives></ref><ref id="cit3"><label>3</label><citation-alternatives><mixed-citation xml:lang="ru">Bochkaryov PYu, Korolev RD, Bokova LG. Comprehensive Assessment of the Manufacturability of Products. Advanced Engineering Research (Rostov-on-Don). 2023;23(2):155–168. https://doi.org/10.23947/2687-1653-2023-23-2-155-168</mixed-citation><mixed-citation xml:lang="en">Bochkaryov PYu, Korolev RD, Bokova LG. Comprehensive Assessment of the Manufacturability of Products. Advanced Engineering Research (Rostov-on-Don). 2023;23(2):155–168. https://doi.org/10.23947/2687-1653-2023-23-2-155-168</mixed-citation></citation-alternatives></ref><ref id="cit4"><label>4</label><citation-alternatives><mixed-citation xml:lang="ru">Sadler B. Critical Issues in Anode Production and Quality to Avoid Anode Performance Problems. Journal of Siberian Federal University. Engineering &amp; Technologies. 2015;8(5):546–568. https://doi.org/0.17516/1999-494X-2015-8-5-546-568</mixed-citation><mixed-citation xml:lang="en">Sadler B. Critical Issues in Anode Production and Quality to Avoid Anode Performance Problems. Journal of Siberian Federal University. Engineering &amp; Technologies. 2015;8(5):546–568. https://doi.org/0.17516/1999-494X-2015-8-5-546-568</mixed-citation></citation-alternatives></ref><ref id="cit5"><label>5</label><citation-alternatives><mixed-citation xml:lang="ru">Михалев Ю.Г., Поляков П.В., Ясинский А.А., Поляков А.А. Возникновение конусов на аноде алюминиевого электролизера Цветные металлы. 2018;9:43–48. https://doi.org/10.17580/tsm.2018.09.06</mixed-citation><mixed-citation xml:lang="en">Mikhalev YG, Polyakov PV, Yasinskiy AS, Polyakov AA. Spikes Generation on Anode of Aluminium Reduction Cell. Non-ferrous metals. 2018;9:43–48. https://doi.org/10.17580/tsm.2018.09.06</mixed-citation></citation-alternatives></ref><ref id="cit6"><label>6</label><citation-alternatives><mixed-citation xml:lang="ru">Polyakov PV, Vlasov AA, Mikhalev YuG, Yanov VV. On Cone Formation on Burnt Anode Face in Aluminum Electrolyzers. Metallurgist. 2017;60(9/10):1087–1093. https://doi.org/10.1007/s11015-017-0411-2</mixed-citation><mixed-citation xml:lang="en">Polyakov PV, Vlasov AA, Mikhalev YuG, Yanov VV. On Cone Formation on Burnt Anode Face in Aluminum Electrolyzers. Metallurgist. 2017;60(9/10):1087–1093. https://doi.org/10.1007/s11015-017-0411-2</mixed-citation></citation-alternatives></ref><ref id="cit7"><label>7</label><citation-alternatives><mixed-citation xml:lang="ru">Penkova T, Senashova M, Korobko A. Multidimensional Analysis of Aluminum Production Monitoring Data in Basic Operation Modes. CEUR Workshop Proceedings. 2020;2727:128–136. URL: https://ceur-ws.org/Vol-2727/paper17.pdf (accessed: 04.08.2026).</mixed-citation><mixed-citation xml:lang="en">Penkova T, Senashova M, Korobko A. Multidimensional Analysis of Aluminum Production Monitoring Data in Basic Operation Modes. CEUR Workshop Proceedings. 2020;2727:128–136. URL: https://ceur-ws.org/Vol-2727/paper17.pdf (accessed: 04.08.2026).</mixed-citation></citation-alternatives></ref><ref id="cit8"><label>8</label><citation-alternatives><mixed-citation xml:lang="ru">Белоусова Н.В., Шарыпов Н.А., Шахрай С.Г., Безруких А.И. Угольная пена в алюминиевом электролизере: проблемы и некоторые пути их решения. Цветные металлы. 2017;8:43–49. https://doi.org/10.17580/tsm.2017.08.06</mixed-citation><mixed-citation xml:lang="en">Belousova NV, Sharypov NA, Shakhrai SG, Bezrukikh AI. Coal Foam in an Aluminum Electrolyzer: Problems and Some Solutions. Non-ferrous Metals. 2017;8:43–49. https://doi.org/10.17580/tsm.2017.08.06</mixed-citation></citation-alternatives></ref><ref id="cit9"><label>9</label><citation-alternatives><mixed-citation xml:lang="ru">Metus A, Penkova T. Analysis of Aluminium Electrolysis Data in the Context of Extreme Values of Technological Parameters. CEUR Workshop Proceedings. 2020;2727:92–98. URL: https://ceur-ws.org/Vol-2727/paper12.pdf (accessed: 04.08.2026).</mixed-citation><mixed-citation xml:lang="en">Metus A, Penkova T. Analysis of Aluminium Electrolysis Data in the Context of Extreme Values of Technological Parameters. CEUR Workshop Proceedings. 2020;2727:92–98. URL: https://ceur-ws.org/Vol-2727/paper12.pdf (accessed: 04.08.2026).</mixed-citation></citation-alternatives></ref><ref id="cit10"><label>10</label><citation-alternatives><mixed-citation xml:lang="ru">Zhi-Hua Zhou. Machine Learning. Singapore: Springer; 2021. 460 p. URL: https://link.springer.com/content/pdf/bfm:978-981-15-1967-3/1?pdf=chapter+toc (accessed: 15.07.2026).</mixed-citation><mixed-citation xml:lang="en">Zhi-Hua Zhou. Machine Learning. Singapore: Springer; 2021. 460 p. URL: https://link.springer.com/content/pdf/bfm:978-981-15-1967-3/1?pdf=chapter+toc (accessed: 15.07.2026).</mixed-citation></citation-alternatives></ref><ref id="cit11"><label>11</label><citation-alternatives><mixed-citation xml:lang="ru">Tugashova LG, Zatonskiy AV. Machine Learning-Based Condition Assessment Method for Shell-and-Tube Heat Exchangers to Improve Energy Efficiency. Advanced Engineering Research (Rostov-on-Don). 2026;26(2):2237. https://doi.org/10.23947/2687-1653-2026-26-2-2237</mixed-citation><mixed-citation xml:lang="en">Tugashova LG, Zatonskiy AV. Machine Learning-Based Condition Assessment Method for Shell-and-Tube Heat Exchangers to Improve Energy Efficiency. Advanced Engineering Research (Rostov-on-Don). 2026;26(2):2237. https://doi.org/10.23947/2687-1653-2026-26-2-2237</mixed-citation></citation-alternatives></ref><ref id="cit12"><label>12</label><citation-alternatives><mixed-citation xml:lang="ru">Cheng Ji, Wei Sun. A Review on Data-Driven Process Monitoring Methods: Characterization and Mining of Industrial Data. Processes. 2022;10(2):335. https://doi.org/10.3390/pr10020335</mixed-citation><mixed-citation xml:lang="en">Cheng Ji, Wei Sun. A Review on Data-Driven Process Monitoring Methods: Characterization and Mining of Industrial Data. Processes. 2022;10(2):335. https://doi.org/10.3390/pr10020335</mixed-citation></citation-alternatives></ref><ref id="cit13"><label>13</label><citation-alternatives><mixed-citation xml:lang="ru">Muntin AV, Zhikharev PYu, Ziniagin AG, Brayko DA. Artificial Intelligence and Machine Learning in Metallurgy. Рart 1. Methods and Algorithms. Metallurgist. 2023;67(5/6):886–894. https://doi.org/10.1007/s11015-023-01576-3</mixed-citation><mixed-citation xml:lang="en">Muntin AV, Zhikharev PYu, Ziniagin AG, Brayko DA. Artificial Intelligence and Machine Learning in Metallurgy. Рart 1. Methods and Algorithms. Metallurgist. 2023;67(5/6):886–894. https://doi.org/10.1007/s11015-023-01576-3</mixed-citation></citation-alternatives></ref><ref id="cit14"><label>14</label><citation-alternatives><mixed-citation xml:lang="ru">Zhikharev PYu, Muntin AV, Brayko DA, Kryuchkova MO. Artificial Intelligence and Machine Learning In Metallurgy. Part 2. Application Examples. Metallurgist. 2024;67:1545–1560. https://doi.org/10.1007/s11015-024-01648-y</mixed-citation><mixed-citation xml:lang="en">Zhikharev PYu, Muntin AV, Brayko DA, Kryuchkova MO. Artificial Intelligence and Machine Learning In Metallurgy. Part 2. Application Examples. Metallurgist. 2024;67:1545–1560. https://doi.org/10.1007/s11015-024-01648-y</mixed-citation></citation-alternatives></ref><ref id="cit15"><label>15</label><citation-alternatives><mixed-citation xml:lang="ru">Abd Majid NA, Taylor MP, Chen JJ, Young BR. Aluminium Process Fault Detection and Diagnosis. Advances in Materials Science and Engineering. 2015;2015:1–11. https://doi.org/10.1155/2015/682786</mixed-citation><mixed-citation xml:lang="en">Abd Majid NA, Taylor MP, Chen JJ, Young BR. Aluminium Process Fault Detection and Diagnosis. Advances in Materials Science and Engineering. 2015;2015:1–11. https://doi.org/10.1155/2015/682786</mixed-citation></citation-alternatives></ref><ref id="cit16"><label>16</label><citation-alternatives><mixed-citation xml:lang="ru">Martel A. Spike Detection Using Advanced Analytics and Data Analysis. In book: Martin O. (ed) Light Metals 2018. Cham: Springer; 2018. P. 485–490. https://doi.org/10.1007/978-3-319-72284-9_64</mixed-citation><mixed-citation xml:lang="en">Martel A. Spike Detection Using Advanced Analytics and Data Analysis. In book: Martin O. (ed) Light Metals 2018. Cham: Springer; 2018. P. 485–490. https://doi.org/10.1007/978-3-319-72284-9_64</mixed-citation></citation-alternatives></ref><ref id="cit17"><label>17</label><citation-alternatives><mixed-citation xml:lang="ru">Faraj M, Sayed K, Al Hosani A, Bakuteev A, Shyamala M, Pervez K, et al. Anode Spike Model – A Case Study of Challenges and Future Directions. In: TRAVAUX 53. Proc. 42nd International ICSOBA Conference. Lyon: ICSOBA; 2024. P. 1553–1573. URL: https://icsoba.org/proceedings/42nd-conference-and-exhibition-icsoba-2024/?doc=131 (accessed: 04.08.2026).</mixed-citation><mixed-citation xml:lang="en">Faraj M, Sayed K, Al Hosani A, Bakuteev A, Shyamala M, Pervez K, et al. Anode Spike Model – A Case Study of Challenges and Future Directions. In: TRAVAUX 53. Proc. 42nd International ICSOBA Conference. Lyon: ICSOBA; 2024. P. 1553–1573. URL: https://icsoba.org/proceedings/42nd-conference-and-exhibition-icsoba-2024/?doc=131 (accessed: 04.08.2026).</mixed-citation></citation-alternatives></ref><ref id="cit18"><label>18</label><citation-alternatives><mixed-citation xml:lang="ru">Gang Yan, Ximing Liang. Predictive Models of Aluminum Reduction Cell Based on LS-SVM. In: International Conference on Digital Manufacturing &amp; Automation. New York City: IEEE; 2010. P. 99–102. https://doi.org/10.1109/ICDMA.2010.12</mixed-citation><mixed-citation xml:lang="en">Gang Yan, Ximing Liang. Predictive Models of Aluminum Reduction Cell Based on LS-SVM. In: International Conference on Digital Manufacturing &amp; Automation. New York City: IEEE; 2010. P. 99–102. https://doi.org/10.1109/ICDMA.2010.12</mixed-citation></citation-alternatives></ref><ref id="cit19"><label>19</label><citation-alternatives><mixed-citation xml:lang="ru">Mikhalev A, Lugovaya N, Penkova T, Puzanov I, Zavadyak A. Application of Ensemble Algorithms to Detect Anode Effects in Aluminum Production. CEUR Workshop Proceedings. 2021;3047:79–85. URL: https://ceur-ws.org/Vol-3047/paper11.pdf (accessed: 04.08.2026).</mixed-citation><mixed-citation xml:lang="en">Mikhalev A, Lugovaya N, Penkova T, Puzanov I, Zavadyak A. Application of Ensemble Algorithms to Detect Anode Effects in Aluminum Production. CEUR Workshop Proceedings. 2021;3047:79–85. URL: https://ceur-ws.org/Vol-3047/paper11.pdf (accessed: 04.08.2026).</mixed-citation></citation-alternatives></ref><ref id="cit20"><label>20</label><citation-alternatives><mixed-citation xml:lang="ru">Nazatul Aini Abd Majid, Mark P Taylor, John JJ Chen, Marco A Stam, Albert Mulder, Brent R Young. Aluminium Process Fault Detection by Multiway Principal Component Analysis. Control Engineering Practice. 2011;19(4):367–379. https://doi.org/10.1016/j.conengprac.2010.12.005</mixed-citation><mixed-citation xml:lang="en">Nazatul Aini Abd Majid, Mark P Taylor, John JJ Chen, Marco A Stam, Albert Mulder, Brent R Young. Aluminium Process Fault Detection by Multiway Principal Component Analysis. Control Engineering Practice. 2011;19(4):367–379. https://doi.org/10.1016/j.conengprac.2010.12.005</mixed-citation></citation-alternatives></ref><ref id="cit21"><label>21</label><citation-alternatives><mixed-citation xml:lang="ru">Puzanov II, Zavadyak AV, Klykov VA, Makeev AV, Plotnikov VN. Continuous Monitoring of Information on Anode Current Distribution as Means of Improving the Process of Controlling and Forecasting Process Disturbances. Journal of Siberian Federal University. Engineering &amp; Technologies. 2016:9(6):788–801. https://doi.org/10.17516/1999-494X-2016-9-6-788-801</mixed-citation><mixed-citation xml:lang="en">Puzanov II, Zavadyak AV, Klykov VA, Makeev AV, Plotnikov VN. Continuous Monitoring of Information on Anode Current Distribution as Means of Improving the Process of Controlling and Forecasting Process Disturbances. Journal of Siberian Federal University. Engineering &amp; Technologies. 2016:9(6):788–801. https://doi.org/10.17516/1999-494X-2016-9-6-788-801</mixed-citation></citation-alternatives></ref><ref id="cit22"><label>22</label><citation-alternatives><mixed-citation xml:lang="ru">Поляков П.В., Шарыпова Н.А., Осипова В.А., Пьяных А.А. Математическое моделирование распределения тока при наличии нарушений на подошве анода алюминиевого электролизера. Цветные металлы. 2019;913(1):25–30. https://doi.org/10.17580/tsm.2019.01.04</mixed-citation><mixed-citation xml:lang="en">Polyakov PV, Sharypova NA, Osipova VA, Pianykh AA. Mathematical Modeling of Current Distribution in the Presence of Abnormalities on the Reduction Cell Anode Bottom. Non-ferrous Metals. 2019;913(1):25–30. https://doi.org/10.17580/tsm.2019.01.04</mixed-citation></citation-alternatives></ref><ref id="cit23"><label>23</label><citation-alternatives><mixed-citation xml:lang="ru">Van Buuren S, Groothuis-Oudshoorn K. mice: Multivariate Imputation by Chained Equations in R. Journal of Statistical Software. 2011;45(3):1–67. https://doi.org/10.18637/jss.v045.i03</mixed-citation><mixed-citation xml:lang="en">Van Buuren S, Groothuis-Oudshoorn K. mice: Multivariate Imputation by Chained Equations in R. Journal of Statistical Software. 2011;45(3):1–67. https://doi.org/10.18637/jss.v045.i03</mixed-citation></citation-alternatives></ref><ref id="cit24"><label>24</label><citation-alternatives><mixed-citation xml:lang="ru">Bentéjac C, Csörgő A, Martínez-Muñoz G. A Comparative Analysis of Gradient Boosting Algorithms. Artificial Intelligence Review. 2021;54(3):1937–1967. https://doi.org/10.1007/s10462-020-09896-5</mixed-citation><mixed-citation xml:lang="en">Bentéjac C, Csörgő A, Martínez-Muñoz G. A Comparative Analysis of Gradient Boosting Algorithms. Artificial Intelligence Review. 2021;54(3):1937–1967. https://doi.org/10.1007/s10462-020-09896-5</mixed-citation></citation-alternatives></ref><ref id="cit25"><label>25</label><citation-alternatives><mixed-citation xml:lang="ru">Fort S, Huiyi Hu, Lakshminarayanan B. Deep Ensembles: A Loss Landscape Perspective. ArXiv preprint. 2019:2. https://doi.org/10.48550/arXiv.1912.02757</mixed-citation><mixed-citation xml:lang="en">Fort S, Huiyi Hu, Lakshminarayanan B. Deep Ensembles: A Loss Landscape Perspective. ArXiv preprint. 2019:2. https://doi.org/10.48550/arXiv.1912.02757</mixed-citation></citation-alternatives></ref><ref id="cit26"><label>26</label><citation-alternatives><mixed-citation xml:lang="ru">Hossin M, Sulaiman MN. A Review on Evaluation Metrics for Data Classification Evaluations. International Journal of Data Mining &amp; Knowledge Management Process. 2015;5(2):1–11. https://doi.org/10.5121/ijdkp.2015.5201</mixed-citation><mixed-citation xml:lang="en">Hossin M, Sulaiman MN. A Review on Evaluation Metrics for Data Classification Evaluations. International Journal of Data Mining &amp; Knowledge Management Process. 2015;5(2):1–11. https://doi.org/10.5121/ijdkp.2015.5201</mixed-citation></citation-alternatives></ref><ref id="cit27"><label>27</label><citation-alternatives><mixed-citation xml:lang="ru">Завадяк А.В., Ноженкова Л.Ф., Пузанов И.И., Пенькова Т.Г., Коробко А.А., Коробко А.В. и др. Инструменты интеллектуальной поддержки управления процессом обнаружения технологических нарушений и оценки технологического состояния комплекса производства алюминия. Свидетельство о регистрации программы для ЭВМ № 2021662399. Российская Федерация. Государственная регистрация в Реестре программ для ЭВМ — 27.07.2021. 1 с.</mixed-citation><mixed-citation xml:lang="en">Zavadyak AV, Nozhenkova LF, Puzanov II, Penkova TG, Korobko AA, Korobko AV, et al. Intelligent Support Tools for Managing the Detection of Process Disturbances and Assessing the Process State of an Aluminum Production Complex. Certificate of Software State Registration No. 2021662399, 2021. 1 p. (In Russ.)</mixed-citation></citation-alternatives></ref></ref-list><fn-group><fn fn-type="conflict"><p>The authors declare that there are no conflicts of interest present.</p></fn></fn-group></back></article>
