Искусственный интеллект совершил эпохальный скачок: новые модели решают задачи, неподвластные даже лучшим математикам
Последние достижения в сфере искусственного интеллекта поражают своей стремительностью, превосходя самые смелые ожидания. Владимир Бандура, CEO Innolyticsgroup и амбассадор Университета Сингулярности, делится эксклюзивными подробностями о новом этапе в развитии ИИ-моделей. Речь идёт не просто об улучшении в выполнении математических задач, а о кардинальной смене парадигмы: модели демонстрируют способность к самостоятельному поиску решений для совершенно новых, ранее неизвестных вызовов, успешно проходя тесты, специально созданные для того, чтобы избежать простого перебора вариантов.
Один из разработчиков таких передовых систем отметил, что будущие поколения моделей станут “онтологическим шоком” для пользователей. Эти слова, похоже, уже находят своё подтверждение. Мы стремительно приближаемся к тому моменту, когда круг задач, для которых человек может чётко сформулировать и вопрос, и ответ, начнёт исчерпываться для ИИ-систем.
Математические головоломки: от детских задач до передовых исследований
Ещё несколько лет назад сложность элементарной школьной математики ставила большинство языковых моделей в тупик. Эксперты часто подчёркивали ограниченность таких систем, называя их “стохастическими попугаями” — сущностями, которые лишь статистически имитируют язык, но не обладают подлинным логическим мышлением. Однако появление моделей, способных к “глубинному” мышлению, кардинально изменило ситуацию.
Уже в 2025 году на престижной международной олимпиаде по математике искусственный интеллект завоевал золотые медали, соревнуясь на равных с людьми по стандартным правилам. Это стало неожиданностью для многих, но ведущие исследователи искусственного интеллекта предсказали такое развитие событий.
Именно поэтому в конце 2024 — начале 2025 года был представлен тест Frontier Math — один из самых сложных комплексов математических задач. Разработка этого теста потребовала привлечения десятков ведущих математиков, которые соревновались за право сформулировать сотни сложных задач. Эти задачи были разделены на четыре уровня сложности: от университетской математики до передовых исследовательских проблем. Задания четвёртой категории настолько сложны, что специалисты высочайшего уровня могли тратить недели на их разработку.
Для оценки сложности теста и сравнения с человеческими возможностями авторы провели испытания с самыми талантливыми студентами Массачусетского технологического института (MIT). Восемь команд по четыре-пять человек имели 4,5 часа на выполнение теста. Результаты оказались впечатляющими: в относительно простых заданиях первых трёх уровней команды набирали в среднем 19%, а все команды вместе — 35%. Задания четвёртого уровня, ещё более комплексные, даже не были включены в тесты для студентов, поскольку даже ведущие математики с медалями Филдса признавали, что смогут решить лишь несколько из них, преимущественно из своей узкой специализации.
На старте самые современные на тот момент ИИ-модели демонстрировали результаты менее 10% даже в самых простых заданиях первых трёх уровней Frontier Math. Однако новая модель, GPT-6 Astra, показала абсолютное доминирование, решив 97,6% задач самого сложного, четвёртого уровня. Это означает, что модель справилась практически со всеми задачами, которые требовали настоящего математического гения, демонстрируя уровень, значительно превосходящий возможности любого живого математика.
Практическое применение и новые горизонты
Возникает закономерный вопрос: как эти впечатляющие академические достижения трансформируются в практическое применение? Ответ лежит в сферах, где сложные математические модели уже играют ключевую роль. Наиболее яркий пример — финансовый конгломерат BlackRock, чий программный комплекс Aladdin управляет активами на сумму более 21 триллиона долларов. Эта система, изначально разработанная для BlackRock, теперь используется многими другими организациями.
В контексте стремительного развития ИИ модели, которые демонстрируют более высокий математический уровень, чем даже самые опытные команды таких гигантов, как BlackRock, открывают беспрецедентные возможности. Потенциал для разработки более совершенных алгоритмов, аналитических инструментов и прогнозных моделей огромен. Хотя это может вызывать дискуссии о влиянии на “тайные мировые правительства” или другие конспирологические теории, факты остаются фактами: новые ИИ-модели создают основу для качественно нового уровня разработок.
Скачок в креативность и символическое мышление
Удивительные способности новых моделей подтверждаются не только в математике. Впечатляет прогресс в тестах на креативное решение задач, таких как ARC AGI 3. Этот тест известен своей сложностью и спецификой, которая наказывает модели за попытки “грубого” перебора вариантов.
Предыдущая лучшая модель OpenAI, GPT 5.6 Sol, набрала в ARC AGI 3 лишь 7,8%. Новая же модель, Astra, показала результат 99,9%, что свидетельствует о её способности мгновенно понимать логику новых задач, даже если их правила неизвестны. При этом Astra демонстрировала более эффективные пути решения, чем среднестатистический человек, используя меньшее количество шагов.
Исследователи ARC AGI 3 были чрезвычайно удивлены уровнем символических рассуждений, продемонстрированным Astra. Модель создала собственный алгебраический язык для описания состояний игры, что значительно упростило ей процесс решения головоломок. ARC AGI 3, представленный лишь в конце марта 2026 года, на момент выхода был настолько сложным, что ни одна модель не преодолевала 10% результата. Однако этот рекорд продержался лишь несколько месяцев, в отличие от первой версии ARC, которая оставалась непревзойдённой пять лет.
Эти достижения — только начало. Десятки подобных тестов подтверждают рекордные показатели новых моделей. Уже в ближайшие дни Astra станет доступной для широкого круга пользователей, что означает: мы стоим на пороге новой эры искусственного интеллекта, где возможности машин превосходят самые смелые человеческие предположения.
Роман Спас - автор блога о разработке сайтов, IT-новости, продвижении вебпроектов, дизайне и современных технологиях. В своих материалах он на простом языке объясняет сложные digital-темы, делится практическими советами для владельцев сайтов, предпринимателей, маркетологов и специалистов, которые хотят лучше понимать онлайн-среду. Основной фокус автора – эффективные сайты, SEO, вебдизайн, интернет-маркетинг и технологические решения, помогающие бизнесу развиваться в цифровом пространстве.
Искусственный интеллект совершил эпохальный скачок: новые модели решают задачи, неподвластные даже лучшим математикам
Последние достижения в сфере искусственного интеллекта поражают своей стремительностью, превосходя самые смелые ожидания. Владимир Бандура, CEO Innolyticsgroup и амбассадор Университета Сингулярности, делится эксклюзивными подробностями о новом этапе в развитии ИИ-моделей. Речь идёт не просто об улучшении в выполнении математических задач, а о кардинальной смене парадигмы: модели демонстрируют способность к самостоятельному поиску решений для совершенно новых, ранее неизвестных вызовов, успешно проходя тесты, специально созданные для того, чтобы избежать простого перебора вариантов.
Один из разработчиков таких передовых систем отметил, что будущие поколения моделей станут “онтологическим шоком” для пользователей. Эти слова, похоже, уже находят своё подтверждение. Мы стремительно приближаемся к тому моменту, когда круг задач, для которых человек может чётко сформулировать и вопрос, и ответ, начнёт исчерпываться для ИИ-систем.
Математические головоломки: от детских задач до передовых исследований
Ещё несколько лет назад сложность элементарной школьной математики ставила большинство языковых моделей в тупик. Эксперты часто подчёркивали ограниченность таких систем, называя их “стохастическими попугаями” — сущностями, которые лишь статистически имитируют язык, но не обладают подлинным логическим мышлением. Однако появление моделей, способных к “глубинному” мышлению, кардинально изменило ситуацию.
Уже в 2025 году на престижной международной олимпиаде по математике искусственный интеллект завоевал золотые медали, соревнуясь на равных с людьми по стандартным правилам. Это стало неожиданностью для многих, но ведущие исследователи искусственного интеллекта предсказали такое развитие событий.
Именно поэтому в конце 2024 — начале 2025 года был представлен тест Frontier Math — один из самых сложных комплексов математических задач. Разработка этого теста потребовала привлечения десятков ведущих математиков, которые соревновались за право сформулировать сотни сложных задач. Эти задачи были разделены на четыре уровня сложности: от университетской математики до передовых исследовательских проблем. Задания четвёртой категории настолько сложны, что специалисты высочайшего уровня могли тратить недели на их разработку.
Для оценки сложности теста и сравнения с человеческими возможностями авторы провели испытания с самыми талантливыми студентами Массачусетского технологического института (MIT). Восемь команд по четыре-пять человек имели 4,5 часа на выполнение теста. Результаты оказались впечатляющими: в относительно простых заданиях первых трёх уровней команды набирали в среднем 19%, а все команды вместе — 35%. Задания четвёртого уровня, ещё более комплексные, даже не были включены в тесты для студентов, поскольку даже ведущие математики с медалями Филдса признавали, что смогут решить лишь несколько из них, преимущественно из своей узкой специализации.
На старте самые современные на тот момент ИИ-модели демонстрировали результаты менее 10% даже в самых простых заданиях первых трёх уровней Frontier Math. Однако новая модель, GPT-6 Astra, показала абсолютное доминирование, решив 97,6% задач самого сложного, четвёртого уровня. Это означает, что модель справилась практически со всеми задачами, которые требовали настоящего математического гения, демонстрируя уровень, значительно превосходящий возможности любого живого математика.
Практическое применение и новые горизонты
Возникает закономерный вопрос: как эти впечатляющие академические достижения трансформируются в практическое применение? Ответ лежит в сферах, где сложные математические модели уже играют ключевую роль. Наиболее яркий пример — финансовый конгломерат BlackRock, чий программный комплекс Aladdin управляет активами на сумму более 21 триллиона долларов. Эта система, изначально разработанная для BlackRock, теперь используется многими другими организациями.
В контексте стремительного развития ИИ модели, которые демонстрируют более высокий математический уровень, чем даже самые опытные команды таких гигантов, как BlackRock, открывают беспрецедентные возможности. Потенциал для разработки более совершенных алгоритмов, аналитических инструментов и прогнозных моделей огромен. Хотя это может вызывать дискуссии о влиянии на “тайные мировые правительства” или другие конспирологические теории, факты остаются фактами: новые ИИ-модели создают основу для качественно нового уровня разработок.
Скачок в креативность и символическое мышление
Удивительные способности новых моделей подтверждаются не только в математике. Впечатляет прогресс в тестах на креативное решение задач, таких как ARC AGI 3. Этот тест известен своей сложностью и спецификой, которая наказывает модели за попытки “грубого” перебора вариантов.
Предыдущая лучшая модель OpenAI, GPT 5.6 Sol, набрала в ARC AGI 3 лишь 7,8%. Новая же модель, Astra, показала результат 99,9%, что свидетельствует о её способности мгновенно понимать логику новых задач, даже если их правила неизвестны. При этом Astra демонстрировала более эффективные пути решения, чем среднестатистический человек, используя меньшее количество шагов.
Исследователи ARC AGI 3 были чрезвычайно удивлены уровнем символических рассуждений, продемонстрированным Astra. Модель создала собственный алгебраический язык для описания состояний игры, что значительно упростило ей процесс решения головоломок. ARC AGI 3, представленный лишь в конце марта 2026 года, на момент выхода был настолько сложным, что ни одна модель не преодолевала 10% результата. Однако этот рекорд продержался лишь несколько месяцев, в отличие от первой версии ARC, которая оставалась непревзойдённой пять лет.
Эти достижения — только начало. Десятки подобных тестов подтверждают рекордные показатели новых моделей. Уже в ближайшие дни Astra станет доступной для широкого круга пользователей, что означает: мы стоим на пороге новой эры искусственного интеллекта, где возможности машин превосходят самые смелые человеческие предположения.
Roman Spas
Роман Спас - автор блога о разработке сайтов, IT-новости, продвижении вебпроектов, дизайне и современных технологиях. В своих материалах он на простом языке объясняет сложные digital-темы, делится практическими советами для владельцев сайтов, предпринимателей, маркетологов и специалистов, которые хотят лучше понимать онлайн-среду. Основной фокус автора – эффективные сайты, SEO, вебдизайн, интернет-маркетинг и технологические решения, помогающие бизнесу развиваться в цифровом пространстве.
Недавние записи
Модели Anthropic против OpenAI: как исследователи взломали?
18.09.2026Исследование видимости бренда в AI-поиске: что помогает
18.09.2026Китайский 3-нм прорыв: транзисторы GAA приближают, но
18.09.2026Рубрики