Новости

Раскрытие математических достижений ИИ: OpenAI публикует результаты внутренней модели

OpenAI делится решениями математических задач, полученными внутренней передовой моделью, публикуя проверяемые доказательства на языке Lean в открытом доступе на GitHub.

Обновлено:
2 мин чтения
Раскрытие математических достижений ИИ: OpenAI публикует результаты внутренней модели

OpenAI сообщила о публикации широкого спектра новых математических результатов, которые были получены с помощью внутренней передовой модели. Компания меняет подход к тому, как делится подобными достижениями с научным сообществом, делая ставку на прозрачность и строгую верификацию.

Для разработки лучших практик публикации OpenAI консультировалась с независимой консультативной группой по математике и искусственному интеллекту при Институте перспективных исследований (Institute for Advanced Study). Опираясь на их рекомендации, компания разместила результаты в репозитории на GitHub, добавив протоколы для проверки статей и цитирования. В будущем планируется продолжать улучшать качество публикаций, математического изложения и представления данных для их лучшего понимания.

oai ironclad cua 1x1

oai ironclad cua 1x1

Важной частью релиза стала публикация формализованных доказательств. Они написаны на языке Lean — специальном языке программирования, который позволяет компьютеру автоматически проверять корректность математических шагов. Репозиторий будет пополняться новыми формализациями по мере их получения.

В целях научной прозрачности компания раскрыла дополнительные детали исследовательского процесса. В открытом доступе появились 10 кратких описаний логики рассуждений модели и статистика по количеству попыток решения задач. Также приведена оценка затраченных вычислительных ресурсов: в среднем на один результат ушел объем вычислений, эквивалентный примерно трем часам размышлений в рамках тарифа ChatGPT Pro.

Mental Health Bench art card

Mental Health Bench art card

Этот шаг направлен на расширение границ человеческих знаний и стимулирование дальнейшего прогресса в точных науках. В ближайшем будущем OpenAI планирует профинансировать серию семинаров, конференций и специальных программ, посвященных осмыслению крупных результатов, полученных с помощью искусственного интеллекта.

В перспективе компания работает над тем, чтобы ответственно выпустить саму модель, сгенерировавшую эти решения, и предоставить ученым передовые возможности напрямую. Продолжение оценки внутренних моделей в математике и других науках рассматривается как необходимый шаг для создания инструментов, способных ускорить развитие фундаментальных исследований.

Introducing GPT-6 Sol and Luna — Art card

Introducing GPT-6 Sol and Luna — Art card

TL;DR

Главное

OpenAI начала открыто делиться математическими результатами своих передовых моделей, используя проверяемые компьютером доказательства для интеграции ИИ в фундаментальную науку.

Ключевые факты

  • /Результаты работы внутренней передовой модели опубликованы на GitHub.
  • /Доказательства формализованы на языке Lean для компьютерной проверки.
  • /В среднем на один результат затрачены вычисления, эквивалентные трем часам работы ChatGPT Pro.
  • /Опубликованы 10 описаний логики рассуждений модели и статистика попыток решения.

Инсайт

Использование языка Lean для публикации результатов указывает на то, что компания делает ставку не просто на генерацию ответов, а на строгую машинную верификацию, исключающую возможность логических галлюцинаций в математических доказательствах.

Источник:Openai

Читайте также

Гайды по теме