6 października 2026 roku OpenAI ogłosiło na GitHubie publikację wyników matematycznych wygenerowanych przez wewnętrzny model frontier. Repozytorium zawiera także materiały dotyczące sprawdzania prac, a firma podała, że średni nakład obliczeniowy na jeden wynik odpowiadał mniej więcej trzem godzinom pracy ChatGPT Pro.
OpenAI opublikowało wyniki z modelu wewnętrznego
OpenAI opisało model generujący wyniki jako wewnętrzny model frontier. W repozytorium znalazły się protokoły dotyczące zmian w pracach i ich cytowania, dziesięć podsumowań rozumowania modelu, szacunki nakładu obliczeniowego oraz statystyki prób rozwiązywania problemów.
Jak Lean pomaga sprawdzać dowody
OpenAI udostępniło formalizacje w Lean dla wielu dowodów i zapowiedziało dodanie kolejnych. Lean to język programowania i asystent dowodzenia, który pozwala zapisać argument matematyczny w ścisłej, formalnej postaci, a następnie sprawdzić jego kroki za pomocą komputera.
Formalizacja pozwala sprawdzić zapisany w ten sposób dowód. OpenAI mówi o formalizacjach wielu dowodów — nie o formalnym zapisie każdego wyniku z repozytorium.
Co oznacza równoważnik trzech godzin
Według OpenAI obliczenia przypadające średnio na jeden wynik odpowiadały mniej więcej trzem godzinom pracy ChatGPT Pro w trybie rozumowania. To miara nakładu obliczeniowego na wynik, a nie czas potrzebny na wygenerowanie całej kolekcji. Wyniki stworzył model wewnętrzny; ChatGPT Pro służy w tym szacunku za punkt odniesienia.
Zalecenia AGMAI dotyczące matematyki generowanej przez AI
29 września 2026 roku Advisory Group on Mathematics and Artificial Intelligence (AGMAI) opublikowała zalecenia dotyczące odpowiedzialnego udostępniania matematyki generowanej przez AI. Grupa wezwała laboratoria do zaprzestania testowania zaawansowanych problemów matematycznych na własnościowych modelach niedostępnych dla społeczności badawczej. Zaleciła też ujawnianie m.in. nazwy modelu, użytych poleceń, podsumowania rozumowania, czasu pracy i szacowanego kosztu obliczeń, a także wspieranie inicjatyw pomagających badaczom zrozumieć wyniki.
OpenAI poinformowało, że konsultowało się z AGMAI i uwzględniło jej zalecenia przy przygotowaniu publikacji. Firma zapowiedziała również finansowanie warsztatów i powiązanych programów oraz zadeklarowała, że pracuje nad odpowiedzialnym udostępnieniem modelu, który wygenerował wyniki.