Nalutas ng Self-Taught Clinician at ng Isang 16-Oras na Sesyon ng AI ang Isa sa mga Bukas na Problema ng Applied Mathematics
Sa madaling sabi
Isang neurosurgeon sa Beijing ang gumamit GPT-5.6 upang patunayan ang isang 20-taong-gulang na haka-haka sa matematika, na hudyat ng pagbabago sa kung sino ang maaaring gumawa — at magpatunay — ng pananaliksik.

Si Shanmu Jin, isang postdoctoral researcher at neurosurgery resident sa Peking Union Medical College Hospital sa Beijing, ay nagpatunay sa Konjektura ni Crouzeix — isang problema sa pagsusuri ng matrix na nanatiling bukas sa loob ng mahigit dalawang dekada. Ang mapagpasyang argumento ay hindi lumitaw mula sa isang departamento ng matematika: ito ay lumitaw sa loob ng 16 na oras na autonomous na pagtakbo ng GPT-5.6 Araw sa loob ChatGPT Mode ng trabaho, ginagabayan ng isang maingat na dinisenyong prompt na dinisenyo mismo ni Jin.
Naabot ni Jin ang problema sa pamamagitan ng isang di-linear na landas. Ang kanyang undergraduate background ay sa heolohiya; kalaunan ay nakakuha siya ng medikal na degree at pinalawak ang kanyang kaalaman sa matematika sa pamamagitan ng self-directed study, na una ay hinimok ng pananaliksik sa transcranial ultrasound. Ang Conjecture ni Crouzeix, na binuo noong 2004, ay tungkol sa ugnayan sa pagitan ng spectral norm ng isang matrix at ang maximum ng isang polynomial sa numerical range nito — isang compact convex region ng complex plane na kumukuha ng higit pang pag-uugali ng isang matrix kaysa sa mga eigenvalue nito lamang. Ang resolusyon nito ay may direktang aplikasyon sa pagsusuri ng mga matrix function, mga iterative solver tulad ng GMRES, at mga rational Krylov method.
Sa halip na i-prompt ang modelo nang interactive, nagpatakbo si Jin ng isang pinahabang autonomous session gamit ang isang prompt architecture na inangkop mula sa isa OpenAI ay binuo para sa isang naunang resulta ng matematika, ang haka-haka ng Cycle Double Cover. Tinanggihan ng setup ang access sa internet ng modelo. Nagtalaga ito ng mga nakikipagkumpitensyang subagent na inatasang bumuo at mag-stress-testing ng iba't ibang estratehiya sa pagpapatunay nang nakapag-iisa, na may mga tahasang tagubilin laban sa napaaga na tagpo at isang kinakailangan na palsuhin ang mga kandidatong argumento sa pamamagitan lamang ng mga konkretong kontra-halimbawa. Ang modelo ay inatasan na magpatuloy hanggang sa ang isang kumpletong patunay ay makaligtas sa panloob na pagsusuri ng adversarial. Ang nagresultang preprint, na nai-post noong Hulyo 27, 2026, ay kinabibilangan ng buong prompt, magkakasunod na draft na manuskrito, isang Lean formalization, at isang axiom audit.
Pagkumpirma ng Kapwa at ang Tanong Kung Sino ang Gumagamit ng Matematika Ngayon
Ang patunay ay sinuri at kinumpirma na nina Alex Townsend, isang matematiko mula sa Cornell, numerical analyst na si Anne Greenbaum, at ni Michel Crouzeix mismo — ang orihinal na may-akda ng haka-haka. Nagpapatuloy ang pormal na peer review. Walong araw matapos lumabas ang unang preprint, nag-post ang mga matematiko na sina Emiel Lorist at Felix Schwenninger ng isang independiyenteng limang-pahinang patunay gamit ang ibang pamamaraan, na pinagsasama ang klasikal na double-layer potential theory na may perturbation lemma para sa 2-dilations. Malugod na tinanggap ni Jin ang parallel na resulta bilang pandagdag sa kanyang sariling gawain.
Ipinapakita ng pangyayaring ito ang isang estruktural na pagbabago sa pananaliksik sa matematika na mahirap balewalain. Kapag ang isang problemang bukas simula noong 2004 ay nalutas ng isang self-taught clinician gamit ang isang consumer AI tool, ang mga hadlang sa paggawa ng mga bagong resulta ay lubos na nababawasan — habang ang kadalubhasaan na kinakailangan upang mapatunayan ang mga resultang iyon ay nagiging mas puro at mas mahalaga.
Para sa larangan ng AI, ang kaso ay nag-aalok ng isang konkretong demonstrasyon kung ano ang magagawa ng mga frontier language model kapag binigyan ng maayos na istrukturang mga autonomous na gawain at sapat na oras ng pag-compute. Kung ang komunidad ng matematika ay may imprastraktura upang makuha ang dami ng mga resulta na maaaring sumunod ay nananatiling isang bukas na tanong.
Pagtanggi sa pananagutan
Sa linya na may Mga alituntunin ng Trust Project, pakitandaan na ang impormasyong ibinigay sa pahinang ito ay hindi nilayon at hindi dapat bigyang-kahulugan bilang legal, buwis, pamumuhunan, pananalapi, o anumang iba pang paraan ng payo. Mahalagang mamuhunan lamang kung ano ang maaari mong mawala at humingi ng independiyenteng payo sa pananalapi kung mayroon kang anumang mga pagdududa. Para sa karagdagang impormasyon, iminumungkahi naming sumangguni sa mga tuntunin at kundisyon pati na rin sa mga pahina ng tulong at suporta na ibinigay ng nagbigay o advertiser. MetaversePost ay nakatuon sa tumpak, walang pinapanigan na pag-uulat, ngunit ang mga kondisyon ng merkado ay maaaring magbago nang walang abiso.
Tungkol sa Ang May-akda
Alisa, isang dedikadong mamamahayag sa MPost, ay dalubhasa sa crypto, AI, mga pamumuhunan, at sa malawak na larangan ng Web3. Sa isang matalas na mata para sa mga umuusbong na uso at teknolohiya, naghahatid siya ng komprehensibong saklaw upang ipaalam at hikayatin ang mga mambabasa sa patuloy na umuusbong na tanawin ng digital finance.
Mas marami pang artikulo
Alisa, isang dedikadong mamamahayag sa MPost, ay dalubhasa sa crypto, AI, mga pamumuhunan, at sa malawak na larangan ng Web3. Sa isang matalas na mata para sa mga umuusbong na uso at teknolohiya, naghahatid siya ng komprehensibong saklaw upang ipaalam at hikayatin ang mga mambabasa sa patuloy na umuusbong na tanawin ng digital finance.



