Truveta je u časopisu JCO Clinical Cancer Informatics objavio studiju u kojoj prikazuje kako veliki jezični model može iz neuređenih medicinskih zapisa izvući podatke o stadiju raka s visokom preciznošću. Model TLM-Oncology je u istraživanju analizirao više od dva milijuna kliničkih bilješki i generirao više od 2,7 milijuna zapisa o stadiju za više od 217.000 pacijenata. Model je primijenjen na karcinome mokraćnog mjehura, dojke, vrata maternice, debelog crijeva i prostate, a pokazao je jednako dobre rezultate i na tipove raka koji nisu bili uključeni u početno treniranje. Autori studije ističu da je većina ključnih onkoloških informacija pohranjena u slobodnom tekstu liječničkih i patoloških izvješća, što otežava njihovo korištenje u istraživanjima. Prema riječima Sujathe Sagiraju, voditeljice istraživanja, kombinacija dubokog kliničkog znanja, napredne umjetne inteligencije i skalabilnog inženjeringa omogućila je pretvaranje tih podataka u istraživački spreman oblik.