Kaptam egy hozzáférést az idei ESHG konferencia anyagához, és gondoltam átnézem, milyen újdonságok vannak a tudományban. A konferencia humán genetika központú, hibrid, ezért a poszterek mindegyike, az előadások nagy része visszanézhető. Erre szükség is van, mert párhuzamosan hat szekció is futott, a helyszínen lehetetlen valamennyit végignézni. Rettenetes mennyiségű anyag van, még utólag is komoly erőfeszítést igényel, hogy kiválogassam a hasznos részeket. Meg sem próbálok teljességre törekedni.
Hosszú readek a klinikum szolgálatában
Több előadás, poszter címe is utalt rá, hogy a hosszú readek használata egyre relevánsabb a klinikumban. Még az Illumina is próbál nyitni a hosszabb szekvenciák irányába. Igaz, a maguk módján. Továbbra is 2x150 readekkel operálnak, csak nem fragmentálnak. A hosszú DNS szálak ezért klaszterekbe rendeződnek a flow cell-en. A klaszterezésről magáról nem beszéltek, ezért nem tiszta számomra, hogy honnan tudják, melyik read melyik klaszter tagja. Az sem tiszta, hogy ezek a klaszter információk elérhetőek-e a felhasználók számára, vagy csak a Dragen platform eredményeit látjuk.
Hibák nélkül nem megy
Egy teljes szekciót, négy előadást szenteltek az elmúlasztott variánsoknak. Hiába szekvenálnak tízezres nagyságrendben genomokat, hiába duzzadnak a klinikai adatbázisok, még a nagy nyelvi modellek korában is alaposan meg kell nézni, mit kapunk eredményül. Ebben a szekcióban az előadók eseteket mutattak be, és egy online szavazó rendszerben a hallgatóság szavazhatott, hogy az adott variáns klinikailag releváns-e vagy sem. A válaszok nagyon szórtak. Számomra ebből az a következtetés, hogy a mutációk biológiai megítélése még most is nagyon szubjektív. A másik fontos információ, hogy az annotációk változnak. Ami most még klinikailag irrelevánsnak tűnik, később patogén besorolást kaphat.
Nyelvi modellek megtalálták a helyüket
Még továbbra is találni furcsa alkalmazását a nyelvi modelleknek. Az egyik ilyen az ember egész életútját egy nyelvnek fogja fel, és a különböző hatások (műtét, dohányzás, stb.) szavak, amelyek alapján a nyelvi modell megpróbálja megjósolni az illető életkilátásait. Szerencsére ezek a fajta kutatások kevesen voltak, a legtöbb poszterben az LLM-ek az annotációkat, szöveges forrásokat dolgoztak fel. Tehát arra használták, amire való. Végre!
Kincsek
Ez egy random felsorolás lesz azokkal a dolgokkal, amik érdekesnek tűntek. GenMasterTable: klikkelős program, aki unja a GoldenHelixet, használhatja ezt is. Van hozzá egy GenMasterAI nyelvi modell, hogy összegezze a találatokat. A VEP kapott AlphaMissense támogatást.
