
Η τεχνητή νοημοσύνη χρησιμοποιείται πλέον όχι μόνο για κείμενα και εικόνες, αλλά και για να αποκωδικοποιεί βασικούς μηχανισμούς της ίδιας της ζωής. Ερευνητές του University of California San Diego ανακοίνωσαν ότι με τη βοήθεια μηχανικής μάθησης κατάφεραν να αποκαλύψουν το χαρακτηριστικό μοτίβο DNA ενός κρίσιμου «διακόπτη» που βοηθά στην έναρξη της έκφρασης των γονιδίων.
Το στοιχείο αυτό ονομάζεται initiator και βρίσκεται στην περιοχή από όπου ξεκινά η μεταγραφή της γενετικής πληροφορίας. Η ομάδα ανέλυσε περίπου 500.000 διαφορετικές αλληλουχίες DNA και χρησιμοποίησε τα δεδομένα για να εκπαιδεύσει μοντέλο μηχανικής μάθησης που μπορεί να προβλέπει με μεγάλη ακρίβεια πότε το initiator είναι ενεργό.
Τι ακριβώς αποκάλυψε η μελέτη
Σύμφωνα με τους ερευνητές, το μοτίβο του initiator εμφανίζεται σε περίπου 60% των ανθρώπινων γονιδιακών promoters που εξετάστηκαν. Αυτό είναι σημαντικό επειδή οι promoters λειτουργούν σαν σημεία ελέγχου: καθορίζουν πότε, πού και σε ποιο βαθμό ένα γονίδιο θα «ανάψει» και θα αρχίσει να παράγει το αντίστοιχο RNA και, τελικά, πρωτεΐνες.
Η λανθασμένη ενεργοποίηση ή απενεργοποίηση γονιδίων μπορεί να συνδέεται με σοβαρές παθήσεις. Για τον λόγο αυτό, η δυνατότητα ενός μοντέλου AI να εντοπίζει το initiator και να προβλέπει πώς επηρεάζεται από μεταλλάξεις μπορεί να δώσει στους επιστήμονες ένα νέο εργαλείο για τη μελέτη του καρκίνου και άλλων γενετικών διαταραχών.
Γιατί η τεχνητή νοημοσύνη ήταν κρίσιμη
Το εντυπωσιακό σημείο της δουλειάς δεν είναι μόνο ο αριθμός των αλληλουχιών που εξετάστηκαν, αλλά και ο συνδυασμός εργαστηριακών πειραμάτων με υπολογιστική ανάλυση. Οι ερευνητές μέτρησαν τη δραστηριότητα εκατοντάδων χιλιάδων παραλλαγών και στη συνέχεια έδωσαν αυτά τα δεδομένα στο μοντέλο.
Έτσι, αντί να βασιστούν αποκλειστικά σε ένα απλό «μοτίβο συναίνεσης», δημιούργησαν ένα μοντέλο που μαθαίνει ποιοι συνδυασμοί βάσεων του DNA αυξάνουν ή μειώνουν τη δραστηριότητα του initiator.
Τι μπορεί να σημαίνει για τις μεταλλάξεις
Το επόμενο μεγάλο βήμα είναι η χρήση αυτών των μοντέλων για την πρόβλεψη της επίδρασης συγκεκριμένων μεταλλάξεων. Αν μια μικρή αλλαγή στο DNA βρίσκεται μέσα ή κοντά σε ένα στοιχείο που ελέγχει την έναρξη της μεταγραφής, το μοντέλο μπορεί να βοηθήσει να εκτιμηθεί αν αυτή η αλλαγή θα επηρεάσει την ενεργοποίηση ενός γονιδίου.
Αυτό δεν σημαίνει ότι η AI μπορεί ήδη να προβλέψει με βεβαιότητα ποιος θα εμφανίσει μια ασθένεια. Σημαίνει όμως ότι η γενετική έρευνα αποκτά ένα νέο επίπεδο πρόβλεψης, το οποίο μπορεί να χρησιμοποιηθεί για να ιεραρχούνται μεταλλάξεις που αξίζουν περαιτέρω μελέτη.
Το μεγάλο στοίχημα: να αποκωδικοποιηθεί ο «κώδικας έκφρασης» των γονιδίων
Ο καθηγητής James T. Kadonaga εξηγεί ότι μέσα στα περίπου έξι δισεκατομμύρια βάσεις DNA κάθε ανθρώπινου κυττάρου υπάρχει ένας πολύπλοκος κώδικας που καθορίζει πότε και πόσο θα ενεργοποιείται κάθε γονίδιο. Το νέο μοντέλο αφορά μόνο ένα κομμάτι αυτού του κώδικα, αλλά δείχνει τον δρόμο για πιο ολοκληρωμένα συστήματα στο μέλλον.
Αν η έρευνα προχωρήσει, αντίστοιχα μοντέλα θα μπορούσαν να συνδυάζουν πολλαπλά ρυθμιστικά στοιχεία και να δίνουν πολύ ακριβέστερες προβλέψεις για τη λειτουργία του ανθρώπινου γονιδιώματος.
Γιατί είναι σημαντικό το εύρημα
Η συγκεκριμένη μελέτη βρίσκεται ακριβώς στο σημείο όπου συναντώνται βιολογία, γενετική και τεχνητή νοημοσύνη. Δεν πρόκειται για μια απλή επίδειξη AI. Πρόκειται για τη χρήση μηχανικής μάθησης πάνω σε τεράστιο όγκο πραγματικών πειραματικών δεδομένων, με στόχο να κατανοηθεί καλύτερα ένας βασικός μηχανισμός της γονιδιακής λειτουργίας.
Το αποτέλεσμα δείχνει ότι η επόμενη μεγάλη εποχή της AI μπορεί να μην περιοριστεί στα chatbots και στην αυτοματοποίηση, αλλά να περάσει βαθιά μέσα στα εργαστήρια, στην ανακάλυψη φαρμάκων, στη γενετική και στη βιοϊατρική έρευνα.
Πηγές
UC San Diego
Genes & Development / DOI
Phys.org / UC San Diego
Φωτογραφία: CSIRO ScienceImage — CC BY 3.0