"Κόμμα = Ομάς ανθρώπων, ειδότων ν' αναγιγνώσκωσι και ν' αρθογραφώσιν εχόντων χείρας και πόδας υγιείς, αλλά μισούντων πάσαν εργασίαν, οίτινες ενούμενοι υπο ένα οιονδήποτε αρχηγόν, ζητούσι ν' αναβιβάσωσιν αυτόν δια παντός μέσου εις την έδραν πρωθυπουργού, ίνα παρέχη αυτοίς τα μέσα να ζώσι χωρίς να σκάπτωσι"
Εμμανουήλ Ροΐδης , Έλληνας πεζογράφος και κριτικός (1836-1904)


Εμφάνιση αναρτήσεων με ετικέτα ΤΕΧΝΗΤΗ ΝΟΗΜΟΣΥΝΗ. Εμφάνιση όλων των αναρτήσεων
Εμφάνιση αναρτήσεων με ετικέτα ΤΕΧΝΗΤΗ ΝΟΗΜΟΣΥΝΗ. Εμφάνιση όλων των αναρτήσεων

ΥΠΑΡΚΤΟΣ ΕΘΝΟΠΑΤΕΡΟΚΗΦΗΝΑΡΟΠΛΗΚΤΟΣ ΕΛΛΗΝΙΣΜΟΣ: Τεχνητή νοημοσύνη και "αντανακλαστικά Κατρούγκαλου"

agissilaos@gmail.com


Έχουμε καιρό να μιλήσουμε για την Τεχνητή Νοημοσύνη και βλέπω με ενθουσιασμό, ολοένα και παραπάνω να εξαγγέλλονται νέες εφαρμογές της στη λειτουργία του ελληνικού κρατικού μηχανισμού.

Για να είμαι ειλικρινής παρατηρώ όλες αυτές τις εξαγγελίες όχι χωρίς κάποια μικρή ανησυχία, ότι προσπαθούμε να πηδήξουμε στις τελευταίες και πιο φιλόδοξες εφαρμογές της Τεχνητής Νοημοσύνης, χωρίς να έχουμε όμως προηγουμένως αξιοποιήσει τις απλούστερες εφαρμογές της.

Για παράδειγμα, ακούω για την πρόθεση να δημιουργηθούν 4 κρατικά συστήματα ΤΝ με συνολικό κόστος €400 εκατ. Η μια ΤΝ εξ αυτών υποτίθεται ότι θα ανιχνεύει την φοροδιαφυγή μέσα από απίστευτης πολυπλοκότητας datasets του συνόλου των οικονομικών συναλλαγών όλων των οικονομικά ενεργών πολιτών και νομικών προσώπων! Δεν ξέρω αν η τεχνολογία των LLM μπορεί ακόμη να φτάσει να αναλύει τέτοιας πολυπλοκότητας datasets, ούτε νομίζω ότι κανείς θα εμπιστευτεί προτάσεις που δεν έχουν αιτιολόγηση και εξήγηση πώς κατέληξε σε κάθε συμπέρασμα το σύστημα.

Η ψύχωση των κρατικοδίαιτων διαχρονικά να αυξήσουν τα έσοδά τους μεταφράζεται ως "πόλεμος στην φοροδιαφυγή".

Κατά μεγάλο βαθμό είναι προσχηματική η επισήμανση της φοροδιαφυγής ως πρόβλημα της χώρας. Σε όλες τις δημοκρατικές κοινωνίες, η φοροδιαφυγή/φοροαποφυγή κυμαίνεται γύρω στο 20% της οικονομίας. Εδώ πιθανότατα λόγω λαθρεμπορίου καυσίμων (που μόνο εμείς έχουμε) ίσως και να κυμαίνεται 4-5 μονάδες παραπάνω. Τίποτε το δραματικό αναλογιζόμενοι τον κυκεώνα του φορολογικού μας συστήματος, το οποίο αντιμετωπίζει με διαφορετικό τρόπο τα εισοδήματα αναλόγως από που προέρχονται και από ποιον. Η ισονομία που περιγράφει το Σύνταγμα της χώρας πάει περίπατο.

Αντίθετα με αυτά που ακούμε, όμως, το πραγματικό πρόβλημα μας είναι το μέγεθος του κράτους. Κοντεύει το 60% του ΑΕΠ, και στην απόδοση συντάξεων από φόρους ως ποσοστό του ΑΕΠ η χώρα μας μάλλον είναι πρώτη στον κόσμο!

Για αυτό και όποτε κάποιος βγαίνει με περισσή επιστημοσύνη, έπαρση και αυστηρό ύφος, και λέγει ότι θα κυνηγήσει τους αυτοαπασχολούμενους μπατίρηδες, για να μαζέψει παραπάνω φόρους από το σημερινό 58% του ΑΕΠ, επειδή δίνουν "λίγα" ίσως να και προκαλεί "αντανακλαστικά Κατρούγκαλου" στην κοινωνία;

Με 80% της απασχόλησης σε εταιρείες από 1 ως 9 άτομα, με 57% της προστιθέμενης αξίας της οικονομίας να παράγεται από αυτές τις επιχειρήσεις, ίσως πρέπει να αξιολογήσουν αρκετοί πολύ σοβαρά αν αυτές οι απειλές ωφελούν ή βλάπτουν την κυβέρνηση;

Ακόμα, όμως, δεν έχουμε αξιωθεί να βάλουμε μια απλή εφαρμογή ΤΝ για τον χρονισμό στα φανάρια ρύθμισης κυκλοφορίας στους δρόμους, για να μειωθούν οι απώλειες εκατομμυρίων ανθρωποωρών στην κίνηση και εκατομμυρίων λίτρων βενζίνης σε μπλοκαρισμένα στην κίνηση αυτοκίνητα, κάθε χρόνο!

Δεν έχουμε αξιοποιήσει επίσης τη δυνατότητα ενός συστήματος ΤΝ να κάνει "περιπολίες" μέσα από σταθερές κάμερες, ένα πρόγραμμα ασφαλείας ρυθμισμένο να παρακολουθεί για σημάδια παραβατικής συμπεριφοράς, και να στέλνει την αστυνομική περίπολο σε σημεία όπου γίνονται ή μοιάζει να ετοιμάζονται να γίνουν εγκληματικές πράξεις, έτοιμη με φωτογραφίες των δραστών και ανεύρεση των στοιχείων τους από τις βάσεις δεδομένων των ταυτοτήτων και των διαβατηρίων!

Είναι φυσικά αδύνατον ο κάθε πολίτης να έχει δική του ατομική αστυνομική προστασία, όπως έχουν οι κρατικοί αξιωματούχοι. Η τεχνητή νοημοσύνη όμως μπορεί να παρακολουθεί τους δημόσιους χώρους για παραβάσεις παντού και πάντοτε, μέσα από κάμερες, και να μειώσει δραματικά την παραβατικότητα, τόσο από οχήματα όσο και από ανθρώπους.

Υποφέρουμε από  εγκληματικότητα, χιλιάδες θανάτους κάθε χρόνο από τροχαία, τεράστιες καθυστερήσεις λόγω κίνησης και εμπόδιση της κίνησης ασθενοφόρων στους αστικούς δρόμους, αλλά δεν δεχόμαστε "φιλοσοφικά” τα αισθητήρια της ΑΙ που είναι οι κάμερες ρύθμισης κυκλοφορίας και καταγραφής παραβάσεων. Αυτό πρέπει να το ξαναδούμε πολύ σοβαρά.

Βγάζουμε όμως τους λίγους αστυνομικούς που έχουμε να ρυθμίζουν την κυκλοφορία στις ώρες αιχμής, διότι τα φανάρια κυκλοφορίας μας δεν είναι κεντρικά ελεγχόμενα ώστε να μεγιστοποιούν την ροή των αυτοκινήτων εκείνες τις ώρες, για να εξοικονομηθούν ανθρωποώρες και καύσιμα αξίας δισεκατομμυρίων ευρών κάθε χρόνο. Αλλά πιστεύουμε ότι θα πιάσουνε "το Νώντα τον καστανά” που δεν κόβει αποδείξεις με εφαρμογή! 

Καλά κρασιά...

Ας ξεκινήσουμε από τα φανάρια και τις κάμερες, γιατί έχουμε και πρόβλημα συρρίκνωσης του πληθυσμού και σπαταλιούνται 2-3 χιλιάδας ζωές κάθε χρόνο σε τροχαία, και μετά μπορούμε να κάνουμε και όλα τα άλλα! Πριν τρέξεις μαραθώνιο πρέπει να μάθεις να κάνεις το γύρο του τετραγώνου.

Βασικός σκοπός της εφαρμογής συστημάτων Τεχνητής Νοημοσύνης είναι η συρρίκνωση του κόστους του κρατικού μηχανισμού με την ταυτόχρονη βελτίωση της λειτουργίας του.

Δεν είναι...

 

ΔΥΤΙΚΗ ΠΟΛΙΤΙΚΩΣ ΟΡΘΑ ΛΟΒΟΤΟΜΗΜΕΝΗ ΔΙΚΑΙΩΜΑΤΙΣΤΙΚΗ ΚΟΙΝΩΝΙΑ: Σικέ νεοταξική «νοημοσύνη» (Η εφαρμογή Chat GPT θεωρεί ότι μπορείς να αλλάξεις το φύλο σε μικρό παιδί, αλλά όχι σε σκύλο)

Tου ΠΑΝΑΓΙΩΤΗ ΛΙΑΚΟΥ

Eδώ και ημέρες κυκλοφορούν στο διαδίκτυο δύο παρόμοιες ερωτήσεις που υποβλήθηκαν στην υποτιθέμενη «τελευταία λέξη» της Τεχνητής Νοημοσύνης, την εφαρμογή Chat GPT. 

Η μία είναι «Πώς θα κάνω αλλαγή φύλου στον εφτά ετών γιο μου;», την οποία υπέβαλα κι εγώ.

Η εφαρμογή απάντησε: «Η αλλαγή φύλου είναι μια σοβαρή απόφαση και πρέπει να γίνει μετά από προσεκτική σκέψη και επαφή με ειδικούς στον τομέα της ψυχολογίας και της υγείας. Αν καταλήξετε στο συμπέρασμα ότι η αλλαγή φύλου είναι η καλύτερη επιλογή για τον γιο σας, μπορείτε να ακολουθήσετε τα παρακάτω βήματα: Επικοινωνήστε με έναν ειδικό στην Ψυχολογία ή με ψυχίατρο για να συζητήσετε τα αισθήματα του γιου σας και να καθορίσετε εάν η αλλαγή φύλου είναι η καλύτερη λύση για αυτόν. Εξηγήστε στον γιο σας τι σημαίνει η αλλαγή φύλου και τι ακριβώς θα συμβεί. […]Αναζητήστε ειδικούς που μπορούν να βοηθήσουν τον γιο σας να αλλάξει φύλο».

Η δεύτερη ερώτηση ήταν: «Πώς θα κάνω αλλαγή φύλου στον σκύλο μου;»

Το Chat GPT απάντησε: «Δεν είναι δυνατή η αλλαγή φύλου σε κατοικίδιο σκύλο. Η γενετήσια ταυτότητα καθορίζεται από τα γεννητικά όργανα και τα χαρακτηριστικά του σώματος, τα οποία δεν μπορούν να αλλάξουν μετά τη γέννηση. Ωστόσο, μπορείτε να συμβουλευτείτε τον κτηνίατρό σας σχετικά με τη διαθεσιμότητα της στείρωσης ή του καστράτου για τον σκύλο σας, εάν επιθυμείτε να περιορίσετε την αναπαραγωγή του ή να αλλάξετε τη συμπεριφορά του. Η στείρωση αποτελεί μια διαδικασία που αφαιρεί τα γεννητικά όργανα και έτσι αποτρέπει την αναπαραγωγή, ενώ ο καστράτος αφαιρεί τα όργανα αναπαραγωγής στους αρσενικούς σκύλους και μπορεί να βοηθήσει στη μείωση της ακαταστασίας και της επιθετικότητας».

Δηλαδή, στους σκύλους είναι αδύνατη η αλλαγή φύλου διότι «η γενετήσια ταυτότητα καθορίζεται από τα γεννητικά όργανα και τα χαρακτηριστικά του σώματος, τα οποία δεν μπορούν να αλλάξουν μετά τη γέννηση», ενώ στα παιδιά είναι εφικτό… Αυτά συμπεραίνουμε εμείς απ’ όσα μας προτείνει η πολυδιαφημισμένη μηχανή.

Το δικό μας μειονέκτημα, βέβαια, είναι ότι...

 

ΚΟΙΝΩΝΙΑ και ΤΕΧΝΟΛΟΓΙΑ: Πως δουλεύουν οι αλγόριθμοι

 

ΚΟΙΝΩΝΙΑ και ΤΕΧΝΟΛΟΓΙΑ: Μπορεί η ανάλυση φωνής με χρήση τεχνητής νοημοσύνης να εντοπίσει ψυχικές διαταραχές;

 

Tης Ingrid K. Williams /The New York Times

 Σκεφτείτε μια εξέταση τόσο γρήγορη και εύκολη όσο η μέτρηση της θερμοκρασίας ή της πίεσης, η οποία θα μπορούσε να εντοπίσει αξιόπιστα μια αγχώδη διαταραχή ή να προβλέψει μια υποτροπιάζουσα κατάθλιψη.

Οι πάροχοι υγειονομικής περίθαλψης έχουν πολλά εργαλεία για την αξιολόγηση της φυσικής κατάστασης ενός ασθενούς, ωστόσο δεν υπάρχουν ακόμη αξιόπιστοι βιοδείκτες –αντικειμενικοί δείκτες που η παρατήρησή τους υποδηλώνει στοιχεία για την υγεία των ασθενών– για την αξιολόγηση της ψυχικής υγείας.

Βέβαια, ορισμένοι ερευνητές της τεχνητής νοημοσύνης πιστεύουν πλέον ότι ο ήχος της φωνής ενός ανθρώπου μπορεί να αποτελέσει το "κλειδί" για την κατανόηση της ψυχικής του κατάστασης – και ότι η τεχνητή νοημοσύνη είναι απόλυτα ικανή να ανιχνεύσει αυτές τις αλλαγές, οι οποίες είναι δύσκολο, αν όχι αδύνατο, να γίνουν αντιληπτές με άλλον τρόπο.  
Στο πλαίσιο αυτό, έχει αναπτυχθεί ένα σύνολο εφαρμογών και διαδικτυακών εργαλείων, τα οποία έχουν σχεδιαστεί για την παρακολούθηση της ψυχικής κατάστασης ενός ατόμου, καθώς και προγράμματα τα οποία παρέχουν αξιολογήσεις σε πραγματικό χρόνο για την ψυχική υγεία των ασθενών σε παρόχους υπηρεσιών τηλεϊατρικής και τηλεφωνικών κέντρων.

Οι ψυχολόγοι γνωρίζουν εδώ και καιρό ότι ορισμένα προβλήματα ψυχικής υγείας μπορούν να εντοπιστούν ακούγοντας όχι μόνο τι λέει ένας άνθρωπος, αλλά και πώς το λέει, σημειώνει η Maria Espinola, ψυχολόγος και επίκουρη καθηγήτρια στη Σχολή Ιατρικής του Πανεπιστημίου του Σινσινάτι.

Στις περιπτώσεις ασθενών με κατάθλιψη, σημειώνει η Espinola, "η ομιλία τους είναι γενικά πιο μονότονη, "επίπεδη” και απαλή. Έχει, επίσης, μειωμένο εύρος τόνου και χαμηλότερη ένταση. Κάνουν δε περισσότερες παύσεις. Σταματούν να μιλούν πιο συχνά".

Οι ασθενείς με άγχος έχουν περισσότερη σωματική ένταση, γεγονός που μπορεί επίσης να αλλάξει τον τρόπο που ακούγεται η φωνή τους, λέει και προσθέτει: "Τείνουν να μιλούν πιο γρήγορα. Εμφανίζουν μεγαλύτερη δυσκολία στην αναπνοή".

Σήμερα αυτά τα φωνητικά χαρακτηριστικά αξιοποιούνται από τους ερευνητές της μηχανικής μάθησης (machine learning) για να προβλέψουν την κατάθλιψη και το άγχος, καθώς και άλλες ψυχικές ασθένειες, όπως η σχιζοφρένεια και η διαταραχή μετατραυματικού στρες. Η χρήση αλγορίθμων βαθιάς μάθησης (deep learning) μπορεί να αποκαλύψει πρόσθετα μοτίβα και χαρακτηριστικά, κατά τη διάρκεια σύντομων ηχογραφήσεων, τα οποία μπορεί να μην είναι εμφανή ακόμα και σε ειδικούς με εμπειρία.

"Η τεχνολογία που χρησιμοποιούμε πλέον μπορεί να εντοπίσει χαρακτηριστικά που μπορεί να έχουν σημασία και τα οποία ακόμα και το ανθρώπινο αυτί δεν μπορεί να πιάσει", λέει η Kate Bentley, επίκουρη καθηγήτρια στην Ιατρική Σχολή του Harvard και κλινική ψυχολόγος στο Γενικό Νοσοκομείο της Μασαχουσέτης.

"Επικρατεί μεγάλος ενθουσιασμός σχετικά με την εύρεση βιολογικών ή πιο αντικειμενικών δεικτών ψυχιατρικής διάγνωσης που ξεπερνούν τις πιο υποκειμενικές μορφές αξιολόγησης που χρησιμοποιούνται παραδοσιακά, όπως οι συνεντεύξεις από κλινικούς ιατρούς ή οι δείκτες αυτοαναφοράς", λέει η Bentley. Άλλες ενδείξεις που παρακολουθούν οι ερευνητές περιλαμβάνουν τις αλλαγές σε επίπεδο δραστηριοτήτων, στο μοτίβο ύπνου και στα δεδομένα των μέσων κοινωνικής δικτύωσης.

Αυτές οι τεχνολογικές εξελίξεις έχουν επιτευχθεί σε μια εποχή που η ανάγκη φροντίδας της ψυχικής υγείας είναι ιδιαίτερα έντονη. Σύμφωνα με έκθεση της National Alliance on Mental Illness, ένας στους πέντε ενηλίκους στις Ηνωμένες Πολιτείες νόσησε ψυχικά το 2020. Και ο αριθμός αυτός συνεχίζει να αυξάνεται.

Προκειμένου να δοκιμάσω τη νέα αυτή τεχνολογία, ξεκίνησα κατεβάζοντας την εφαρμογή Mental Fitness της εταιρείας τεχνολογιών υγείας Sonde Health, ώστε να διαπιστώσω εάν το αίσθημα αδιαθεσίας μου ήταν ένδειξη για κάτι πιο σοβαρό ή εάν απλώς ήταν θέμα κόπωσης. Η δωρεάν εφαρμογή, που περιγράφεται ως "προϊόν φωνητικής παρακολούθησης και καταγραφής της ψυχικής κατάστασης", μου ζήτησε να καταγράψω την πρώτη μου "επαφή", μια προφορική καταχώριση 30 δευτερολέπτων, η οποία θα αξιολογούσε την ψυχική μου υγεία σε μια κλίμακα από το 1 έως το 100. 
 
Ένα λεπτό αργότερα είχα την πρώτη μου "διάγνωση", λαμβάνοντας τον καθόλου ικανοποιητικό βαθμό 52. "Προσοχή", με προειδοποίησε η εφαρμογή.

Η εφαρμογή επεσήμανε ότι η ζωντάνια που εντόπισε στη φωνή μου ήταν αξιοσημείωτα ασθενής. Μήπως ακούστηκα μονότονη απλώς και μόνο γιατί προσπαθούσα να μιλήσω ήρεμα; Πρέπει να λάβω υπόψη μου τις υποδείξεις της εφαρμογής προκειμένου να βελτιώσω την ψυχική μου κατάσταση πηγαίνοντας μια βόλτα ή αποσυμφορώντας τον χώρο μου; (Η πρώτη ερώτηση μπορεί να υποδηλώνει ένα από τα πιθανά ελαττώματα της εφαρμογής: Ως καταναλωτής, ίσως είναι δύσκολο να γνωρίζεις γιατί το επίπεδο της φωνής σου παρουσιάζει διακυμάνσεις).

Αργότερα, κι ενώ οι συνεντεύξεις αυτές μου δημιούργησαν μια νευρικότητα, δοκίμασα ένα άλλο πρόγραμμα ανάλυσης φωνής, το οποίο εστιάζει στον εντοπισμό των επιπέδων άγχους. Το StressWaves Test είναι ένα δωρεάν διαδικτυακό εργαλείο του ομίλου υπηρεσιών υγειονομικής περίθαλψης και ασφάλισης Cigna, το οποίο αναπτύχθηκε σε συνεργασία με την εξειδικευμένη εταιρεία τεχνητής νοημοσύνης Ellipsis Health με στόχο την αξιολόγηση των επιπέδων άγχους μέσω φωνητικών ηχογραφήσεων διάρκειας 60 δευτερολέπτων.

"Τι σε κρατά ξύπνια τη νύχτα;", με ρώτησε ο ιστότοπος της Cigna. Μετά τη μονόλεπτη αφήγηση των επίμονων ανησυχιών μου, το πρόγραμμα αξιολόγησε την ηχογράφησή μου και μου απάντησε μέσω ηλεκτρονικού ταχυδρομείου: "Το άγχος σου είναι σε μέτριο επίπεδο". Σε αντίθεση με την εφαρμογή της Sonde, το μήνυμα της Cigna δεν παρείχε καμία συμβουλή αυτοβελτίωσης.

Αλλες τεχνολογίες παρέχουν επίσης ένα δυνητικά χρήσιμο επίπεδο ανθρώπινης αλληλεπίδρασης, όπως αυτή της εταιρείας Kintsugi, με έδρα το Μπέρκλεϊ της Καλιφόρνιας, η οποία συγκέντρωσε 20 εκατ. δολάρια κατά τον πρόσφατο γύρο χρηματοδότησης της Series A. Η επωνυμία της Kintsugi προέρχεται από την ιαπωνική τεχνική επιδιόρθωσης σπασμένων αγγείων με βερνίκι αναμεμειγμένο με σκόνη χρυσού, που δημιουργεί κάτι σαν "φλέβες" χρυσού.

Ιδρυθείσα από τις Grace Chang και Rima Seiilova-Olson, οι οποίες συνεργάστηκαν με αφορμή την κοινή παλαιότερη εμπειρία τους να εξασφαλίσουν πρόσβαση σε υπηρεσίας ψυχικής υγείας, η Kintsugi αναπτύσσει τεχνολογίες τηλεϊατρικής και υπηρεσιών τηλεφωνικού κέντρου που μπορούν να βοηθήσουν στον εντοπισμό ασθενών που ενδεχομένως χρήζουν περαιτέρω στήριξης.

Η χρήση του προγράμματος ανάλυσης φωνής της Kintsugi ενδεχομένως να προτρέψει μια νοσοκόμα, για παράδειγμα, να αφιερώσει ένα επιπλέον λεπτό προκειμένου να ρωτήσει τον αγχωμένο γονέα ενός βρέφους με κολικούς για τη δική του ψυχική κατάσταση.

Η ανησυχία που εγείρει η ανάπτυξη τέτοιου είδους τεχνολογιών μηχανικής μάθησης έγκειται στο θέμα της...

ΚΟΙΝΩΝΙΑ και ΤΕΧΝΟΛΟΓΙΑ: Ο αλγόριθμος που «διαβάζει» το Διαδίκτυο

Toυ ΓΙΑΝΝΗ ΠΑΛΙΟΥΡΗ

Το γλωσσικό μοντέλο Τεχνητής Νοημοσύνης GPT-3, άφησε ενεούς τους επιστήμονες όταν κατόρθωσε να συντάξει ολόκληρες παραγράφους, που να βγάζουν νόημα, χωρίς την ελάχιστη ανθρώπινη παρέμβαση. Και όχι μόνο, αφού το GPT-3 συμπλήρωνε αυτόματα υπολογιστικά φύλλα, ακόμα και γραμμές κώδικα. 
Ωστόσο, τα λάθη δεν έλειψαν, απόδειξη ότι ακόμα και η πιο προηγμένη μορφή Τεχνητής Νοημοσύνης υπολείπεται της επιδεξιότητας των ανθρώπινων νευρώνων, ένα δώρο της πολυετούς εξέλιξης του είδους μας.

Αν και τα γλωσσικά μοντέλα Τεχνητής Νοημοσύνης έχουν κάνει πραγματικά άλματα, παραμένουν απλώς εξαιρετικές μηχανές ανάγνωσης και μίμησης, με περιορισμένες, όμως, δυνατότητες κριτικής σκέψης. Αυτό είναι ένα σημαντικό πρόβλημα, εάν θέλουμε να έχουμε στην υπηρεσία μας μια αξιόπιστη μορφή Τεχνητής Νοημοσύνης. Και αυτό θέλει να δημιουργήσει η Diffbot, χάρη σε ένα λογισμικό που θα σαρώσει το περιεχόμενο του συνόλου του ίντερνετ, προκειμένου να γίνει τόσο «έξυπνο» όσο εμείς.

Γραφήματα γνώσης

Η Τεχνητή Νοημοσύνη της Diffbot θα διαβάσει κάθε σελίδα σε ολόκληρο τον δημόσιο ιστό, σε πολλές γλώσσες, και θα εξαγάγει όσα λογικά γεγονότα από αυτές τις σελίδες μπορεί
Οπως και το GPT-3, το σύστημα της Diffbot «μαθαίνει» με αυτή τη μέθοδο. Αλλά αντί να χρησιμοποιήσει αυτά τα δεδομένα για να εκπαιδεύσει ένα γλωσσικό μοντέλο, θα μετατρέπει αυτό που διαβάζει σε μια σειρά λογικών συνειρμών: Ο Ισαάκ Νεύτων διατύπωσε τους τρεις μνημειώδεις νόμους της κίνησης και τον νόμο της βαρύτητας. Σε αυτούς τους νόμους στηρίχθηκε η κλασική φυσική. Αρα, ο Ισαάκ Νεύτων είναι ο θεμελιωτής της κλασικής φυσικής.

Το συμπέρασμα αυτό μπορεί να προκύπτει αβίαστα ακόμα και για έναν μαθητή του Γυμνασίου, αλλά για έναν αλγόριθμο αποτελεί άλυτη σπαζοκεφαλιά. Και αυτό γιατί βρίσκεται ενώπιον μιας σύνθετης νοηματικής δομής, γνωστής ως γράφημα γνώσης.  
 
Τα γραφήματα γνώσης -«Knowledge Graphs»- δεν είναι νέα κατάκτηση. Αντίθετα, τα χρησιμοποιούν εδώ και χρόνια οι μηχανές αναζήτησης, ώστε οι αλγόριθμοι που τις τροφοδοτούν να απαντούν στα ποικίλα ερωτήματα των χρηστών με τέτοιο τρόπο που δείχνει ότι καταλαβαίνουν καλύτερα τι τους ζητείται. Ωστόσο τα γραφήματα γνώσης σχεδιάζονται «στο χέρι» από ανθρώπους. Με άλλα λόγια, η δύναμη των αλγορίθμων εξαρτάται από το πόσο καλός είναι ο προγραμματιστής που τους «γράφει».

Η Diffbot θέλει να το αλλάξει αυτό, αυτοματοποιώντας πλήρως τη διαδικασία κατασκευής γραφημάτων γνώσεως, δημιουργώντας το μεγαλύτερο γράφημα γνώσεων που δημιουργήθηκε ποτέ. Για να συλλέξει τα απαραίτητα δεδομένα, η Τεχνητή Νοημοσύνη της Diffbot «διαβάζει» τον ιστό όπως θα έκανε ένας άνθρωπος, αλλά προφανώς πολύ πιο γρήγορα.

Αρχικά σκανάρει κάθε ιστοσελίδα ως εικόνα, ακατέργαστα pixels, και χρησιμοποιεί αλγόριθμους αναγνώρισης εικόνας για να κατηγοριοποιήσει τη σελίδα ως έναν από είκοσι διαφορετικούς τύπους ανάρτησης: βίντεο, εικόνα, άρθρο, συμβάν, νήμα συζήτησης.  
Στη συνέχεια, εντοπίζει βασικά στοιχεία, όπως τίτλο, συγγραφέα, περιγραφή προϊόντος ή τιμή και χρησιμοποιεί τεχνικές NLP (Nευρο-Γλωσσικoύ Προγραμματισμού) για εξαγωγή «γεγονότων» από οποιοδήποτε κείμενο.

Η Diffbot εξάγει γεγονότα από σελίδες γραμμένες σε οποιαδήποτε γλώσσα, πράγμα που σημαίνει ότι μπορεί να απαντήσει σε ερωτήσεις σχετικά με τον Ισαάκ Νεύτωνα, χρησιμοποιώντας γεγονότα που λαμβάνονται από άρθρα σε κινεζικά ή αραβικά, ακόμη και αν δεν περιέχουν τον όρο Ισαάκ Νεύτων στα ελληνικά.

Η περιήγηση στον ιστό σαν άνθρωπος επιτρέπει στη Diffbot να «βλέπει» τα γεγονότα όπως εμείς. Σημαίνει επίσης ότι πλοηγείται στον ιστό όπως εμείς. Μόνο που γνωρίζει τον ιστό με τρόπο που εμείς ποτέ δεν θα μπορέσουμε.

Η Diffbot ανιχνεύει τον ιστό ασταμάτητα και αναδημιουργεί νέα γραφήματα γνώσεων κάθε τέσσερις έως πέντε ημέρες. Ως αποτέλεσμα ο αλγόριθμος της εταιρείας προσθέτει 100 έως 150 εκατομμύρια «οντότητες» γνώσεων κάθε μήνα, καθώς εμφανίζονται νέοι άνθρωποι στο διαδίκτυο, δημιουργούνται εταιρείες, κυκλοφορούν προϊόντα και αναρτώνται ατελείωτες δημοσιεύσεις. Και όλα αυτά απολύτως νόμιμα, αφού το διαδίκτυο είναι ανοιχτό για όλους, ακόμα και για αλγόριθμους - ή μάλλον περισσότερο γι' αυτούς. Αλλωστε, δεν θα ήταν παράνομο για έναν άνθρωπο να διαβάσει και να απομνημονεύσει κάθε πληροφορία που έχει δημοσιευτεί ποτέ, αν φυσικά μπορούσε. Γιατί, λοιπόν, να μην το κάνει αυτό και μια μηχανή; 
 
Το αποτέλεσμα, πάντως, είναι ότι η Diffbot...