Κρατάω bookmarks από το 2009. Στο Tefter βρίσκονται από το 2018, όταν βγήκε — ό,τι υπήρχε πριν το εισήγαγα από τις υπηρεσίες που χρησιμοποιούσα ως τότε, με τις αρχικές ημερομηνίες να διατηρούνται. Το ένα πέμπτο του αρχείου είναι εκείνη η προϊστορία, και φαίνεται: το 78% όσων έσωσα πριν το 2018 έχει tags, έναντι 41% από το 2018 και μετά — και στα πρώτα χρόνια, ως το 2013, το ποσοστό ήταν 96%.
Στην αρχή το απέδωσα στις παλιές υπηρεσίες, που σε ανάγκαζαν να ταξινομείς. Αλλά η κατάρρευση δεν συμπίπτει με την αλλαγή εργαλείου: το 2014–2017 είναι ήδη στο 44%, τέσσερα χρόνια πριν μπω στο Tefter. Άλλαξα εγώ, όχι το εργαλείο — και όπως θα φανεί παρακάτω, άλλαξα σε όλα ταυτόχρονα.
Κάποια στιγμή αναρωτήθηκα τι θα έβγαινε αν τα κοίταζα όλα μαζί, όχι σαν λίστα αλλά σαν αρχείο. Κατέβασα το export και έκατσα να το δουλέψω.
Πριν από οτιδήποτε άλλο, μια διόρθωση που έκανα στον εαυτό μου νωρίς και αξίζει να ειπωθεί: αυτά δεν είναι κείμενα που διάβασα. Είναι κείμενα που έσωσα. Και μάλιστα δεν είναι καν κείμενα όλα. Είναι links σε οτιδήποτε, από κείμενα όντως, μέχρι εικόνες ή youtube videos. Κάποια τα διάβασα / κατανάλωσα, τα περισσότερα όχι, και δεν υπάρχει τρόπος να ξεχωρίσω ποια. Το πεδίο «διαβάστηκε» είναι συμπληρωμένο σε είκοσι επτά από τις δεκατρείς χιλιάδες εγγραφές. Ό,τι ακολουθεί αφορά την προσοχή μου, όχι την ανάγνωσή μου. Αποδείχθηκε πιο ενδιαφέρον έτσι.
Τρεις περίοδοι
Το πρώτο που φάνηκε είναι ότι το αρχείο έχει τρεις ξεκάθαρες περιόδους, με βίαια σύνορα.
Από το 2010 ως το 2013 το ένα τρίτο απ’ όσα έσωζα ήταν άρθρα από τον ελληνικό τύπο, Ελευθεροτυπία, tvxs και Indymedia — και οι ελληνικοί τίτλοι έφτασαν το 59% μέσα στο 2011. Μετά, μέσα σε μία χρονιά, το 2014, τα ελληνικά πέφτουν στο 3% και ο κώδικας φτάνει τα μισά της χρονιάς. Δεν υπάρχει μετάβαση, υπάρχει διακόπτης.
Νομίζω ότι η εξήγηση εδώ είναι αφενός η Ελληνική κρίση που είχε αρχίσει να γιγαντώνεται εκείνα τα χρόνια σε συνδυασμό με τη γέννηση της κορούλας και την έκρηξη που γίνεται τότε με τις τεχνολογίες και τα πρώτα χρόνια στην Skroutz.
Η δεύτερη τομή είναι το 2019. Γεννιούνται δώδεκα καινούργια θέματα μέσα σε έναν χρόνο — έναντι ενός ή δύο σε κάθε άλλη χρονιά — και οι λέξεις που έσωσα τετραπλασιάζονται. Δεν ήταν άνοιγμα ενδιαφερόντων· ήταν άνοιγμα βάθους. Το 28% όσων κράτησα εκείνη τη χρονιά ήταν κείμενα τριών ως δέκα χιλιάδων λέξεων. Δεν ξαναέγινε.
Δεν μπορώ να το εξηγήσω αυτό. Μάλλον έχουν αρχίσει να με ενδιαφέρουν και άλλα θέματα τότε και ίσως η χρήση του Tefter να με ώθησε και σε επιπλέον ενδιαφέροντα bookmarks.
Η τρίτη περίοδος είναι αυτή που ζω ακόμη, και είναι μακράν η μεγαλύτερη: από το 2019 ως σήμερα είναι τα τρία τέταρτα ολόκληρου του αρχείου. Δεν έχει έναν τίτλο όπως οι άλλες δύο. Έχει ζωή και σκέψη (12%), λογισμικό και τεχνητή νοημοσύνη (9%), πολιτική, οικονομία, νευροεπιστήμη, κβαντική φυσική, διάστημα. Ο κώδικας είναι ακόμη εκεί, στο 4%, αλλά δεν είναι πια αυτό που είμαι.
Ο δείκτης που δεν περίμενα
Έφτιαξα ένα μέτρο για το πόσο μετακινείται το κέντρο βάρους των ενδιαφερόντων κάθε χρονιά σε σχέση με την προηγούμενη. Μηδέν σημαίνει «ίδιος άνθρωπος με πέρσι».
Ήμουν σεισμός μέχρι το 2015 — με κορυφές γύρω στο 0,45 — και είμαι πάγος από το 2021, σταθερά κάτω από 0,04. Το χειρότερο: η χρονιά με τα περισσότερα bookmarks είναι ταυτόχρονα η πιο ακίνητη ολόκληρου του αρχείου. Μέγιστη κατανάλωση, μηδενική μετακίνηση. Αυτό δεν είναι περιέργεια, είναι συνήθεια, και δεν το είχα καταλάβει.
Αν το βάλω δίπλα στις τρεις περιόδους, βγαίνει κάτι που δεν το είδα με το πρώτο: η τρίτη περίοδος είναι ταυτόχρονα η μακροβιότερη και η πιο ακίνητη. Άνοιξε βίαια το 2019 και από το 2021 δεν έχει κουνηθεί.
Το αστείο είναι ότι το ίδιο το αρχείο με διαψεύδει αν πάω να προβλέψω κάτι: η πιο ήσυχη χρονιά εκείνης της περιόδου, το 2013, ήταν αυτή που προηγήθηκε της πιο βίαιης στροφής. Δεν υπήρχε κανένα σήμα.
Λέξεις που άλλαξαν νόημα
Αυτό είναι το κομμάτι που με χαροποίησε περισσότερο, και βγήκε μόνο του — δεν είπα στο πρόγραμμα τι να ψάξει. Παίρνει κάθε αρκετά συχνή λέξη και συγκρίνει ποιες λέξεις τη συντροφεύουν στην αρχή και ποιες στο τέλος.
memory 2009–2015 jruby, disk, heap, cpu, usage, garbage
2022–2026 stress, retrieval, recall, formation
objects 2016–2021 heap, object, proc, ruby, garbage
2022–2026 holes, distant, neutron, astronomers, stars
tasks 2016–2021 column, board, assigned, agenda
2022–2026 perform, routine, coding, automate, agent
strategy 2016–2021 portfolio, marketing, acquisition, startups
2022–2026 hegemony, sanctions, governance, socialist
Η «μνήμη» ταξιδεύει από τη μνήμη του υπολογιστή στη μνήμη του ανθρώπου. Τα «αντικείμενα» από τον σωρό της Ruby σε μαύρες τρύπες. Καμία από αυτές τις λέξεις δεν τη διάλεξα εγώ.
Και δεν είναι τυχαίες. Είναι η ίδια διαδρομή που περιέγραψα παραπάνω, γραμμένη σε λεξιλόγιο: ο σωρός της Ruby που γίνεται αστρονομία, τα κουτάκια ενός πίνακα εργασιών που γίνονται πράκτορες, το μάρκετινγκ που γίνεται ηγεμονία.
Ό,τι οργανώνω και ό,τι αφήνω γυμνό
Το σαράντα ένα τοις εκατό του αρχείου δεν το άγγιξα ποτέ ξανά — ούτε tag, ούτε λίστα, ούτε σημείωση. Και η κατανομή δεν είναι τυχαία.
Η μουσική μπαίνει σε λίστες στο 61%. Η φιλοσοφία στο 54%. Η κβαντική φυσική στο 5%, το διάστημα στο 3%.
Οργανώνω ό,τι σκοπεύω να χρησιμοποιήσω. Αφήνω γυμνό ό,τι με γεμίζει θαυμασμό. Ή μήπως ό,τι νιώθω ότι δεν γνωρίζω καλά; Δεν έχω απάντηση σε αυτό.
Και μια προειδοποίηση
Πεντακόσιοι τριάντα έξι από τους συνδέσμους μου είναι νεκροί. Το ποσοστό κυμαίνεται μεταξύ 6% και 12% για ό,τι έχει πάνω από οκτώ χρόνια, και πέφτει ομαλά όσο πλησιάζουμε στο σήμερα. Δεν είναι τύχη, είναι καμπύλη ηλικίας.
Από αυτούς, οι εκατόν ενενήντα έχουν σωσμένο αντίγραφο του κειμένου. Οι τριακόσιοι σαράντα έξι δεν έχουν τίποτα. Χάθηκαν. Αν κρατάτε αρχείο και δεν κρατάτε και το περιεχόμενο, αυτό σας περιμένει.
Το εργαλείο
Έγραψα ένα script που τα κάνει όλα αυτά και βγάζει μια σελίδα HTML. Παίρνει ένα αρχείο JSONL και δεν στέλνει τίποτα πουθενά — τρέχει τοπικά, χωρίς καμία κλήση στο δίκτυο.
pip install scikit-learn pandas plotly
python3 tefter_analyze.py bookmarks.jsonl
Είναι στο github.com/chief/tefter-analyze,
με άδεια MIT. Φτιάχτηκε για exports του Tefter, αλλά θέλει μόνο url, title
και saved_at — οτιδήποτε άλλο είναι προαιρετικό και η αναφορά προσαρμόζεται σε
ό,τι βρει. Στα δικά μου δεκατρείς χιλιάδες bookmarks κάνει ένα λεπτό.
Το μοιράζομαι όχι για τα δικά μου δεδομένα — αυτά αφορούν μόνο εμένα — αλλά επειδή νομίζω ότι σχεδόν όποιος κρατάει αρχείο για χρόνια θα βρει μέσα του κάτι που δεν ήξερε. Η ανάλυση φτάνει και σε λεπτομέρειες που δεν χρειάζεται να αποκαλύψω, μπορώ να πω όμως ότι οι ψυχολόγοι του μέλλοντος θα μπορούσαν να ζητάνε και το ιστορικό των bookmarks σου! :)