Τεχνητή Νοημοσύνη (AI). Τι είναι, τι ξέρουμε, τι αλλάζει στη ζωή και στον πολιτισμό;

Ωραίο βίντεο για το που πάμε (μας πάνε, ότι αρέσει σοτν καθένα)

 
Αυτή είναι μια από τις στιγμές που αντιλαμβάνεται κανείς πως ζούμε κάτι άλλο.

Πρίν από κανένα μήνα προχώρησαν τη θεωρία του Riemann κατά πολύ, εξαιρετικά σημαντικό, απίστευτο για την επιστημονική κοινότητα, πρακτικά γράφοντας νέα μαθηματικά.
Σήμερα έγινε πάλι κάτι, τυποποιήθηκε η απόδειξη για το τελευταίο θεώρημα του Fermat, ένα από τα σπουδαία άλυτα προβλήματα των μαθηματικών μέχρι πρότινος. Η απόδειξη είχε γίνει το 1995, ωστόσο μόνο με αυτή τη διαδικασία είσαι απόλυτα σίγουρος για την ορθότητα της.

Τον φρέσκαρα και εγώ λίγο τον Fermat, το τελευταίο του θεώρημα αναφέρει απλά ότι δεν υπάρχουν θετικοί ακέραιοι αριθμοί α, β, και γ που να ικανοποιούν την εξίσωση α^n+β^n=γ^n για οποιονδήποτε ακέραιο αριθμό >2. Όπου n=2 το γνωστό μας Πυθαγόρειο.

Πήρε 11 ημέρες, 13 εκατομμύρια γραμμές κώδικα και απέδειξε 29500 ενδιάμεσα θεωρήματα με ακαδημαϊκούς του Columbia να κάνουν τη καθοδήγηση του μοντέλου.

1788562969252.png
 
Επίσης το Artificial Analysis ενημέρωσε τη βασική του κλίμακα τοποθετώντας το Astra αρκετά μπροστά από το Sol εν αντιθέσει με τη προηγούμενη σύνθεση του δείκτη.
Ο δείκτης δεν αποτυπώνει τη διαφορά στην ευφυία των μοντέλων αναλογικά. Δηλαδή το Gemini 3.5-Flash-Lite με 28 μονάδες δεν είναι στο μισό της απόδοσης του Sol, είναι πολύ χαμηλότερα.

1788563628358.png
 
Ήρθε το 6, αλλά λίγο περίεργα.
Στο "Work" έχεις κανονικά επιλογή για όποιο thinking level θέλεις από όποιο μοντέλο θέλεις.
Στο CODEX έχω δει κανονικά Max / Ultra.
Όμως στο "Chat" πρακτικά σε αφήνει να το επιλέξεις μόνο στο "Pro" επίπεδο. Δεν γράφει όνομα μοντέλου στο μενού και έχει μόνο ένα "Latest". Ο καλύτερος τρόπος που βρήκα για να ξέρω τι χρησιμοποιώ είναι απλά να... ρωτάω το μοντέλο. Οπότε ναι στο Pro έχεις το 6, αλλά στα υπόλοιπα thinking levels έχει μόνο την επιλογή ως Sol. Δεν μου αρέσει γιατί θα ήθελα απεριόριστο "Extra Thinking" στο Chat με το 6. Τώρα τα όρια είναι πολύ πιο στενά και έχεις τα ίδια στο Work και στο Codex. Θέλω να δω πόσα chat και πόσο μεγάλα μπορώ να κάνω με το Pro 6 στο chat.

1788676454199.png1788676473867.png

Το άλλο που ήθελα να δω ήταν αν όντως η χωρική αντίληψη έχει βελτιωθεί. Ναι έχει, αλλά ακόμη είναι προβληματική αν δεν χρησιμοποιήσει το μοντέλο κάποιο εξωτερικό εργαλείο. Μόλις του είπα να κάνει export το project στο Blender εκεί όλα ήταν τέλεια όπως τα συζητήσαμε με σωστές διαστάσεις σε όλα.

Δείτε ότι στον οριζόντιο άξονα έχει βάλει ένα κομμάτι κάτι λιγότερο από 1 μέτρο που δεν το μετράει πουθενά, ενώ οι αναλογίες του πλυντηρίου και γενικά όλων των πραγμάτων είναι προβληματικές. Δύο prompts για να βγει το πιο κάτω.
1788676806893.png

Μετά του είπα να το κάνει export στο Blender όλα ήταν οκ εκεί και κάνεις ότι παραπάνω θέλεις από το Blender. Φυσικά μπορείς μέσω codex να δώσεις computer use στο blender, αφού έχεις δώσει να διαβάσει όλα τα manuals και τα faqs. Κοινώς ναι δεν μπορεί από μόνο του ακόμη να βγάλει ότι θα χρειαζόσουν, αλλά έμμεσα μπορεί να κάνει πολλά παραπάνω πράγματα.
 
  • Like
Reactions: anderm
Το 3D modeling είναι το μεγαλύτερο άλμα του πάντως.
Χωρίς να έχω κάνει χρήση για αυτόν τον σκοπό πάντως, τα αποτελέσματα είναι πολύ καλά. Καταλαβαίνω πως αντίστοιχο αποτέλεσμα δεν βγάζουν άλλα μοντέλα.
 
Εχμμ...νομίζω ότι περάσαμε επίσημα το threshold του AGI (το οποίο όλοι λένε πως είναι χωρική ζώνη και όχι σημείο). Και δεν το λέω για το hype ή για το wow. Βλέπω ήδη διαφορά στα outputs σε σχέση με τα prompts. Θέλει πολύ πιο απλά prompts για να βγάλει αποτέσμα καλυτερο από πριν και επίσης με ρώτησε κομβικές ερωτήσεις όχι για το πως να κάνει κάτι που του ζήτησα, αλλά πως θέλω το αποτέλσμα να είναι. Αυτό είναι το βασικό θέμα που είχα με τα μοντέλα που είχαμε ως τώρα.
Επίσης το Integration με εξωτερικά εργαλεία είναι πολύ καλύτερο. Να δώσω παράδειγμα. Πριν πολύ λίγο καιρό η nvidia είχε ανακοινώσει ότι πήρε το Opus 5 και του έβαλε harness και στο ARC-AGI-3 από 30% στο 100%.

Το Astra πήρε 100% μόνο του. Και σκεφτείτε ένα τρελό harness γύρω από αυτό. Δεν έχω δουλέψει με το Fable και δεν ξέρω πως συμπεριφέρετε σε task που δεν έχουν σχέση με προγραμματισμό / ΙΤ για να το κρίνω, αλλά φαντάζομαι θα είναι πολύ κοντά και αυτό.

Νομίζω πως ήρθε η ώρα να ξεκινήσουμε να φτιάχνουμε προσωπικούς βοηθούς πιο σοβαρά. Πρέπει να διαλέξουμε αν θέλουμε να ανοίξουμε τα πάντα σε κάποια από τις εταιρίες, να φτιάξουμε το δικό μας ή να έχουμε κάποιο υβρίδιο. Επίσης θεωρώ ότι όσο χτίζουμε, τόσο πιο δύσκολο θα είναι κάποιος να φύγει από την Anthropic και να πάει στην OpenAI κλπ.
Προσωπικά διαμορφώνω το υβρίδιο και ελπίζω να ξεκινήσω να το χρησιμοποιώ μέσα στο Σεπτέμβρη. Προφανώς θα έχει πρόσβαση στη νοημοσύνη του Astra για τα task που απαιτείται, αλλά όσο προχωράμε, τόσο περισσότερο βλέπω task που μικρότερα μοντέλα είναι υπέραρκετά να καλύψουν.
 
Το Astra πήρε 100% μόνο του

1788785514811.png

Με το harness της OpenAI πήγε στο 100% και αυτό.

Νομίζω πως ήρθε η ώρα να ξεκινήσουμε να φτιάχνουμε προσωπικούς βοηθούς πιο σοβαρά. Πρέπει να διαλέξουμε αν θέλουμε να ανοίξουμε τα πάντα σε κάποια από τις εταιρίες, να φτιάξουμε το δικό μας ή να έχουμε κάποιο υβρίδιο. Επίσης θεωρώ ότι όσο χτίζουμε, τόσο πιο δύσκολο θα είναι κάποιος να φύγει από την Anthropic και να πάει στην OpenAI κλπ.
Προσωπικά διαμορφώνω το υβρίδιο και ελπίζω να ξεκινήσω να το χρησιμοποιώ μέσα στο Σεπτέμβρη. Προφανώς θα έχει πρόσβαση στη νοημοσύνη του Astra για τα task που απαιτείται, αλλά όσο προχωράμε, τόσο περισσότερο βλέπω task που μικρότερα μοντέλα είναι υπέραρκετά να καλύψουν.

Για αυτό, θέλουμε μικρότερα αλλά ικανά μοντέλα με καλό throughput ώστε να μην περιμένεις για απάντηση τα οποία θα κάνουν και γρήγορα tool calls και ότι είναι πιο σύνθετο θα το κάνουν escalate. Χρειάζεται ένα υβρίδιο με το κόστος του Luna, την ευφυία τουλάχιστον του Sonnet και τη ταχύτητα των gemini flash.
 
Για αυτό, θέλουμε μικρότερα αλλά ικανά μοντέλα με καλό throughput ώστε να μην περιμένεις για απάντηση τα οποία θα κάνουν και γρήγορα tool calls και ότι είναι πιο σύνθετο θα το κάνουν escalate. Χρειάζεται ένα υβρίδιο με το κόστος του Luna, την ευφυία τουλάχιστον του Sonnet και τη ταχύτητα των gemini flash.
Θα ξεκινήσω με το Qwen3.8-27B το οποίο στα χαρτιά είναι στο επίπεδο του Luna χοντρικά και ελπίζω να έχω 15 tokens/sec με το setup μου...Σε ίδιο hardware έχουν πετύχει 25 αλλά εικάζω ότι είχε παίξει τρελό optimization.
 
Η τεχνητή νοημοσύνη (AI) δεν έχει προκαλέσει ακόμη την ευρέως προβλεπόμενη «αποκάλυψη» στην αγορά εργασίας των ΗΠΑ, καθώς η οικονομία προσέθεσε 162.000 θέσεις εργασίας τον Αύγουστο του 2026, με την ανεργία να διαμορφώνεται στο 4,1%, σύμφωνα με τη Στατιστική Υπηρεσία Εργασίας των ΗΠΑ (Bureau of Labor Statistics). Οι εταιρείες έχουν ανακοινώσει περίπου 200.000 απολύσεις που σχετίζονται με την τεχνητή νοημοσύνη από τα μέσα του 2023. Ωστόσο, το περιοδικό The Economist εκτιμά ότι η άνθηση της τεχνητής νοημοσύνης έχει συμβάλει στη δημιουργία περίπου 1 εκατομμυρίου θέσεων εργασίας, κινούμενη από την κατασκευή κέντρων δεδομένων (data centers), τις ενεργειακές υποδομές και τους νέους ρόλους που εξειδικεύονται στην τεχνητή νοημοσύνη.

Οι επενδύσεις σε υποδομές AI ενισχύουν επίσης τη ζήτηση - και τους υψηλότερους μισθούς - για ηλεκτρολόγους, ειδικούς συστημάτων θέρμανσης, εξαερισμού και κλιματισμού (HVAC), μηχανικούς και τεχνικούς, ενώ οι αγγελίες για θέσεις όπως μηχανικοί AI και επικεφαλής AI έχουν σχεδόν διπλασιαστεί σε σύγκριση με την περίοδο 2023–24. Η αναστάτωση στην αγορά εργασίας είναι άνιση: οι θέσεις εργασίας στην εξυπηρέτηση πελατών και τη διοικητική υποστήριξη έχουν μειωθεί κατακόρυφα, αλλά τα στοιχεία μέχρι στιγμής υποδηλώνουν ότι η τεχνητή νοημοσύνη δημιουργεί νέες θέσεις εργασίας με ταχύτερο ρυθμό από αυτόν με τον οποίο τις καταργεί.

Πηγή: https://www.economist.com/finance-a...ocalypse-is-postponed-an-ai-jobs-boom-is-here
 
Οπότε είναι κρίσιμο το up-skilling.

Είναι κρίσιμο να περάσει αυτό το μήνυμα εντελώς ξεκάθαρα στα επαγγέλματα που ήδη "χτυπιούνται"..
Είναι πολύ πιο περίπλοκο πάντως. Σίγουρα υπάρχει ζήτηση για ότι έχει να κάνει με τα data center, αλλά κατά βάση μιλάμε για Blue collar και εργοτάξιο. Μια εταιρία που φτιάχνει ήδη data center δεν θα χρειαστεί πολλούς παραπάνω μηχανικούς για το σχεδιασμό, με δεδομένη και τη χρήση ΑΙ. Θα χρειαστεί όμως εργατικά χέρια στο εργοτάξιο όλων των βαθμίδων. Καθόλου άσχημα, αλλά είναι σχεδόν αδύνατο να πάρεις έναν 25 ετών προγραμματιστή και να του πεις πήγαινε να γίνεις ψυκτικός ή ηλεκτρολόγος 3 χρόνια μόλις μετά που τελείωσε τη σχολή του. Αντίστοιχα θα χρειαστούμε συντηρητές ρομπότ κλπ.
Και πάλι στην ουσία έχεις τη αντίστοφη πορεία ως τώρα που οδηγούσες προς white collar δουλειές.

Και πόσο θα διαρκέσει και αυτό; Έστω ότι δουλέψει καλά το concept του Musk για τα διεσπαρμένα data center στο διάστημα. Εκεί πάλι χάνονται οι θέσεις εργασίας.

To upskilling το είπε και το Παγκόσμιο Οικονομικό Φόρουμ από πέρισυ. Εγώ θα το έλεγα Re-skilling όμως, που ίσως βρει αντιστάσεις από τους εργαζόμενους γιατί μπορεί να κατευθυνθούν σε μικρότερου κοινωνικού πρεστίζ επαγγέλματα και κανείς δεν μιλάει για τον ελέφαντα στο δωμάτιο. Δεν ξέρουμε καν τα επαγγέλματα του μέλλοντος, άρα πως να φτιάξουμε curriculum; Τα μισά ΑΙ courses σε πάνε σε επίπεδο... ECDL στο Word. Δεν το υποβαθμίζω, αλλά δεν είναι αυτή η λύση / ο σκοπός.
 
Last edited:
Δεύτερη μέρα χρήσης του Astra. Ναι βγάζει καλύτερα αποτελέσματα στον ίδιο περίπου χρόνο ή και λιγότερο με το Sol.
Όμως το allowance στο Codex με αλλαγή από Sol σε Astra στο Extra High κατεβαίνει πιο έντονα χαρακτηριστικά. Δεν θέλω καν να δοκιμάσω Ultra, φαντάζομαι θα ξεμείνω πολύ γρήγορα.
Να πω ότι είμαι στην πρώτη Pro συνδρομή των 100 δολαρίων.
Αυτή δίνει 50 μηνύματα την εβδομάδα στο Pro στο chat - περιέργως σε αυτό το tier δεν διαφοροποιεί το allowance μεταξύ Sol Pro και Astra Pro, οπότε δεν έχω κανένα λόγο να χρησιμοποιώ το Sol Pro.
Σίγουρα δεν είναι φθηνό ή ρεαλιστικό να χρησιμοποιείς τα κορυφαία μοντέλα για κάθε είδους ερώτημα. Περιμένω να δω πότε θα φέρει στο chat το Astra Extended Thinking χωρίς πρακτικά περιορισμό χρήσης. Αυτό ναι θα είναι κάτι σημαντικό.
 
Είναι πολύ πιο περίπλοκο πάντως. Σίγουρα υπάρχει ζήτηση για ότι έχει να κάνει με τα data center, αλλά κατά βάση μιλάμε για Blue collar και εργοτάξιο. Μια εταιρία που φτιάχνει ήδη data center δεν θα χρειαστεί πολλούς παραπάνω μηχανικούς για το σχεδιασμό, με δεδομένη και τη χρήση ΑΙ. Θα χρειαστεί όμως εργατικά χέρια στο εργοτάξιο όλων των βαθμίδων. Καθόλου άσχημα, αλλά είναι σχεδόν αδύνατο να πάρεις έναν 25 ετών προγραμματιστή και να του πεις πήγαινε να γίνεις ψυκτικός ή ηλεκτρολόγος 3 χρόνια μόλις μετά που τελείωσε τη σχολή του. Αντίστοιχα θα χρειαστούμε συντηρητές ρομπότ κλπ.
Και πάλι στην ουσία έχεις τη αντίστοφη πορεία ως τώρα που οδηγούσες προς white collar δουλειές.

Και πόσο θα διαρκέσει και αυτό; Έστω ότι δουλέψει καλά το concept του Musk για τα διεσπαρμένα data center στο διάστημα. Εκεί πάλι χάνονται οι θέσεις εργασίας.

To upskilling το είπε και το Παγκόσμιο Οικονομικό Φόρουμ από πέρισυ. Εγώ θα το έλεγα Re-skilling όμως, που ίσως βρει αντιστάσεις από τους εργαζόμενους γιατί μπορεί να κατευθυνθούν σε μικρότερου κοινωνικού πρεστίζ επαγγέλματα και κανείς δεν μιλάει για τον ελέφαντα στο δωμάτιο. Δεν ξέρουμε καν τα επαγγέλματα του μέλλοντος, άρα πως να φτιάξουμε curriculum; Τα μισά ΑΙ courses σε πάνε σε επίπεδο... ECDL στο Word. Δεν το υποβαθμίζω, αλλά δεν είναι αυτή η λύση / ο σκοπός.

Το 30% των θέσεων που αυξήθηκαν ήταν blue collar και το 70% white collar.

1788884929878.png 1788884935368.png

Το 2024 η τάση ήταν στο να περιοριστούν οι software engineers. Η τάση αντιστράφηκε επειδή δεν επαρκεί στις εταιρίες το να μείνει ίδιος ο αριθμός των παραδοτέων, από μικρότερο προσωπικό. Η τάση αυτή τη στιγμή είναι να αυξήσεις συντριπτικά τα παραδοτέα όπως αυτά προκύπτουν από την αυξημένη παραγωγικότητα.
 
Δεύτερη μέρα χρήσης του Astra. Ναι βγάζει καλύτερα αποτελέσματα στον ίδιο περίπου χρόνο ή και λιγότερο με το Sol.
Όμως το allowance στο Codex με αλλαγή από Sol σε Astra στο Extra High κατεβαίνει πιο έντονα χαρακτηριστικά. Δεν θέλω καν να δοκιμάσω Ultra, φαντάζομαι θα ξεμείνω πολύ γρήγορα.
Να πω ότι είμαι στην πρώτη Pro συνδρομή των 100 δολαρίων.
Αυτή δίνει 50 μηνύματα την εβδομάδα στο Pro στο chat - περιέργως σε αυτό το tier δεν διαφοροποιεί το allowance μεταξύ Sol Pro και Astra Pro, οπότε δεν έχω κανένα λόγο να χρησιμοποιώ το Sol Pro.
Σίγουρα δεν είναι φθηνό ή ρεαλιστικό να χρησιμοποιείς τα κορυφαία μοντέλα για κάθε είδους ερώτημα. Περιμένω να δω πότε θα φέρει στο chat το Astra Extended Thinking χωρίς πρακτικά περιορισμό χρήσης. Αυτό ναι θα είναι κάτι σημαντικό.

Θα βγούν και τα υπόλοιπα μοντέλα του GPT-6.
Απεριόριστη χρήση δεν μπορούν να δώσουν σε ένα τεράστιο μοντέλο, είναι λογικό, αλλά θα έχεις στο GPT-6 Sol πιθανότατα, το οποίο θα φέρει τις βελτιώσεις της γενιάς σε computer usage, 3D κλπ. Εάν θέλεις μια παρηγοριά, στο Claude μετράνε όλα στο όριο χρήσης.
 
Άλλη μια μέρα, κάτι επίσης καταπληκτικό έγινε.

To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Ένα κλειστό μοντέλο της OpenAI, έλυσε το πρόβλημα Navier-Stokes, ένα από τα 7 σπουδαία άλυτα προβλήματα στα μαθηματικά. 88 ώρες και 10.000 agents χρειάστηκαν για να λυθεί.
Όπως πάμε σε ένα χρόνο, ότι λύνεται θα λυθεί.

Βέβαια εάν σταμάταγε εδώ θα παρέμενε καταπληκτικό.
Μια ομάδα ερευνητών, οι Levent Alpöge και Tristan Buckmaster από το ινστιτούτο Courant στο πανεπιστήμιο της Νέας Υόρκης, έκαναν προηγουμένως την απόδειξη της έκρηξης, της εμφάνισης ιδιομορφίας/απειρισμού σε πεπερασμένο χρόνο στις εξισώσεις Euler, που είναι το βασικό σκαλοπάτι για να φτάσεις στις εξισώσεις Navier-Stokes.

Αυτοί έκαναν χρήση των μοντέλων των OpenAI & Anthropic για το παραπάνω, και υπάρχει μια καλή περίπτωση όπως λέει η OpenAI να εκπαίδευσαν το νεότερο μοντέλο τους πάνω στη δουλειά τους στις εξισώσεις Euler. Κάτι κατάλαβαν επ'αυτού όταν έμαθαν πως ξεκίνησε η ομάδα της OpenAI το prompting λίγο αφού είχαν τελειώσει με τις εξισώσεις Euler.

Ο Buckmaster έβγαλε ένα statement γράφοντας πως έφτασαν στο σημείο να τον απειλήσουν με καταστροφή της καριέρας του εάν δεν ακολουθήσουν το timeline που τους έδωσαν για τις δημοσιεύσεις.

Και φυσικά αφού δημοσιεύτηκε, έσπευσαν να τους δώσουν συγχαρητήρια. HBO-Level drama.

1788893909076.png
 
Το βλέπουμε που πάει το πράγμα. Όντως ότι λύνεται θα λυθεί πολύ σύντομα, συμφωνώ. Και αν λυθούν τα μαθηματικά, καταλαβαίνουμε ότι όλα από εκεί και κάτω είναι θέμα χρόνου (φυσική και επιστήμες μηχανικού).
Με τέτοια νοημοσύνη διαθέσιμη, πόσο δύσκολο θα είναι τα ρομπότ που έτρεξαν στους αγώνες στην Κίνα πριν λίγες εβδομάδες να μην βελτιστοποιηθούν άμεσα τουλάχιστον στο Hardware κομμάτι μιας και τα big data για την εκπαίδευση των αλγορίθμων δεν μπορείς απλά να βάλεις ένα μοντέλο να τα φτύσει - ακόμη...

Υ.Γ. Με τρελαίνουν τα em-dashes του chatgpt στις ανακοινώσεις τους! Αναρωτιέμαι προ AI πόσοι τα χρησιμοποιούσαν. Εγώ μια ζωή για όλες τις παύλες απλά πάταγα το - από το πληκτρολόγιο των αριθμών στο πλάι... :ROFLMAO:
 
Last edited:
 
Οσον αφορα στις επιπτωσεις
Ειναι προφανες οτι "παιζονται" περισσοτερα πραγματα απο θεσεις εργασιας.