Τεχνητή Νοημοσύνη (AI). Τι είναι, τι ξέρουμε, τι αλλάζει στη ζωή και στον πολιτισμό;

Το βλέπουμε που πάει το πράγμα. Όντως ότι λύνεται θα λυθεί πολύ σύντομα, συμφωνώ. Και αν λυθούν τα μαθηματικά, καταλαβαίνουμε ότι όλα από εκεί και κάτω είναι θέμα χρόνου (φυσική και επιστήμες μηχανικού).
Όχι, υπάρχει το θεώρημα του Gödel. "Υπάρχουν αληθείς προτάσεις που δεν είναι αποδείξιμες μέσα σε ένα λογικά συνεπές σύστημα".
 
  • Like
Reactions: Deneb
Η Cursor έβγαλε καινούριο benchmark για το software development:

1789076019625.png

Και το πιο ωραίο της ημέρας:


Συνοπτικά:

  1. Η Alibaba έστελνε 3 εκατομμύρια (!!!) αιτήματα την ημέρα στα Opus 4.6 & 4.7 μέσα από 3.500 λογαριασμούς για να εκπαιδεύσει τα μοντέλα της -έτσι φτιάχνουμε και εμείς μοντέλο
  2. Η Moonshot (Kimi) σε έστελνε στο Claude ενώ νόμιζες ότι στέλνεις αιτήματα στο Kimi x.x για να τραβήξει και αυτή το chain of thought των μοντέλων, μέσα από 5380 ψεύτικους λογαριασμούς
  3. Φυσικά έκανε το ίδιο και η Deepseek, με απείρου κάλλους καταστάσεις:
    1. Υπάλληλος υπηρεσίας του Ρωσικού υπουργείου αμύνης ανέβασε ενεργούς κωδικούς πρόσβασης κυβερνητικών βάσεων δεδομένων και πήγαν στο Claude
    2. Η αστυνομία της Κίνας έφτιαξε ένα case management σύστημα παρακολούθησης πολιτών "The engineer built a tool that compares a person’s movements against police records using the national ID number of citizens."
  4. Ένα γκρούπ τρομοκρατών στην Υεμένη προσπάθησε να φτιάξει λογισμικό καθοδήγησης πυραύλων (!!!) Μάλιστα δοκίμασαν και τον πύραυλο, απέτυχε και ξαναρώτησαν το μοντέλο για το τι πήγε στραβά
  5. Η υπηρεσία ασφαλείας του Μάλι προσπάθησε να φτιάξει ένα σύστημα super-surveillance που να παρακολουθεί 25 εκατομμύρια SIM ταυτόχρονα.
  6. Έφτιαξαν ψεύτικα dating app με 4,700 περσόνες, έχοντας ανταλλάξει πάνω από 2 εκατομμύρια μηνύματα

Και άλλα δεκάδες ακόμη παραδείγματα που είναι να τραβάς τα μαλλιά σου.
 
Last edited:
  • Wow
Reactions: evanfotis
...

Και το πιο ωραίο της ημέρας:


Συνοπτικά:

  1. Η Alibaba έστελνε 3 εκατομμύρια (!!!) αιτήματα την ημέρα στα Opus 4.6 & 4.7 μέσα από 3.500 λογαριασμούς για να εκπαιδεύσει τα μοντέλα της -έτσι φτιάχνουμε και εμείς μοντέλο
  2. Η Moonshot (Kimi) σε έστελνε στο Claude ενώ νόμιζες ότι στέλνεις αιτήματα στο Kimi x.x για να τραβήξει και αυτή το chain of thought των μοντέλων, μέσα από 5380 ψεύτικους λογαριασμούς
  3. Φυσικά έκανε το ίδιο και η Deepseek, με απείρου κάλλους καταστάσεις:
    1. Υπάλληλος υπηρεσίας του Ρωσικού υπουργείου αμύνης ανέβασε ενεργούς κωδικούς πρόσβασης κυβερνητικών βάσεων δεδομένων και πήγαν στο Claude
    2. Η αστυνομία της Κίνας έφτιαξε ένα case management σύστημα παρακολούθησης πολιτών "The engineer built a tool that compares a person’s movements against police records using the national ID number of citizens."
  4. Ένα γκρούπ τρομοκρατών στην Υεμένη προσπάθησε να φτιάξει λογισμικό καθοδήγησης πυραύλων (!!!) Μάλιστα δοκίμασαν και τον πύραυλο, απέτυχε και ξαναρώτησαν το μοντέλο για το τι πήγε στραβά
  5. Η υπηρεσία ασφαλείας του Μάλι προσπάθησε να φτιάξει ένα σύστημα super-surveillance που να παρακολουθεί 25 εκατομμύρια SIM ταυτόχρονα.
  6. Έφτιαξαν ψεύτικα dating app με 4,700 περσόνες, έχοντας ανταλλάξει πάνω από 2 εκατομμύρια μηνύματα

Και άλλα δεκάδες ακόμη παραδείγματα που είναι να τραβάς τα μαλλιά σου.

Το μεγαλείο της ανθρωπότητας!!!
Μερικά από όσα φανταζόμασταν, αλλά δεν είχαμε αποδείξεις να τα υποστηρίξουμε...

Τα θέματα για χρήση των Αμερικάνικων μοντέλων για εκπαίδευση των Κινέζικων τα γνωρίζουμε και υπάρχει ακόμη ανοικτό debate σε ποιο επίπεδο είναι θεμιτές ή όχι τέτοιες πρακτικές και υπό ποιο πρίσμα. Τα άλλα είναι τα ζουμερά όμως...

Πάντως εγώ ακόμη προσπαθώ να συνειδητοποιήσω ότι οι εξισώσες Navier Stokes λύθηκαν από ένα μοντέλο που είναι ακόμη υπό εξέλιξη και απλά του έβαλαν και αυτό το τασκ στα μισά της εκπαίδευσής του. Το κόστος, όσο και αν το παρουσιάζουν τεράστιο, στο τέλος της ημέρας ήταν ώρες και MWh και τίποτα παραπάνω για να λυθούν πρακτικά τα μαθηματικά. Αυτό ίσως και να είναι ASI...όχι απλά AGI...

To Singularity είναι εδώ και σε λίγο ο δυτικός κόσμος θα ασχολείται με τα υδατογραφήματα στο κείμενο, που πια οι περισσότεροι δηλώνουν τη χρήση εργαλείων έτσι και αλλιώς για βελτίωση κειμένου και θα έχουμε τις ηθικές συζητήσεις αν θα πρέπει να απαγορευτούν οι σύντροφοι ρομπότ που βασίζονται μέσω cloud σε advanced AIs που προσφέρουν υπηρεσίες συντρόφου και αν πρέπει να κάνουμε οριζόντια απαγόρευση σαν τους Κινέζους.

In the mean time, ο Musk και οι φίλοι του δεν θα έχουν απλά ένα data center στο διάστημα, αλλά θα φτιάχνουν και τα τσιπ στο διάστημα...το πρώτο εργοστάσιο πέρα από τη γη μας...

 
Θα ξεκινήσω με το Qwen3.8-27B το οποίο στα χαρτιά είναι στο επίπεδο του Luna χοντρικά και ελπίζω να έχω 15 tokens/sec με το setup μου...Σε ίδιο hardware έχουν πετύχει 25 αλλά εικάζω ότι είχε παίξει τρελό optimization.
Ενδιαφεροντα ολα αυτα..
Μπορεις αν θελεις και ειναι εφικτο να μας κανεις περιγραφη του setup σου?
Που και πως τα τρεχεις ολα αυτα
 
Ενδιαφεροντα ολα αυτα..
Μπορεις αν θελεις και ειναι εφικτο να μας κανεις περιγραφη του setup σου?
Που και πως τα τρεχεις ολα αυτα
Το σχεδιασμό τον κάνω από τον Ιούνιο, γιατί το κόστος είναι μεγάλο (3-4000 ευρώ). Έχω παραγγείλει ένα ASUS ProArt PX13 με AMD Ryzen Al MAX+ 395, 128GB RAM, 2TB SSD. Για τις ανάγκες μου ήταν μονόδρομος η πλατφόρμα, αλλά έφαγα αρκετό χρόνο να δω αν θέλω να είναι σε minipc μορφή ή λαπτοπ. Τελικά κατέληξα σε laptop γιατί στη χειρότερη περίπτωση θα έχω ένα καινουργιο δυνατό λαπτοπ να αντικαταστήσω τον βασικό μου υπολογιστή που είναι άλλο ένα λαπτοπ 6μιση ετών ακόμη και αν δεν χρησιμοποιήσω όλα τα Local AI εργαλεία που σκέφτομαι τελικά. Είναι λαπτοπ γιατί 3 φορές το χρόνο πάει στο εξοχικό που έχω στημένο και εκεί γραφείο. To laptop είναι στο δρόμο τώρα με UPS από την Amazon, λογικά θα το έχω την επόμενη εβδομάδα στα χέρια μου.

Για τα ταξίδια έχω άλλο υπολογιστή, ένα MS Surface Pro 7, αν και ίσως το καινούργιο Asus να αντικαταστήσει και αυτό αν καταφέρω να το ασφαλίσω για κλοπή/καταστροφή σε διάρκεια ταξιδιού.

Θα ξεκινήσω με το Qwen3.8-27B γιατί είναι αρκετά δυνατό -τουλάχιστον σύμφωνα με τα benchmarks-, ικανό να καλύψει αυτά που έχω στο μυαλό μου και βάσει benchmark ρεαλιστικά περιμένω 10-15 token/s που είναι αποδεκτά. Θα ξεκινήσω με Q8 και αν δεν πάει καλά θα πέσω σε Q6. Ελπίζω να μην χρειαστεί να πέσω περισσότερο.

Όλα θα τρέχουν στα windows 11, το harness θα βασίζεται σε Python/FastAPI/Pydantic/SQLAlchemy/Pydantic AI target. Σκοπεύω σιγά σιγά να προσθέσω ένα local React interface later και ένα ξεχωριστό egress broker. Θα κρατήσω προς το παρόν το LM Studio για να σερβίρει το μοντέλο γιατί το έχω μάθει καλά με το μικρό Qwen3 4B Instruct 2507 που χρησιμοποιώ για τη γραμματέα μου προς το παρόν. Θα στήσω και πρόσβαση μέσω CLI με το ChatGPT όπου χρειάζεται παραπάνω νοημοσύνη. Πρακτικά η πρώτη εφαρμογή είναι ένας εξελιγμένος προσωπικός βοηθός βασισμένος στη γραμματέα που έχω σήμερα (να πω ότι η γραμματέας χρησιμοποιεί το LLM για την διεπαφή μαζί μου μόνο, από πίσω για όλα τα task υπάρχει ντετερμινιστικός κλασσικός προγραμματισμός - δοκίμασα και με το openclaw για κάτι περισσότερο, αλλά είναι αδύνατον με 4Β μοντέλο).

Αυτό που είναι τελείως προσωπικό είναι ότι θα στηθεί για 3 βασικά σενάρια:
1. Σενάριο στο οποίο τρέχει κλειδωμένο στο pc μου για συμβόλαια της δουλειάς μου, που μου απαγορεύουν ακόμη και τη χρήση του Business Co-pilot που θεωρείται ότι χρησιμοποιεί Private tenant στο cloud. Για ότι desk research χρειάζεται, θα κάνω de-sensitivize και θα περνάω μετά από προσωπικό έλεγχο στο codex το research και θα μεταφέρω πίσω τα αποτελέσματα χεράτα (δηλαδή όπως δούλευα μέχρι σήμερα με το παραδοσιακό google από πλευράς προσέγγισης). Από κανένα ΑΙ, στο Qwen3.8-27B θα είναι τρελή διαφορά πιστεύω για αυτού του είδους τα έργα στη δουλειά μου.
2. Σενάριο που επιτρέπω πρόσβαση στο Internet αλλά με έλεγχο του τι φεύγει από τον υπολογιστή μου. Θεωρητικά θα φτιάξω κάποτε ένα skill για να επιτρέπει στο πρώτο σενάριο περιορισμένη πρόσβαση στο internet αυτόματα χωρίς να τσεκάρω τα πάντα.
3. Καθημερινό σενάριο που λειτουργεί με πλήρη πρόσβαση στο internet και μπορεί να τραβάει το chatgpt μέσω CLI ώστε να είναι μέσω της συνδρομής και να μην πληρώνω μέσω API. Αυτό είναι που θέλω να δω πόσο θα χρησιμοποιήσω, γιατί εκεί που δεν υπάρχει θέμα confidentiality χρησιμοποιώ φουλ το chatgpt (έχω τη μικρή Pro συνδρομή).

Τέλος θα προσπαθήσω να μιλάω μαζί του αρκετά για να δει πως σκέφτομαι και δουλεύω και να αποθηκεύω μνήμες από αυτά με στόχο να τις χρησιμοποιήσω για την εκπαίδευση κάποιου προσωποποιημένου προσωπικού βοηθού στο μέλλον. Αυτό το επίπεδο δεν έχει ΑΙ. Θα μου φτιάξει το Codex προσωποποιημένη εφαρμογή γιατί δεν υπάρχει κάποιο open source που να κάνει αυτό ακριβώς που θέλω και θέλω να γίνει ντετερμινιστικά.

Αν πάει καλά θα το εξελίσω. Θα βελτιώνω το software ανάλογα με τη χρήση που θα κάνω. Αν θελήσω να τρέξω κάποιο καλύτερο μοντέλο τοπικά μπορώ να πάρω ένα minipc με την ίδια πλατφόρμα και να αυξήσω την μνήμη - αυτό ήδη υποστηρίζεται. Αν δεν πάει καλά, θα έχω ένα καινούργιο λαπτοπ για τα επόμενα 5-6 χρόνια άνετα.
 
Last edited:
  • Like
Reactions: leonkoum
 
Τους πήρε μια ημέρα να μας διαβάσουν, να βρουν το αρχικό κείμενο και να το γράψουν :p :p :p
 
  • Haha
Reactions: anderm
Σε άλλα νέα η OpenAI ενεργοποίησε το GPT-Live-1 στο API που είχε ανακοινωθεί τον Ιούλιο, ενεργοποιώντας full-dublex voice, δηλαδή πράκτορες που ακούν την ώρα που μιλάνε και συνεχίζουν να δουλεύουν απρόσκοπτα.

 
Και σε πιο σημαντικά νέα. Με την αυξανόμενη ανεργία πολλοί white collar εργαζόμενοι κάνουν αυτό είδαμε να γίνεται σε εργοστάσια...αφήνουν να τους καταγράφουν το πως κάνουν την εργασία τους για εισόδημα.

Να σημειώσω ότι η Κίνα έχει κάνει εθνική πολιτική την ανάπτυξη big data sets που θα χρησιμοποιηθούν μελλοντικά τόσο για το ΑΙ καθαυτό όσο και για τα ρομπότ. Νιώθω ότι αυτή η πρωτοβουλία τελικά ίσως τους κερδίσει το race ειδικά για τα ρομπότ.

 
Last edited:
Σε άλλα νέα η OpenAI ενεργοποίησε το GPT-Live-1 στο API που είχε ανακοινωθεί τον Ιούλιο, ενεργοποιώντας full-dublex voice, δηλαδή πράκτορες που ακούν την ώρα που μιλάνε και συνεχίζουν να δουλεύουν απρόσκοπτα.


Ο market leader σε αυτό είναι η Google, έχει μετά διαφοράς τη καλύτερη κατανόηση φωνής σε πολλές γλώσσες. Νομίζω είχαν βγάλει και το αντίστοιχο API 1-2 χρόνια τώρα.
 
Ο market leader σε αυτό είναι η Google, έχει μετά διαφοράς τη καλύτερη κατανόηση φωνής σε πολλές γλώσσες. Νομίζω είχαν βγάλει και το αντίστοιχο API 1-2 χρόνια τώρα.
Ισχύει προφανώς.
Αυτό που βλέπω είναι ότι η google προς το παρόν έχει ρίξει πετσέτα για το καλύτερο frontier μοντέλο. Όμως με τις συνεχείς αναβαθμίσεις του Flash έχει μάλλον το καλύτερο σχεδόν Instant μοντέλο με το χαμηλότερο κόστος.
Η Anthropic δείχνει ότι δεν μπορεί να ανοίξει βεντάλια και συνεχίζει προσφέροντας το καλύτερο frontier μοντέλο για coding (με υψηλό κόστος) και πάνε γιο-γιο με την OpenAI ανάλογα με ποια εβδομάδα τσεκάρεις και ποιο benchmark δεις για το κατά απόλυτη τιμή καλύτερο μοντέλο.
Τέλος η OpenAI δείχνει ότι θέλει να παίξει σε πολλά ταμπλό. Έχει στη χειρότερη το δεύτερο καλύτερο μοντέλο με ελάχιστη διαφορά από το πρώτο και έχει μεγάλη γκάμα φθηνών μοντέλων. Για κάποιον που έχει το χρόνο και τη γνώση να ψάξει τι μοντέλο χρειάζεται για δεδομένη εφαρμογή έχει και για μικρές εφαρμογές καλύτερο κόστος και από την google. Έχει περάσει τη google στο Image generation, και προσπαθεί τώρα να προσφέρει και φωνή. Νομίζω πως η στρατηγική της είναι να μπορεί να τα προσφέρει όλα. Οι τελευταίες συνεντεύξεις υψηλόβαθμων στελεχών της που έχω δει όλες αναφέρουν σε κάποιο σημείο ότι λείπει εκείνο το μοντέλο που θα μπορεί να καταλαβαίνει το prompt του χρήστη και να διαλέγει το καλύτερο από τα διαθέσιμα μοντέλα. Και νομίζω ότι αυτό για την OpenAI έχει το μεγαλύτερο νόημα με τόσες επιλογές με Astra, Sol, Terra, Luna. Μια μικρομεσαία επιχείρηση μπορεί να πει δεν μας παρατά, θα έχουμε Fable για frontier tasks και gemini flash για τα μικρά και δεν θα πονοκεφαλιάσω για το ποιο από όλα αυτά που έχει η OpenAI έχει τον καλύτερο λόγο κόστους προς ωφέλειας.

Αυτό που δεν γράφουμε στα παραπάνω είναι ότι τα Κινέζικα μοντέλα, με σωστό harness προσφέρουν locally αυτά που χρειάζονται πολλές φορές εφαρμογές που είναι οκ με τα flash / terra / luna με το πλεονέκτημα της εμπιστευτικότητας αν τα τρέχεις locally.


1789198306697.png

1789198353009.png
 
  • Like
Reactions: anderm
Εξαιρετικά σημαντικό για εμένα είναι να χρησιμοποιούμε το σωστό μοντέλο για τη χρήση που μας ενδιαφέρει κάθε φορά.
Η Google έχει μια τεράστια βεντάλια από μοντέλα, από embeded για IoT λύσεις και ρομπότ μέχρι live δημιουργίας video. Το ότι έχουν ανοίξει την βεντάλια περισσότερο από τους πάντες κατέληξε στο να μην έχουν αυτή τη στιγμή frontier LLM.
Είναι σημαντικό, όταν βλέπεις πως σπαταλάς πόρους χωρίς το ανάλογο αποτέλεσμα να επικεντρωθείς εκεί που πραγματικά πρέπει, όπως έκανε η OpenAI με τα Sora και τον browser. Η Anthropic ασχολείται πρακτικά μόνο με τους Business/Enterprise πελάτες, frontier LLM και τίποτα άλλο. Όταν τα χρησιμοποιώ από το Bedrock της δουλειάς για κάτι πιο φιλόδοξο που θέλει αρκετές ώρες, για να μην είναι extreme το κόστος, γράφω στο Fable να σηκώνει Opus/Sonnet sub-agents για τα απλούστερα κομμάτια και κάνει διαφορά.

Screenshot 2026-09-08 200057.png

Ένα πραγματικό use case: Έστω πως θέλει κανείς να κάνει integrate ένα chatbot στο site του που όντως να απαντάει όπως πρέπει και να είναι χρήσιμο, τα Gemini Flash είναι ότι καλύτερο. Άμεσες αποκρίσεις και με ικανοποιητικό Intelligence, καλύτερο από το Terra ή το Sonnet για αυτή τη δουλειά.
 
Θα διαφωνίσω πάντως για το browser και το computer use plugin της OpenAI. Ειδικά το δεύτερο είναι η πρώτη όψη της επόμενης ημέρας. Για τα δικά μου workflow, το πρώτο ήταν το κλειδί γιατί ουσιαστικά με τον browser έχω φτιάξει ένα workflow που χωρίς να του δίνω credentials καθόλου κάνω πλήρως τη δουλειά μου σε κάτι υψηλής σημασίας και επαναλαμβανόμενο τουλάχιστον 3-4 φορές το μήνα, ενώ το computer use είναι πραγματικά απίστευτο όταν αρχίσεις να το χρησιμοποιείς σαν power user. Σίγουρα θέλει προσοχή, και αυτό που έχω κάνει για τα πειράματα που τρέχω είναι να του δίνω άδεια να χρησιμοποιεί μόνο ένα παράθυρο του vmware και στην ουσία να χρησιμοποιεί μόνο το virtual machine εκεί μέσα. Ναι ξέρω, μπορεί να το χακάρει και να βγει από εκεί μέσα, απλά ελπίζω ότι στα εμπορικά προϊόντα κάπως το έχουν μαζέψει το πράγμα και κάνει αυτό που του λες να κάνει και σου λέει ότι κάνει. Ναι είναι αργό σε γενικές γραμμές, αλλά όπως ξέρουμε για το μόνο που μπορούμε να είμαστε σίγουροι είναι για αύξηση της ταχύτητας.

Είναι τρελό να το βλέπεις να μαθαίνει να χρησιμοποιεί ένα λογισμικό που δεν ήξερε διαβάζοντας αρχικά τα manual, παίζοντας με το λογισμικό όπως θα έπαιζε ένας οποιοσδήποτε χρήσης και γενικά το βλέπω είναι πιο συντηριτικό για να μην χαθεί κάτι. Προφανώς έχω backup του εικονικού μηχανήματος (εκτός πρόσβασης γενικά του υπολογιστή), οπότε αν κάνει κάτι χοντρό, πάλι οκ.
 
Το project του browser ήταν παράλληλο με αυτό του computer use.
Το ακύρωσαν εφόσον έκριναν πως δεν υπάρχουν οι εταιρικοί πόροι που απαιτούνται για να διατηρείς έναν browser. Το Sora το ακύρωσαν επειδή το compute που απαιτείται για κάθε interaction είναι ακραίο σε σχέση με το μη-έσοδο που φέρνει.
 
Το project του browser ήταν παράλληλο με αυτό του computer use.
Το ακύρωσαν εφόσον έκριναν πως δεν υπάρχουν οι εταιρικοί πόροι που απαιτούνται για να διατηρείς έναν browser. Το Sora το ακύρωσαν επειδή το compute που απαιτείται για κάθε interaction είναι ακραίο σε σχέση με το μη-έσοδο που φέρνει.
Παρανόηση...κατάλαβα το plugin του browser στο codex...Όχι το κομμένο project του Browser.
Επίσης όλη η ερευνητική ομάδα του Sora δουλεύει στο project “General-purpose world simulators and robotic agents” της OpenAI που κανείς δεν ξέρει τι ακριβώς κάνουν παρά μόνο ότι πάνε προς την κατεύθυνση των world models.
 
Δείτε κάτι εξαιρετικά ενδιαφέρον.
Το 62% της χωρητικότητας των OpenAI+Anthropic πάει στην εκπαίδευση μοντέλων. Πλέον σε συντριπτικό βαθμό στο Reinforcement Learning, το να βελτιώνονται ήδη εκπαιδευμένα μοντέλα δηλαδή. Αυτό που είδαμε φέτος με το να βγαίνει ένα μοντέλο και να έχεις ανά μήνα τα updates του.

Το 38% της χωρητικότητας πάει στο να τρέχουν τα μοντέλα.
Και εδώ είναι το ενδιαφέρον. Ένα μέρος πάει στη δωρεάν χρήση, ένα μέρος στην επιχορήγηση των συνδρομών και τέλος στους χρήστες API που εν τέλει πληρώνουν όλα τα υπόλοιπα. Η OpenAI μπαίνει μέσα πολύ, αλλά η Anthropic είναι οριακά κερδοφόρα. Ένα ~20% της χωρητικότητας δηλαδή βγάζει όλα τα έξοδα.

1789367856903.png
 
Δείτε κάτι εξαιρετικά ενδιαφέρον.
Το 62% της χωρητικότητας των OpenAI+Anthropic πάει στην εκπαίδευση μοντέλων. Πλέον σε συντριπτικό βαθμό στο Reinforcement Learning, το να βελτιώνονται ήδη εκπαιδευμένα μοντέλα δηλαδή. Αυτό που είδαμε φέτος με το να βγαίνει ένα μοντέλο και να έχεις ανά μήνα τα updates του.

Το 38% της χωρητικότητας πάει στο να τρέχουν τα μοντέλα.
Και εδώ είναι το ενδιαφέρον. Ένα μέρος πάει στη δωρεάν χρήση, ένα μέρος στην επιχορήγηση των συνδρομών και τέλος στους χρήστες API που εν τέλει πληρώνουν όλα τα υπόλοιπα. Η OpenAI μπαίνει μέσα πολύ, αλλά η Anthropic είναι οριακά κερδοφόρα. Ένα ~20% της χωρητικότητας δηλαδή βγάζει όλα τα έξοδα.

View attachment 277279
Θεωρώ ότι όλες οι crazy tech εταιρίες, έχουν τόσο πολύ χρήμα για κάψιμο, που είναι απλά χαζομάρα να μην το κάψουν τώρα που μπορούν. Η Anthropic είναι οριακά κερδοφόρα γιατί δεν έχει τα τεράστια project για data center που έχει η OpenAI, οπότε το πλεονέκτημα μπορεί να αντιστραφεί τρομερά εύκολα.

Σε κάθε περίπτωση και εδώ ο Musk δείχνει το δρόμο. Ξοδέψτε σαν να μην υπάρχει μέλλον, δικά σας είναι εξάλλου τα λεφτά; Δεν του βγήκε με το Grok, πήγε αγόρασε την Cursor και σε ελάχιστο καιρό το Grok επανήλθε βασικά λόγω των dataset που διέθεσε η cursor. Μπήκε χρηματηστήριο και οι συμβατικοί επενδυτές αξιολόγησαν τη Starlink κυρίως ως η με σιγουριά πηγή άμεσου εισοδήματος, αλλά ο Musk πήρε αυτά τα λεφτά για να κάνει τον άνθρωπο διαπλανητικό είδος.

Όπως είχε πει και ο Altman πριν από λίγα χρόνια στην ερώτηση ποιο είναι το business model της OpenAI και είχε απαντήσει, όταν φτιάξω AGI θα μου το φτιάξει εκείνη. Είμαι σίγουρος ότι το τσατάρει με μοντέλα που δεν έχουμε οι υπόλοποι, σαν αυτό που πριν λίγες ημέρες απλά έλυσε τις εξισώσεις Navier Stokes σε ένα διάλλειμα από την εκπαίδευσή του...

Στην ίδια λογική και ο Λευκός Οίκος δεν θέλει να μειώσει την ταχύτητα ανάπτυξης στο ΑΙ με ρυθμιστικό πλαίσιο γιατί θέλει να κερδίσει πάσει θησία από το ΑΙ Arms Race με την Κίνα. A, ναι η EPA θα καταργήσει και όλους τους περιβαλλοντικούς κανονισμούς για τους σταθμούς παραγωγής ενέργειας από ότι φαίνεται, για το κάρβουνο κυρίως αλλά όχι μόνο...που φυσικά το κάνει λόγω ΑΙ μην κυνηγάμε τα νέα data center όπως έγινε ο χαμός με το data center του Musk επειδή λέει δεν ήταν αδειοδοτημένοι οι μισοί αεριοστρόβιλοι και κανένας δεν είχε φίλτρα και πέθαναν μερικοί πλεμπαίοι στα γύρω χωριά...

 
Θεωρώ ότι όλες οι crazy tech εταιρίες, έχουν τόσο πολύ χρήμα για κάψιμο, που είναι απλά χαζομάρα να μην το κάψουν τώρα που μπορούν. Η Anthropic είναι οριακά κερδοφόρα γιατί δεν έχει τα τεράστια project για data center που έχει η OpenAI, οπότε το πλεονέκτημα μπορεί να αντιστραφεί τρομερά εύκολα.

Σε κάθε περίπτωση και εδώ ο Musk δείχνει το δρόμο. Ξοδέψτε σαν να μην υπάρχει μέλλον, δικά σας είναι εξάλλου τα λεφτά; Δεν του βγήκε με το Grok, πήγε αγόρασε την Cursor και σε ελάχιστο καιρό το Grok επανήλθε βασικά λόγω των dataset που διέθεσε η cursor. Μπήκε χρηματηστήριο και οι συμβατικοί επενδυτές αξιολόγησαν τη Starlink κυρίως ως η με σιγουριά πηγή άμεσου εισοδήματος, αλλά ο Musk πήρε αυτά τα λεφτά για να κάνει τον άνθρωπο διαπλανητικό είδος.

Οι μόνες εταιρίες που μπορούν να "κάψουν" χρήμα είναι η Google και η Amazon.
Οι υπόλοιπες το χρήμα που καίνε κάποιος το πληρώνει, με μια υποσχετική πως στο IPO θα πάρει τα χρήματα του πίσω πολλαπλάσια.

Το πλεονέκτημα του να βγάζεις λεφτά, συνδέεται πολύ λιγότερο με το διαθέσιμο compute από όσο ίσως νομίζουμε. Η Google για παράδειγμα, το μεγαλύτερο μέρος των token που παράγει τα διαθέτει δωρεάν είτε απευθείας είτε μέσω των διαφόρων άλλων προϊόντων της. Η OpenAI έχει περισσότερο compute από την Anthropic και έχει τα μισά έσοδα. Για να έχεις έσοδα που μπορεί να οδηγήσουν και σε πιθανή κερδοφορία πρέπει να έχεις προϊόν που αυτοί που πληρώνουν να θέλουν να το αγοράσουν.
 

Η ζήτηση για Pro συνδρομές του Astra έχει εκτοξευθεί και η OpenAI διώχνει τους πελάτες λόγω έλλειψης υπολογιστικών υποδομών...

Πάντως το Astra είναι κάτι διαφορετικό, ειδικά στο Pro στο chat πραγματικά ίσως τερματίζει τη λειτουργικότητα ενός chatbot. Στο CODEX το Extra Thinking του Astra βγάζει καλύτερα και γρηγορότερα αποτελέσματα από το Sol 5.6 Extra Thinking.

Φήμες λένε ότι σύντομα θα έχουμε και ChatGPT 6 Sol...το Astra είναι στην ουσία το "Pro" επίπεδο. Δεν ξέρω ακριβώς πως θα διαχειριστεί τα διαθέσιμα προϊόντα της η OpenAI.