Τεχνητή Νοημοσύνη (AI). Τι είναι, τι ξέρουμε, τι αλλάζει στη ζωή και στον πολιτισμό;

  • Αγαπητοί φίλοι και φίλες,

    Σας προσκαλούμε να γιορτάσουμε μαζί τα 20α γενέθλια του AVclub.

    Το Σάββατο 10 Οκτωβρίου, από τις 18:00 θα πραγματοποιήσουμε το πάρτι των γενεθλίων του φόρουμ μας στο Peñarrubia Lounge.

    Δηλώστε τη συμμετοχή σας εδώ, θα χαρούμε πολύ να σας δούμε από κοντά.

Η χρηματηστηριακή φούσκα είναι δεδομένο ότι θα σκάσει κάποια στιγμή. Σε αυτό συμφωνούμε απόλυτα.
Δύο εταιρίες είναι μόνο απίστευτα καλά τοποθετημένες. Η SpaceX και η Google. Οι άλλοι κανείς δεν ξέρει.

Βέβαια θα παίξει τρελό ρόλο αν έχουν γίνει οι IPOs τους ή όχι. Με τις IPOs θα σηκώσουν τρελό χρήμα, που θα είναι πραγματικό χρήμα στα ταμεία τους και λογικά θα μπορέσουν να αντέξουν τη φούσκα. Οι μικρότερες και περιφερειακές εταιρίες νομίζω ότι θα είναι αυτές που θα επηρρεαστούν περισσότερο...
To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Σχετικό βίντεο που λέει με απλά λόγια το πως και γιατί θα σκάσει η φούσκα (όχι φυσικά το πότε :) )
 
Να και κάτι καινούργιο!

Το Jev (από τη TypeSafe AI) αποτελεί μια νέα κλάση μοντελων τεχνητής νοημοσύνης, τα λεγόμενα System One Models, τα οποία είναι σχεδιασμένα να επικοινωνούν απευθείας με λογισμικό και όχι με ανθρώπους μέσω συνομιλίας:
  • Αντί για κείμενο, παράγει αποφάσεις: Το Jev εγκαταλείπει τη σύνθεση φυσικής γλώσσας (chat) και επιστρέφει αποκλειστικά τυποποιημένες, δομημένες τιμές (typed decisions) και πιθανότητες βάσει προκαθορισμένων σχημάτων.
  • Μηδενικές παραισθήσεις και λάθη κειμένου: Χάρη στον αυστηρό περιορισμό των εξόδων του, εξαλείφει πλήρως τα συντακτικά/τυπικά λάθη και τις «παραισθήσεις» (hallucinations), προσφέροντας παράλληλα αξιόπιστα βαθμονομημένα επίπεδα εμπιστοσύνης (calibrated confidence) σε κάθε του απόφαση.
  • Απίστευτη ταχύτητα: Λειτουργεί με παράλληλη δειγματοληψία αντί για τη διαδοχική παραγωγή token των κλασικών LLM, πετυχαίνοντας χρόνους απόκρισης της τάξης των 70–500ms (40 έως 200 φορές ταχύτερα) καθιστώντας το ιδανικό για αυτοματισμούς πραγματικού χρόνου.
  • Απίστευτα χαμηλό κόστος: Το κόστος εισόδου (Input Tokens) είναι μόλις $0.042 ανά εκατομμύριο tokens (περίπου 42 δολάρια ανά δισεκατομμύριο). Αυτό είναι περίπου 50 έως 100 φορές φθηνότερο από τα κορυφαία παραδοσιακά μοντέλα. Το κόστος εξόδου (Output Tokens) είναι τόσο χαμηλό πουη εταιρία χρεώνει $0. Το κόστος ανά απόφαση/περίπτωση διαμορφώνεται περίπου στα $0.0004, γεγονός που καθιστά για πρώτη φορά οικονομικά βιώσιμη την εκτέλεση ελέγχων ή αποφάσεων AI σε κάθε ξεχωριστή σειρά δεδομένων ενός τεράστιου dataset, κάτι που στα κλασικά LLM θα ήταν απαγορευτικά ακριβό. Σε stress tests σε πραγματικό χρόνο (όπως η εκτέλεση πράκτορα σε σύνθετα περιβάλλοντα με 10 κλήσεις ανά δευτερόλεπτο), το λειτουργικό κόστος διατηρήθηκε σε επίπεδα της τάξης των $7 ανά ώρα.

Όποιος θέλει να μάθει παραπάνω:
To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Και αν θέλει περισσότερα τεχνικά στοιχεία:
To view this content we will need your consent to set third party cookies.
For more detailed information, see our cookies page.

Υ.Γ. Θέλω να δω πότε θα βγάλουν οι Κινέζοι ένα open source...θα ήθελα να το βάλω στο Harness μου να διαλέγει εύκολα ποιο μοντέλο LLM να φορτώνει...
 

“Καμπανάκι” από τη Microsoft για το ΑΙ – “Μπορεί να δημιουργήσει ένα νέο είδος”​

1789718268320.png
Ο επικεφαλής του τμήματος τεχνητής νοημοσύνης της Microsoft, Μουσταφά Σουλεϊμάν, προειδοποίησε ότι, χωρίς επαρκείς δικλίδες ασφαλείας, η ανάπτυξη της τεχνητής νοημοσύνης θα μπορούσε να οδηγήσει στην εμφάνιση ενός νέου «είδους από πυρίτιο», το οποίο θα ανταγωνίζεται τον άνθρωπο.

Ο Σουλεϊμάν υποστήριξε ότι η ανταγωνίστρια εταιρεία Anthropic αντιμετωπίζει την τεχνητή νοημοσύνη σαν να είναι ανθρώπινη, χαρακτηρίζοντας αυτή την προσέγγιση «λανθασμένη» και προειδοποιώντας ότι θα μπορούσε να οδηγήσει στη δημιουργία τεχνολογίας την οποία η ανθρωπότητα δεν θα είναι σε θέση να ελέγξει.

Περισσότερα εδώ
 
Επόμενο Major release σήμερα για το Opus.
Το πρώτο στη γενιά μοντέλων 5.5, με υψηλότερες επιδόσεις από τα Fable και Astra στα περισσότερα tasks.
Θα το δοκιμάσω από αύριο και θα επανέλθω.


1790096153320.png

1790095493002.png

1790095657067.png 1790095665756.png
 
Σήμερα βγήκαν και τα GPT 6 Sol, 6 Luna.
Με 50% λιγότερο κόστος σε σχέση με τα 5.6
Και η Anthropic έριξε το κόστος του Opus 5.5 κατά 20% σε σχέση με το προηγούμενο μοντέλο.

Εκ πρώτης όψεως, το Sol που είναι το αντίστοιχο με το Opus δεν δείχνει κάποια δραματική βελτίωση σε σχέση με το προηγούμενο. Σίγουρα είναι αρκετά κάτω από το Astra.

1790108069688.png

1790108329792.png

1790108352100.png

Έβαλα όλα τα Benchmarks όπως τα συνθέτει η artificial analysis. Στο site της OpenAI φυσικά έχει ορισμένα επιλεγμένα, τα οποία -να με συγχωρούν, πέραν του ότι δεν συγκρίνουν με τα τελευταία μοντέλα, βγάζουν άλλα αντί άλλων αποτελέσματα. Παράδειγμα:

1790108770348.png

Εδώ το 5.6 Sol έχει καλύτερες επιδόσεις σε σχέση με το 6 Sol και ίδια απόδοση έχει και το 6 Luna. Πράγματα οριακά κωμικά.
Θα το διαβάσει κανείς και θα νομίζει πως το Fable και το Astra θα βγάλουν το ίδιο αποτέλεσμα +- 5% με το Luna.