Τεχνητή Νοημοσύνη – Νέα & Εργαλεία | Greek AI Network

Greek AI Network

  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI
No Result
View All Result
Τεχνητή Νοημοσύνη – Νέα & Εργαλεία | Greek AI Network
  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI
No Result
View All Result
Τεχνητή Νοημοσύνη – Νέα & Εργαλεία | Greek AI Network

Greek AI Network

No Result
View All Result
Home Νέα

Τεστ AI από Databricks & Perplexity δείχνει την ωμή αλήθεια

by Theodoros Kostogiannis
27 Ιουλίου, 2025
in Νέα
0
Το K Prize είναι ένας νέος διαγωνισμός προγραμματισμού με Τεχνητή Νοημοσύνη που διοργανώνεται από το Laude Institute, με υποστήριξη του συνιδρυτή των Databricks και Perplexity, Andy Konwinski. Ο πρώτος νικητής, Eduardo Rocha de Andrade, κέρδισε $50.000 με μόλις 7,5% σωστές απαντήσεις, γεγονός που υπογραμμίζει τη δυσκολία του τεστ.
Share on FacebookShare on Twitter

Μια νέα πρόκληση κωδικοποίησης με AI αποκαλύπτει τα πρώτα της αποτελέσματα και δεν είναι εντυπωσιακά

Μια πρόσφατη πρόκληση κωδικοποίησης με τη χρήση τεχνητής νοημοσύνης αποκάλυψε τον πρώτο της νικητή και έθεσε ένα νέο επίπεδο για τους μηχανικούς λογισμικού που βασίζονται σε AI. Η Laude Institute, ένας μη κερδοσκοπικός οργανισμός, ανακοίνωσε τον νικητή του K Prize, ενός πολυεπίπεδου διαγωνισμού κωδικοποίησης AI που ξεκίνησε από τον Andy Konwinski, συνιδρυτή των Databricks και Perplexity. Ο νικητής ήταν ο Eduardo Rocha de Andrade, ένας Βραζιλιάνος ειδικός σε prompts, ο οποίος θα λάβει $50,000 ως βραβείο. Ωστόσο, το πιο εντυπωσιακό δεν ήταν η νίκη του, αλλά η τελική του βαθμολογία: κέρδισε με σωστές απαντήσεις σε μόλις 7,5% των ερωτήσεων της δοκιμής.

Ο Konwinski εξέφρασε την ικανοποίησή του για τη δημιουργία ενός δύσκολου σημείου αναφοράς, υπογραμμίζοντας ότι τα σημεία αναφοράς πρέπει να είναι απαιτητικά για να έχουν σημασία. Ανέφερε επίσης ότι τα αποτελέσματα θα ήταν διαφορετικά αν τα μεγάλα εργαστήρια είχαν συμμετάσχει με τα μεγαλύτερα μοντέλα τους. Το K Prize διεξάγεται εκτός σύνδεσης με περιορισμένη υπολογιστική ισχύ, ευνοώντας τα μικρότερα και ανοιχτά μοντέλα, κάτι που θεωρεί θετικό, καθώς εξισώνει το πεδίο ανταγωνισμού.

Η πρόκληση του K Prize και η σημασία της για την τεχνητή νοημοσύνη

Ο Konwinski έχει υποσχεθεί $1 εκατομμύριο στο πρώτο μοντέλο ανοιχτού κώδικα που θα καταφέρει να πετύχει πάνω από 90% στη δοκιμή. Το K Prize δοκιμάζει μοντέλα σε ζητήματα που έχουν επισημανθεί από το GitHub, ως μέσο αξιολόγησης της ικανότητας των μοντέλων να αντιμετωπίζουν πραγματικά προβλήματα προγραμματισμού. Σε αντίθεση με το γνωστό σύστημα SWE-Bench, το οποίο βασίζεται σε ένα σταθερό σύνολο προβλημάτων που μπορούν να εκπαιδευτούν τα μοντέλα, το K Prize σχεδιάστηκε ως μια “καθαρή” εκδοχή του SWE-Bench, χρησιμοποιώντας ένα σύστημα εισόδου με χρονικό περιορισμό για να αποτρέψει την εκπαίδευση με βάση συγκεκριμένα σημεία αναφοράς.

Για τον πρώτο γύρο, τα μοντέλα έπρεπε να υποβληθούν μέχρι τις 12 Μαρτίου. Οι διοργανωτές του K Prize δημιούργησαν τη δοκιμή χρησιμοποιώντας μόνο ζητήματα από το GitHub που επισημάνθηκαν μετά από αυτή την ημερομηνία. Η κορυφαία βαθμολογία του 7,5% έρχεται σε έντονη αντίθεση με το ίδιο το SWE-Bench, το οποίο επί του παρόντος δείχνει μια κορυφαία βαθμολογία 75% στη πιο εύκολη δοκιμή ‘Verified’ και 34% στη πιο δύσκολη δοκιμή ‘Full’.

Αναζητώντας την αλήθεια πίσω από τις διαφορές στις βαθμολογίες

Ο Konwinski δεν είναι βέβαιος αν η διαφορά οφείλεται σε μόλυνση στο SWE-Bench ή απλώς στην πρόκληση της συλλογής νέων ζητημάτων από το GitHub, αλλά αναμένει ότι το έργο K Prize θα απαντήσει σύντομα στο ερώτημα. Καθώς θα υπάρξουν περισσότερες εκτελέσεις της διαδικασίας, θα αποκτηθεί καλύτερη κατανόηση, καθώς αναμένεται οι συμμετέχοντες να προσαρμοστούν στη δυναμική του διαγωνισμού που διεξάγεται κάθε λίγους μήνες.

Παρά το γεγονός ότι υπάρχουν ήδη διαθέσιμα πολλά εργαλεία κωδικοποίησης AI, πολλοί κριτικοί βλέπουν έργα όπως το K Prize ως ένα απαραίτητο βήμα προς την επίλυση του αυξανόμενου προβλήματος αξιολόγησης της τεχνητής νοημοσύνης. Ο ερευνητής του Princeton, Sayash Kapoor, υποστηρίζει την ανάπτυξη νέων δοκιμών για υπάρχοντα σημεία αναφοράς, επισημαίνοντας ότι χωρίς τέτοιου είδους πειράματα, δεν μπορούμε να διαπιστώσουμε αν το ζήτημα είναι μόλυνση ή απλώς στόχευση του πίνακα κατάταξης του SWE-Bench με ανθρώπινη παρέμβαση.

Μια πρόκληση για τη βιομηχανία και την εξέλιξη της τεχνητής νοημοσύνης

Για τον Konwinski, το K Prize δεν είναι μόνο ένα καλύτερο σημείο αναφοράς, αλλά και μια ανοιχτή πρόκληση για την υπόλοιπη βιομηχανία. Αν ακούσει κανείς τη διαφήμιση, θα έπρεπε να βλέπουμε AI γιατρούς, AI δικηγόρους και AI μηχανικούς λογισμικού, αλλά αυτό δεν ισχύει. Αν δεν μπορούμε να πετύχουμε πάνω από 10% σε μια καθαρή εκδοχή του SWE-Bench, αυτό είναι ένα πραγματικό σημείο αναφοράς για τον ίδιο.

Αυτή η πρόκληση υπογραμμίζει την ανάγκη για πιο αυστηρά και ακριβή σημεία αναφοράς στην αξιολόγηση της τεχνητής νοημοσύνης. Καθώς η τεχνολογία συνεχίζει να εξελίσσεται, είναι κρίσιμο να διασφαλίσουμε ότι οι αξιολογήσεις είναι ρεαλιστικές και αντικατοπτρίζουν την πραγματική ικανότητα των μοντέλων AI να επιλύουν προβλήματα.

Συμπεράσματα και προοπτικές για το μέλλον της τεχνητής νοημοσύνης

Συνοψίζοντας, το K Prize προσφέρει μια νέα προοπτική στην αξιολόγηση των δυνατοτήτων της τεχνητής νοημοσύνης. Η πρόκληση αυτή δεν είναι μόνο μια δοκιμασία για τους συμμετέχοντες, αλλά και μια ευκαιρία για τη βιομηχανία να επανεξετάσει τα πρότυπα και τις μεθόδους αξιολόγησης. Με την πάροδο του χρόνου, τέτοιες πρωτοβουλίες μπορούν να οδηγήσουν σε πιο αξιόπιστες και ακριβείς μετρήσεις για την απόδοση των μοντέλων AI, ενισχύοντας την εμπιστοσύνη και την αξιοπιστία της τεχνολογίας αυτής.

Tags: AI NewsPerplexity

ΣΧΕΤΙΚΑ ΑΡΘΡΑ

Η TypeSafe AI βγαίνει από τη φάση stealth και παρουσιάζει το Jev, ένα νέο μοντέλο τεχνητής νοημοσύνης που έχει σχεδιαστεί όχι για συνομιλίες, αλλά για γρήγορη και δομημένη λήψη αποφάσεων μέσα σε εφαρμογές λογισμικού. Πίσω από την εταιρεία βρίσκεται ο Diogo Almeida, πρώην στέλεχος της OpenAI και ένας από τους συνδημιουργούς του ChatGPT. Η ομάδα της TypeSafe εργάστηκε για περίπου δύο χρόνια πάνω στο Jev, επιχειρώντας να αντιμετωπίσει ορισμένους από τους περιορισμούς που εμφανίζουν τα παραδοσιακά Large Language Models όταν χρησιμοποιούνται για αυτοματοποίηση.
Νέα

Η TypeSafe λανσάρει το Jev για προγραμματιστική λογική

by Theodoros Kostogiannis
18 Σεπτεμβρίου, 2026
Η Pony.ai αποκάλυψε τη νέα γενιά του αυτόνομου ηλεκτρικού της φορτηγού, ενισχύοντας την παρουσία της στον τομέα των εμπορευματικών μεταφορών χωρίς οδηγό. Το T9 Robotruck, που αναπτύχθηκε από κοινού με την GAC Commercial Vehicle, υποστηρίζει αυτόνομη οδήγηση Level 4 και προορίζεται κυρίως για μεταφορές μεγάλων αποστάσεων και εφαρμογές logistics.
Νέα

Η Pony.ai παρουσιάζει αυτόνομο ηλεκτρικό φορτηγό για logistics

by Theodoros Kostogiannis
17 Σεπτεμβρίου, 2026
Η AI αναδιαμορφώνει την αγορά εργασίας στην Ιρλανδία
Νέα

AI και εργασία στην Ιρλανδία: τι δείχνει νέα έρευνα

by Kyriakos Koutsourelis
17 Σεπτεμβρίου, 2026
Google: Επένδυση 13 δισ. ευρώ στη Φινλανδία για AI data centers και ενέργεια
Νέα

Google: Επένδυση 13 δισ. ευρώ στη Φινλανδία για AI data centers και ενέργεια

by Kyriakos Koutsourelis
16 Σεπτεμβρίου, 2026
Η Microsoft AI επιχειρεί να θέσει σαφή όρια στο πόση αυτονομία μπορούν να αποκτήσουν τα προηγμένα συστήματα τεχνητής νοημοσύνης, παρουσιάζοντας το προσχέδιο του Humanist AI Code of Conduct. Το νέο πλαίσιο περιγράφει τους κανόνες που θα πρέπει να ακολουθούν τα μοντέλα AI της εταιρείας κατά την εκπαίδευση και τη λειτουργία τους. Κεντρική αρχή είναι ότι ο άνθρωπος πρέπει να διατηρεί πάντοτε τον τελικό έλεγχο. Ένα μοντέλο θα πρέπει ακόμη και να αποτυγχάνει στην εκτέλεση μιας εργασίας, εφόσον η ολοκλήρωσή της προϋποθέτει ουσιαστική παραβίαση των κανόνων ασφαλείας.
Νέα

Η Microsoft βάζει «κόκκινες γραμμές» στην αυτονομία της AI

by Theodoros Kostogiannis
15 Σεπτεμβρίου, 2026
Το άρθρο εξετάζει την αυξανόμενη ανησυχία γύρω από την ταχύτατη ανάπτυξη της Τεχνητής Νοημοσύνης (AI) και τις εκκλήσεις κορυφαίων στελεχών του κλάδου για επιβράδυνση. Προσωπικότητες όπως οι Dario Amodei (Anthropic), Sam Altman (OpenAI) και Elon Musk εκφράζουν προβληματισμό για τους πιθανούς κινδύνους των ολοένα ισχυρότερων μοντέλων AI.
Νέα

Οι ηγέτες της AI ζητούν επιβράδυνση, αλλά ποιος θα κάνει την αρχή;

by Theodoros Kostogiannis
14 Σεπτεμβρίου, 2026
Νέο εθνικό πρότυπο για την ασφαλή χρήση της AI στα σχολεία
Νέα

AI στα σχολεία: νέο πρότυπο για ασφάλεια και ιδιωτικότητα

by Kyriakos Koutsourelis
14 Σεπτεμβρίου, 2026
Το Aura 1.0 της Ramen αυτοματοποιεί το playtesting και το game development σε Unity και Unreal Engine με τη βοήθεια AI agents και των μοντέλων Claude της Anthropic.
Νέα

Η Ramen φέρνει AI agent για αυτοματοποιημένο game testing

by Theodoros Kostogiannis
13 Σεπτεμβρίου, 2026
Η NVIDIA χρησιμοποιεί Palantir Foundry, cuOpt και Nemotron 3.5 Lightning για βελτιστοποίηση και αυτοματοποίηση της εφοδιαστικής αλυσίδας παραγωγής AI hardware.
Νέα

Palantir και cuOpt βελτιστοποιούν την παραγωγή της NVIDIA

by Theodoros Kostogiannis
12 Σεπτεμβρίου, 2026
Next Post
Η Intel προχωρά σε σημαντικές περικοπές και καθυστερήσεις στα επενδυτικά της σχέδια για την παραγωγή chips, στο πλαίσιο της στρατηγικής του νέου CEO Lip-Bu Tan για μείωση των αναποτελεσματικοτήτων και εξορθολογισμό της λειτουργίας της εταιρείας. Ακυρώνονται έργα σε Γερμανία και Πολωνία, ενοποιούνται οι δραστηριότητες δοκιμών σε Βιετνάμ και Μαλαισία, ενώ καθυστερεί περαιτέρω και το μεγάλο εργοστάσιο στο Οχάιο. Η Intel μειώνει επίσης το προσωπικό της κατά περίπου 15% και έχει ήδη εξαλείψει το 50% των διοικητικών επιπέδων. Στόχος είναι μια πιο ευέλικτη και αποδοτική δομή, βασισμένη σε ρεαλιστική ζήτηση και συγκεκριμένα ορόσημα.

Η Intel ακυρώνει εργοστάσια σε Γερμανία και Πολωνία

Η AWS παρουσιάζει το AgentCore για ασφαλείς AI πράκτορες

Η AWS παρουσιάζει το AgentCore για ασφαλείς AI πράκτορες

Νέες Δεξιότητες στην Εποχή της Τεχνητής Νοημοσύνης

Νέες Δεξιότητες στην Εποχή της Τεχνητής Νοημοσύνης

Πρόσφατα Άρθρα

Microsoft Discovery και προσαρμοστική AI στην επιστημονική έρευνα

Microsoft Discovery και προσαρμοστική AI στην έρευνα

19 Σεπτεμβρίου, 2026
Η TypeSafe AI βγαίνει από τη φάση stealth και παρουσιάζει το Jev, ένα νέο μοντέλο τεχνητής νοημοσύνης που έχει σχεδιαστεί όχι για συνομιλίες, αλλά για γρήγορη και δομημένη λήψη αποφάσεων μέσα σε εφαρμογές λογισμικού. Πίσω από την εταιρεία βρίσκεται ο Diogo Almeida, πρώην στέλεχος της OpenAI και ένας από τους συνδημιουργούς του ChatGPT. Η ομάδα της TypeSafe εργάστηκε για περίπου δύο χρόνια πάνω στο Jev, επιχειρώντας να αντιμετωπίσει ορισμένους από τους περιορισμούς που εμφανίζουν τα παραδοσιακά Large Language Models όταν χρησιμοποιούνται για αυτοματοποίηση.

Η TypeSafe λανσάρει το Jev για προγραμματιστική λογική

18 Σεπτεμβρίου, 2026
Η AWS δίνει δωρεάν πρόσβαση στο Kiro σε εκατομμύρια φοιτητές

AWS: δωρεάν πρόσβαση στο Kiro για φοιτητές 132 ΑΕΙ

18 Σεπτεμβρίου, 2026

Ετικέτες

Adobe AI Agents AI News AI Tools AI Ρομποτική AI στην καθημερινότητα Alibaba Amazon AMD Anthropic Apple AWS Azure AI Chatbot ChatGPT Claude Copilot Deepmind DeepSeek Gemini GenAI Google Grok Huggingface IBM Intel Llama Machine Learning Meta Microsoft Mistral Nvidia OpenAI Oracle Perplexity Physical AI Samsung xAI Εκπαίδευση Επιχειρήσεις Ευρωπαϊκή Ένωση Ηνωμένες Πολιτείες Αμερικής Κίνα Μέσα Κοινωνικής Δικτύωσης Υγεία

Μενού

  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI
  • Σχετικά με εμάς
  • Βασικές έννοιες
  • Όροι Χρήσης
  • Ιδιωτικότητα

© 2024 Gain - Greek AI Network, all rights reserved.

No Result
View All Result
  • Αρχική
  • Νέα
  • Εργαλεία AI
    • Για Βίντεο
    • Για Εικόνα
    • Για Εκπαιδευτικούς
    • Για Εξειδικευμένες Εφαρμογές
    • Για Ήχο
    • Για Κείμενο
  • Εφαρμογές AI
  • Βασικές έννοιες
  • Εκπαιδευτικά Προγράμματα
    • Δωρεάν σεμινάρια AI
    • Κατάρτηση AI

© 2024 Gain - Greek AI Network, all rights reserved.