--:--
Νέο μοντέλο τεχνητής νοημοσύνης φέρνει agents απευθείας σε κάθε συσκευή

Photo: I'M ZION / Unsplash

AI

Νέο μοντέλο τεχνητής νοημοσύνης φέρνει agents απευθείας σε κάθε συσκευή

Το LFM2.5-2.6B της Liquid AI στοχεύει σε τοπική εκτέλεση, εργαλεία και πολυβήματες ροές χωρίς cloud εξάρτηση.

12 Αυγούστου 2026

Το LFM2.5-2.6B της Liquid AI σχεδιάστηκε για να τρέχει πλήρως στη συσκευή και να υποστηρίζει tool calling και πολυβήματες ροές. Η εταιρεία αναφέρει ότι μπορεί να χρησιμοποιηθεί σε laptops και phones, χωρίς cloud inference bill.

Κύρια στοιχεία του LFM2.5-2.6B
2,6δισ.
Παράμετροι μοντέλου
34τρισ.
Tokens προ-εκπαίδευσης
128K θέσεις
Context window
4έως και φορές μικρότερο
Μέγεθος σε σχέση με μεγαλύτερα μοντέλα
Γραφικό βασισμένο στα στοιχεία του άρθρουAION Newsroom

Το LFM2.5-2.6B της Liquid AI σχεδιάστηκε για να τροφοδοτεί ικανoύς agents αποκλειστικά on-device, με υποστήριξη για tool calling και πολυβήματες ροές εργασίας. Σύμφωνα με την εταιρεία, το μοντέλο παραμένει αρκετά μικρό και γρήγορο για καθημερινό hardware, από laptops έως phones.

Τι λέει η Liquid AI για το LFM2.5-2.6B;

Η Liquid AI αναφέρει ότι το μοντέλο δίνει τη δυνατότητα στους developers να αναπτύσσουν agents παντού, να κρατούν τα δεδομένα στη συσκευή και να αποφεύγουν το κόστος inference στο cloud.

Στο υλικό της παρουσιάζει επίσης τον τρόπο με τον οποίο το μοντέλο χτίστηκε ως αξιόπιστο agentic model για edge devices.

Πώς εκπαιδεύτηκε το μοντέλο;

Το LFM2.5-2.6B είναι pre-trained σε περίπου 34T tokens. Στη μέση της εκπαίδευσης, η Liquid AI αναφέρει ότι επεκτείνει το context window στις 128K θέσεις.

Στη συνέχεια, το post-training μετατρέπει το βασικό μοντέλο σε agent σε τέσσερα στάδια.

  • Το Agentic RL pipeline χωρίζει βελτιστοποίηση μοντέλου, inference και εκτέλεση περιβάλλοντος σε ξεχωριστά μέρη.
  • Το Training Engine βελτιστοποιεί το μοντέλο.
  • Το Rollout Engine παράγει ενέργειες με βάση την τελευταία policy.
  • Το RL framework οργανώνει τον βρόχο εκπαίδευσης, συλλέγοντας trajectories και rewards και ενημερώνοντας το μοντέλο.

Οι ενέργειες εκτελούνται μέσα σε Sandbox Service, όπου το Blackbox Harness φιλοξενεί τον agent και συντονίζει τις αλληλεπιδράσεις με το task environment. Το Harness Proxy επιτρέπει τη χρήση agentic harnesses ως black boxes χωρίς τροποποιήσεις, ενώ καταγράφει τα token-level trajectories που χρειάζονται για ανακατασκευή και επιβεβαίωση των RL training samples.

Πού ξεχωρίζει στα benchmarks;

Η Liquid AI λέει ότι το LFM2.5-2.6B συγκρίθηκε με μοντέλα έως και περίπου 4 φορές μεγαλύτερα σε STEM, instruction following, tool use και agentic tasks. Παρότι είναι το μικρότερο μοντέλο της ομάδας, εμφανίζεται ανταγωνιστικό και συχνά καλύτερο από τα υπόλοιπα.

Η εταιρεία ξεχωρίζει ως δυνατά σημεία το instruction following και το tool use. Αναφέρει ότι το μοντέλο βρίσκεται στην κορυφή σε κάθε benchmark instruction-following που παραθέτει και σε κάθε benchmark tool-use, εκτός από το BFCLv4, όπου προηγείται μόνο το Qwen 9.7B.

Στα agentic tasks, σύμφωνα με το υλικό, υπερτερεί των δύο Gemma μοντέλων και ισοβαθμεί με τα Qwen. Επίσης προηγείται στο knowledge και παραμένει κοντά στο math. Στο coding, ωστόσο, τα μεγαλύτερα μοντέλα διατηρούν καθαρό προβάδισμα.

Τι αναφέρει για την ταχύτητα σε CPU και GPU;

Το LFM2.5-2.6B συνοδεύεται από υποστήριξη πρώτης ημέρας σε όλο το inference οικοσύστημα, με αναφορές σε llama.cpp, MLX, vLLM, SGLang και ONNX.

  • Σε CPU inference, η Liquid AI το περιγράφει ως το ταχύτερο μοντέλο που δοκίμασε.
  • Αναφέρει decode speed 220 tokens/s σε M5 Max.
  • Αναφέρει 113 tokens/s σε Ryzen AI Max+ 395.
  • Σε 30 tokens/s, λέει ότι επιτρέπει την εκτέλεση ικανών agents ακόμη και σε τηλέφωνο.

Στο GPU inference, η εταιρεία το περιγράφει ως το ταχύτερο μοντέλο στην κατηγορία μεγέθους του, με σχεδόν 15K output tokens ανά δευτερόλεπτο σε υψηλό concurrency και περίπου 1,3 δισ. tokens την ημέρα σε έναν μόνο H100.

Τι κρατά κανείς από την παρουσίαση του μοντέλου;

Το LFM2.5-2.6B προβάλλεται ως ένα μικρότερο μοντέλο που μπορεί να τρέχει on-device, να υποστηρίζει εργαλεία και πολυβήματες εργασίες και να αξιοποιείται σε laptops, phones και edge συσκευές. Η Liquid AI συνδέει την προσέγγιση αυτή με τοπική διατήρηση των δεδομένων και χρήση χωρίς cloud inference bill.

Πηγή:huggingface.co

Πώς σου φάνηκε το άρθρο;

#τεχνητή νοημοσύνη#on-device#agents
Κοινοποίησηf𝕏WV

? Συχνές Ερωτήσεις

Τι είναι το LFM2.5-2.6B;

Είναι ένα μοντέλο της Liquid AI που, σύμφωνα με την εταιρεία, έχει σχεδιαστεί για να τροφοδοτεί ικανoύς agents αποκλειστικά on-device.

Σε ποιες συσκευές μπορεί να τρέξει;

Η Liquid AI αναφέρει ότι μπορεί να χρησιμοποιηθεί σε laptops, phones και άλλες edge συσκευές.

Τι υποστηρίζει το LFM2.5-2.6B;

Σύμφωνα με το υλικό, υποστηρίζει tool calling και πολυβήματες ροές εργασίας.

Σχετικά Άρθρα

Η νέα δυνατότητα του Claude AI προτρέπει τους χρήστες για λιγότερη εξάρτηση

Η νέα δυνατότητα του Claude AI προτρέπει τους χρήστες για λιγότερη εξάρτηση

Η κυριαρχία των κορυφαίων AI μοντέλων συρρικνώνεται: από τον έναν χρόνο του GPT-4 στις επτά εβδομάδες

Η κυριαρχία των κορυφαίων AI μοντέλων συρρικνώνεται: από τον έναν χρόνο του GPT-4 στις επτά εβδομάδες

Νέα τοποθέτηση Huang για τα κινεζικά AI μοντέλα: Τι είπε

Νέα τοποθέτηση Huang για τα κινεζικά AI μοντέλα: Τι είπε

Αποκλειστικό: Tencent προχωρά στην εξαγορά ποσοστού πλειοψηφίας στην Manus

Αποκλειστικό: Tencent προχωρά στην εξαγορά ποσοστού πλειοψηφίας στην Manus

Ινδός τεχνολογικός μεγιστάνας επενδύει 30 εκατ. δολάρια για να χτίσει AI αντίπαλο του Microsoft Office

Ινδός τεχνολογικός μεγιστάνας επενδύει 30 εκατ. δολάρια για να χτίσει AI αντίπαλο του Microsoft Office

Νέο Fugu Ultra v1.1: Η Sakana AI μιλά για άνοδο έως 7,9 μονάδων

Νέο Fugu Ultra v1.1: Η Sakana AI μιλά για άνοδο έως 7,9 μονάδων

Η υιοθέτηση του ChatGPT επιταχύνεται: από εργαλείο πειραματισμού σε καθημερινή ψηφιακή υποδομή

Η υιοθέτηση του ChatGPT επιταχύνεται: από εργαλείο πειραματισμού σε καθημερινή ψηφιακή υποδομή

Η Meta λανσάρει διακριτικά το Pocket, μια νέα gaming εφαρμογή με έντονο άρωμα AI

Η Meta λανσάρει διακριτικά το Pocket, μια νέα gaming εφαρμογή με έντονο άρωμα AI

Αποκλειστική παράταση για το Claude Fable 5 έως τις 19 Ιουλίου 2026

Αποκλειστική παράταση για το Claude Fable 5 έως τις 19 Ιουλίου 2026

Η κυβέρνηση Τραμπ αίρει τους περιορισμούς στα μοντέλα Mythos και Fable της Anthropic

Η κυβέρνηση Τραμπ αίρει τους περιορισμούς στα μοντέλα Mythos και Fable της Anthropic

Αποκλειστικό: Η ανατροπή από την Meta με το Muse Spark 1.1

Αποκλειστικό: Η ανατροπή από την Meta με το Muse Spark 1.1

Ο Άστον Κούτσερ αποχωρεί από τη Sound Ventures και λανσάρει νέο VC fund με τη Morgan Beller

Ο Άστον Κούτσερ αποχωρεί από τη Sound Ventures και λανσάρει νέο VC fund με τη Morgan Beller

Η Listen Labs αντλεί 69 εκατ. δολάρια μετά το viral billboard stunt και επενδύει στην κλιμάκωση των AI customer interviews

Η Listen Labs αντλεί 69 εκατ. δολάρια μετά το viral billboard stunt και επενδύει στην κλιμάκωση των AI customer interviews

Σημαντικό βήμα της Κίνας για διεθνή συνεργασία στην τεχνητή νοημοσύνη

Σημαντικό βήμα της Κίνας για διεθνή συνεργασία στην τεχνητή νοημοσύνη

Νέα εργαλεία AI για developers: Nano Banana 2 Lite και Gemini Omni Flash στο προσκήνιο

Νέα εργαλεία AI για developers: Nano Banana 2 Lite και Gemini Omni Flash στο προσκήνιο