ოთხ, 16 სექ, 2026
ახალი ინტერაქტიული ქვიზები დაემატა საიტს — შეამოწმე შენი ცოდნა. ნახვა →
ინდუსტრიის სიახლეები

4500 დოლარი და 44 საათი: X-ის მომხმარებელი ამტკიცებს, რომ GPT-6 Astra-მ Factorio დახურა

ხელოვნური ინტელექტის განვითარების ინდუსტრიაში ვიდეოთამაშები ტრადიციულად მნიშვნელოვან სატესტო პოლიგონს წარმოადგენს. ჭადრაკისა და Go-ს წარმატებით დაძლევის შემდეგ, დეველოპერები და მკვლევარები მუდმივად ეძებენ ბევრად...

ხელოვნური ინტელექტის განვითარების ინდუსტრიაში ვიდეოთამაშები ტრადიციულად მნიშვნელოვან სატესტო პოლიგონს წარმოადგენს. ჭადრაკისა და Go-ს წარმატებით დაძლევის შემდეგ, დეველოპერები და მკვლევარები მუდმივად ეძებენ ბევრად უფრო რთულ, მრავალშრიან და დინამიკურ გარემოს. ამ კუთხით განსაკუთრებული ყურადღების ცენტრშია ლოჯისტიკური სიმულატორი Factorio. ეს არის თამაში, სადაც მოთამაშეს უწევს ურთულესი საწარმოო ქსელების მართვა, რესურსების მოპოვება და მასშტაბური ქარხნების ოპტიმიზაცია. მასში წარმატების მისაღწევად საჭიროა არა მხოლოდ სწრაფი რეაქცია, არამედ გრძელვადიანი დაგეგმვა და სტრატეგიული აზროვნება. სწორედ ამიტომ, ნებისმიერი ცნობა იმის შესახებ, რომ ხელოვნურმა ინტელექტმა ეს თამაში დაასრულა, დიდ ინტერესს იწვევს. ბოლო დღეებში სოციალურ ქსელებში გავრცელდა განცხადება, რომლის მიხედვითაც ახალმა მოდელმა ეს შეძლო, თუმცა ეს ინფორმაცია ოფიციალურად დადასტურებული არ არის და მხოლოდ ერთი პიროვნების დაკვირვებას ეყრდნობა.

ამბის მთავარი წყაროა სოციალური ქსელის X-ის მომხმარებელი, ზუსტი სახელით @_Mira___Mira_. მნიშვნელოვანია, თავიდანვე მკაფიოდ გავუსვათ ხაზი იმ ფაქტს, რომ ეს მხოლოდ ამ კონკრეტული მომხმარებლის მტკიცებაა და არავითარ შემთხვევაში არ წარმოადგენს OpenAI-ის ოფიციალურ განცხადებას ან პრესრელიზს. Mira-ს პოსტის თანახმად, ხელოვნურმა ინტელექტმა შეძლო თამაშის სტანდარტული, ანუ ვანილა ვერსიის ბოლომდე გავლა და გამარჯვების ტრადიციული პირობის შესრულება, რაც კოსმოსური რაკეტის წარმატებით აშენებასა და გაშვებას გულისხმობს. აღსანიშნავია, რომ ეს მიღწევა ეხება საბაზისო თამაშს და არა ახალ Space Age დამატებას. გარდა ამისა, ექსპერიმენტი არ მიმდინარეობდა გამარტივებულ ან მშვიდობიან რეჟიმში. თამაშში სრულად იყო ჩართული მტრების, ანუ biters-ის ფუნქცია. ეს ფაქტორი რადიკალურად ცვლის თამაშის სირთულესა და დინამიკას. მოდელს უწევდა არა მხოლოდ ქარხნის ლოჯისტიკის ოპტიმიზაცია და რესურსების შეგროვება, არამედ მუდმივი თავდაცვითი სტრატეგიების შემუშავება, კედლებისა და თავდაცვითი იარაღების განთავსება, რათა დაეცვა თავისი ბაზა მწერების მუდმივი შემოტევებისგან. ეს ყველაფერი მოითხოვს ერთდროულად რამდენიმე კრიტიკული მიმართულების უწყვეტ კონტროლს.

რაც შეეხება ამ ექსპერიმენტის ფინანსურ და დროით მაჩვენებლებს, 2026 წლის 12 სექტემბერს თემას ვრცლად და დეტალურად გამოეხმაურა Zvi Mowshowitz. მის მიერ შეჯამებული მონაცემები ნამდვილად შთამბეჭდავია და კარგად ასახავს პროცესის მასშტაბებს. მიზნის მიღწევას, ანუ რაკეტის გაშვებას, თამაშის შიდა დროით დაახლოებით 44 საათი დასჭირდა. თუმცა, რეალურ დროში ექსპერიმენტის მიმდინარეობა ბევრად უფრო დიდხანს გაგრძელდა და სრულმა პროცესმა 4 დღე და 11 საათი შეადგინა. ინტენსიური გამოთვლებისა და მუდმივი ჩართულობის გამო, პროექტის ჯამურმა ხარჯმა საკმაოდ სოლიდურ ნიშნულს მიაღწია და დაახლოებით 4500 დოლარი შეადგინა. 4500 დოლარი ერთი თამაშის დასრულებისთვის საკმაოდ დიდი თანხაა, თუმცა, თუ გავითვალისწინებთ 4 დღის განმავლობაში მოდელთან უწყვეტ კავშირს, ეს ხარჯი სრულიად გასაგები ხდება. API-სთან მიმდინარე მუდმივი მოთხოვნები და საპასუხო მოქმედებების დაგეგმვა კოლოსალურ გამოთვლით რესურსს მოითხოვს. საზოგადოებრივ ფორუმებზე დისკუსიისას გამოქვეყნდა გამარჯვების დამადასტურებელი სქრინშოთი, რომელზეც რაკეტის გაშვების ზუსტი დრო, 43:40:46, არის დაფიქსირებული.

ამ საინტერესო ექსპერიმენტში გამოყენებული იყო მოდელი, რომლის API-იდენტიფიკატორი სისტემაში ცნობილია როგორც gpt-6-astra. Hacker News-ზე მიმდინარე განხილვების მიხედვით, მოდელს არ ჰქონდა პირდაპირი პროგრამული წვდომა თამაშის ფარულ მონაცემებზე. ექსპერიმენტატორებმა გამოიყენეს კლიენტის მხარეს მომუშავე, სპეციალურად შექმნილი Lua-სენდბოქსი და მოდიფიკაციის API, რომელიც თამაშის მიმდინარე მდგომარეობას უსაფრთხოდ კითხულობდა. ამის შემდეგ მოდელი მოქმედებდა სტანდარტული Factorio InputActions-ის გამოყენებით. მარტივად რომ ვთქვათ, ხელოვნური ინტელექტი ასრულებდა ზუსტად იმავე სიმულირებულ მოქმედებებს, რასაც ნამდვილი ადამიანი მოთამაშე გამოიყენებდა. გარემოს აღსაქმელად სისტემა დამატებით და პერიოდულად იყენებდა სქრინშოთებს. ეს დეტალი ძალიან მნიშვნელოვანია, რადგან გამოირიცხა ყოველგვარი ტექნიკური მანიპულაცია და თამაშში ობიექტების არაკეთილსინდისიერად, უფასოდ შექმნის შესაძლებლობა.

მიუხედავად დეტალური ტექნიკური აღწერისა, ტექნოლოგიური საზოგადოება და ექსპერტები მოითხოვენ სრულ სიფრთხილეს ამ შედეგების შეფასებისას. პირველ რიგში, კიდევ ერთხელ მკაფიოდ უნდა ითქვას, რომ ეს არ არის OpenAI-ის მიერ გამოქვეყნებული ან აღიარებული ოფიციალური შეფასება, ანუ ბენჩმარკი. გარდა ამისა, როგორც Traictory-ის მიმოხილვაშია ნათქვამი, ეგრეთ წოდებული FactorioBench, რომელსაც ხშირად ახსენებენ ფორუმებზე, სინამდვილეში არ წარმოადგენს რაიმე სახის ფორმალურ ან აკადემიურად აღიარებულ ბენჩმარკს. ეს უფრო თემის შიგნით შექმნილი არაფორმალური კონცეფციაა, ვიდრე სანდო სტანდარტი. ამ ეტაპზე ასევე არ არსებობს სხვა დამოუკიდებელი მკვლევრების მიერ ჩატარებული რეპლიკაციის დადასტურება, რაც მეცნიერული და ტექნოლოგიური მიღწევების აღიარებისთვის აუცილებელი ეტაპია. შესაბამისად, სანამ არ მოხდება ექსპერიმენტის შედეგების სრული და დამოუკიდებელი ვერიფიკაცია, @_Mira___Mira_-ს მიერ გავრცელებული ინფორმაცია რჩება მხოლოდ საინტერესო მტკიცებად და არა დადასტურებულ ფაქტად.

წყარო: Mira (X), Zvi Mowshowitz / Traictory / Hacker News