Похоже, у нас теперь первая "мировая" нейронка. То есть модель, которая строит "миры", а не просто какие-то там картинки и видосики. Залил фото и видео, а лучше еще доописал словами, что здесь вообще происходит, и готово.
Это отдельная ветвь эволюции нейронок. Так что, пожалуй, событие ну почти уровня публичного релиза первой общедоступной GPT (но тут можно поспорить, да).
Если честно, я лично жду прорывов именно там, в альтернативных подходах. Хотя модели-то, которые генерировали 3D-миры были и раньше. Но Atlas соединяет в одной архитектуре генерацию управляемого (именно, контролируемого, это важная деталь) видео, реконструкцию 3D-сцен и симуляцию для роботов. Так что по отдельности там не прям новое-инопланетное-совсем-ни-на-что-не-похожее. По отдельности такие трюки могли и другие, а чтобы все разом — нет.
Как работает, вы можете на видео глянуть, не забывая, что, конечно, каждый кулик хвалит свое болото и косячные генерации нам не показывают, а показывают лучшие. Но доступ к модели уже раздают партнерам, и находятся те, кто выкладывает свои первые эксперименты. Кто-то пробует скормить как исходник кадры с четвертого айфона, и на видео вы увидите результат (где проливает коктейль).
Чтобы вы понимали, какой сейчас случился скачок: для сравнения я построил "мир" в модели прошлого поколения по кадру со съемок (здесь можно погулять камерой по всей сцене, если что у меня почти все не так).
Здесь можно почитать про возможности модели и покрутить сцены в браузере.
21
12
8
3September 2, 2026 1.3K 5 42

