人工智慧公司 Midjourney 最近公佈 了其下一步的重大進展。經過多年的提供和專注於靜態圖像,Midjourney 現在正在尋求擴展到視頻生成領域,特別是實時生成。
現在,它作為 Video Model 的 Version 1 的一部分提供,它被描述為“有趣、簡單、美麗且經濟實惠的東西,以便每個人都可以探索”。目前,該系統旨在通過使用動畫運動提示機制將圖像轉換為視頻。從本質上講,它為靜止圖像帶來了生命和運動,可以根據相關源圖像的預期運動級別進行調整。
與競爭對手的 AI 視頻軟體相比,Midjourney 似乎有點落後,但它指出,這隻是邁向更大目標的墊腳石。長期目標是能夠提供即時開放世界類比,而實現這一目標意味著還能夠流覽生成視頻的 3D 模型,然後非常快速地生成所有內容。後幾點是實現 Midjourney 目標的下一步。用 Midjourney 自己的話來說:
“你可能不知道的是,我們相信這項技術的必然目的地是能夠進行實時開放世界類比的模型。
“那是什麼?基本上;想像一個即時生成圖像的 AI 系統。您可以命令它在 3D 空間中移動,環境和角色也會移動,並且您可以與一切互動。
“為了做到這一點,我們需要構建塊。我們需要視覺效果(我們的第一個圖像模型)。我們需要讓這些圖像動起來(視頻模型)。我們需要能夠在太空中移動自己(3D 模型),並且我們需要能夠快速完成這一切(即時模型)。
“接下來的一年包括單獨構建這些部分,發佈它們,然後慢慢地將它們全部組合成一個統一的系統。一開始它可能很昂貴,但比你想像的要快,每個人都可以使用它。
這個視頻軟體的問題是它使用起來要貴得多。Midjourney 的收費是其圖像作業收費的 8 倍,它描述說,這仍然 “比市場上以前的發貨便宜 25 倍以上”。