吉卜力革命:GPT-4o 如何改變 AI 圖片生成

1

__wf_reserved_inherit

OpenAI 剛推出 GPT-4o 圖片生成,迅速席捲社群媒體。與過去的 AI 圖片工具不同,這個新模型以不同方式運作,而成果已說明一切。

GPT-4o 特別在哪裡?

DALL-E 與其他擴散模型會一次生成圖片所有部分,GPT-4o 則採用自回歸方式。這表示它按順序逐像素建立圖片,類似舊式數據機下載圖片。雖然生成較慢,但成果值得等待。

OpenAI 執行長 Sam Altman 親自示範新技術,強調它將協助「創意工作者、教育者、小型企業主與學生」以新方式運用 AI。

吉卜力效應

最廣為流傳的功能,就是把任何圖片轉成吉卜力工作室風格藝術。使用者把個人照片到知名作品都「吉卜力化」,甚至 Sam Altman 也把頭像改成吉卜力風格的自己。

__wf_reserved_inherit

__wf_reserved_inherit

但這只是開始,GPT-4o 還能:

  • 將任何圖片轉成任何藝術風格
  • 替換元素,同時保留原始風格
  • 製作能智慧安排文字位置的資訊圖表
  • 根據詳細描述生成全新圖片
靠,GPT-4o 圖片生成太離譜了,連 UI 都能生成 🤯 設計師危險了。 11 個範例:pic.twitter.com/2uTC06ZDXZ — Dan ⚡️ (@d4m1n) 2025 年 3 月 27 日

在 X 查看原始貼文https://twitter.com/d4m1n/status/1905285032849129795?ref_src=twsrc%5Etfw

與 Google 產品相比如何?

這次發布緊接在 Google 的 Gemini 2.5 重大更新 之後,後者在多項 AI 基準測試登頂。雖然 Google Imagen 3(現已可在 Gemini 使用)提供類似功能,初步比較顯示,面對複雜要求時,GPT-4o 的結果更連貫且準確。

Google 也有令人驚豔的進展。開發者 Matthew Berman 示範 Gemini 只用一條提示詞就能建立複雜互動應用,包括參數可調的 3D 模擬。

圖片之外:下一步是什麼?

其他備受矚目的 AI 工具包括具有即時風格轉換能力的 Ideogram 3.0 mini,以及 AI 在機器人領域展現的可能性。其中,協助盲人的 AI 機器導盲犬格外值得注意。

我們正接近這樣的世界:AI 能快速建立可探索的世界,革新遊戲,最終甚至從簡單描述生成完整多媒體作品。

目前,GPT-4o 的圖片生成 能力,重新帶回早期使用者初次探索這些技術時感受到的「AI 魔法」。想像與創作之間的界線正一天比一天薄。

準備加入 AI 圖片革命了嗎?

雖然 GPT-4o 展示了爆紅的吉卜力風格轉換等精彩可能性,但不是所有人都能使用這類尖端工具。DomoAI 直接為你帶來類似能力,我們自己的風格轉換能把內容化為美麗藝術風格。

使用 DomoAI,你可以快速:

  • 將自訂風格套用至 圖片影片(包括吉卜力靈感風格)
  • 使用簡單提示詞製作專業視覺素材
  • 讓所有內容保持一致品牌美感
  • 將設計時間從數小時縮短至數分鐘

我們的平台不需技術專長或特殊硬體,也沒有其他服務嚴格的使用限制。我們處理複雜部分,讓你專注創意。

準備提升視覺內容了嗎?立即試用 DomoAI,實現你的創作願景。

__wf_reserved_inherit

https://domoai.app/

最新文章