
OpenAI 剛推出 GPT-4o 圖片生成,迅速席捲社群媒體。與過去的 AI 圖片工具不同,這個新模型以不同方式運作,而成果已說明一切。
GPT-4o 特別在哪裡?
DALL-E 與其他擴散模型會一次生成圖片所有部分,GPT-4o 則採用自回歸方式。這表示它按順序逐像素建立圖片,類似舊式數據機下載圖片。雖然生成較慢,但成果值得等待。
OpenAI 執行長 Sam Altman 親自示範新技術,強調它將協助「創意工作者、教育者、小型企業主與學生」以新方式運用 AI。
吉卜力效應
最廣為流傳的功能,就是把任何圖片轉成吉卜力工作室風格藝術。使用者把個人照片到知名作品都「吉卜力化」,甚至 Sam Altman 也把頭像改成吉卜力風格的自己。


但這只是開始,GPT-4o 還能:
- 將任何圖片轉成任何藝術風格
- 替換元素,同時保留原始風格
- 製作能智慧安排文字位置的資訊圖表
- 根據詳細描述生成全新圖片
靠,GPT-4o 圖片生成太離譜了,連 UI 都能生成 🤯 設計師危險了。 11 個範例:pic.twitter.com/2uTC06ZDXZ — Dan ⚡️ (@d4m1n) 2025 年 3 月 27 日
在 X 查看原始貼文https://twitter.com/d4m1n/status/1905285032849129795?ref_src=twsrc%5Etfw
與 Google 產品相比如何?
這次發布緊接在 Google 的 Gemini 2.5 重大更新 之後,後者在多項 AI 基準測試登頂。雖然 Google Imagen 3(現已可在 Gemini 使用)提供類似功能,初步比較顯示,面對複雜要求時,GPT-4o 的結果更連貫且準確。
Google 也有令人驚豔的進展。開發者 Matthew Berman 示範 Gemini 只用一條提示詞就能建立複雜互動應用,包括參數可調的 3D 模擬。
圖片之外:下一步是什麼?
其他備受矚目的 AI 工具包括具有即時風格轉換能力的 Ideogram 3.0 mini,以及 AI 在機器人領域展現的可能性。其中,協助盲人的 AI 機器導盲犬格外值得注意。
我們正接近這樣的世界:AI 能快速建立可探索的世界,革新遊戲,最終甚至從簡單描述生成完整多媒體作品。
目前,GPT-4o 的圖片生成 能力,重新帶回早期使用者初次探索這些技術時感受到的「AI 魔法」。想像與創作之間的界線正一天比一天薄。
準備加入 AI 圖片革命了嗎?
雖然 GPT-4o 展示了爆紅的吉卜力風格轉換等精彩可能性,但不是所有人都能使用這類尖端工具。DomoAI 直接為你帶來類似能力,我們自己的風格轉換能把內容化為美麗藝術風格。
使用 DomoAI,你可以快速:
我們的平台不需技術專長或特殊硬體,也沒有其他服務嚴格的使用限制。我們處理複雜部分,讓你專注創意。
準備提升視覺內容了嗎?立即試用 DomoAI,實現你的創作願景。




