Openai將GPT-4O新圖像生成發射到chatgpt中,顯示“令人難以置信的更好”結果
OpenAI將圖像生成功能直接集成到CHATGPT中,允許用戶創建圖像而無需離開聊天界面。
該公司宣布了該功能週二作為其更廣泛的推動,使AI工具在不同媒體上更有用和訪問的一部分,並保持在AI藝術界的相關性。
該功能是dall·e 3的演變,Openai Image Generator,它發射在2023年9月,但在偏愛下一代模型,包括Flux,Midjourney V6,SD 3.5,Recraft和Reve在內的AI愛好者中不受歡迎。
在此版本之前,OpenAI在同一平台上提供了兩個不同的型號,GPT生成文本和DALL·E 3處理圖像生成。
現在,GPT-4O將自己完成所有操作,而Dall·E 3將消失。
“ GPT -4O圖像生成在準確渲染文本,精確遵循提示以及利用4O固有的知識基礎和聊天環境中出色 - 包括轉換上傳的圖像或將其用作視覺靈感。”官方博客文章.
DALL·E 3的集成在公司計劃中繼續良好,以使GPT-4O成為“ OMNI”模型,該模型訓練有多模式數據,並能夠處理所有任務。 結果是一個模型比其前輩更有能力,準確和聰明。
Openai首席執行官Sam Altman在顯示GPT-4O新功能的視頻中說:“我們知道我們已經讓您等待了,但是我們認為這確實值得,我們認為您會喜歡它。” “向前邁出的一大步,向您解釋它的最佳方法就是展示它。”
在視頻中,該公司通過幾個示例展示了系統功能,包括解釋相對性理論的漫畫頁 - 與英語和普通話中的輸入 - 基於個人和真實照片的Custom交易卡,結合了多個圖像與透明背景的紀念硬幣,以及基於透明背景的多個圖像,以及基於非常準確的圖像,並具有非常準確的圖像,並且具有較長的長期和詳細的促使。
該模型在生成圖像方面速度很慢,但似乎非常準確。 奧特曼(Altman)指出,質量的顯著升級值得等待更長的時間。
阿爾特曼在演示中說:“圖像比我們以前的圖像生成(模型)要慢得多,但令人難以置信的好。我們認為這非常值得等待。” “隨著時間的流逝,我們還可以使其更快。”
推出似乎正在逐漸發生,並且我們無法在發稿時開始使用新型號。
用戶可以根據圖像的出現來判斷他們正在使用的系統:除了明顯的質量差距外,dall·e 3圖像在加載屏幕後完全形成,而新的GPT-4O則可以實時從上到下逐漸呈現圖像。
該公司強調,該技術不僅僅是創建精美的圖像。
“這個版本真正令人興奮的是,現在這些模型可以實際上可以看到他們知道的知識,並以視覺方式將其外部化。” Openai的一位研究科學家解釋說,Sam Altman邀請他們談論這一新功能。
這種功能允許教育應用,例如詳細的科學圖或具有準確渲染文本的信息海報,甚至具有主題一致性的圖像編輯。
Openai也有實施的護欄為了防止產生深泡沫,非法含量和去除水印。
儘管生成的圖像沒有可見的水印,但它們將包括C2PA元數據以將其識別為AI創建。 該公司還正在開發跟踪圖像出處的工具。
該公司計劃將功能帶入其API,使開發人員能夠將技術集成到自己的應用程序中。 Openai使用條款還說用戶將保留其生成的圖像所有權,但要遵守公司使用政策。
編輯塞巴斯蒂安·辛克萊(Sebastian Sinclair)和喬什·奎特納(Josh Quittner)
登入回覆
登入分享您的看法評論
相關文章
|Square
下載BTCC APP,您的加密之旅從這啟程
立即行動 掃描 加入我們的 100M+ 用戶行列