2026年9月10日

科技

Google 推出「Gemini 2.5 Flash Image」:AI 修圖進入全新時代

還記得此前在 LMArena 測試中被稱為“神秘香蕉模型(nano-banana)”的 AI 影像編輯工具嗎?如今它終於揭開面紗,Google 宣佈正式釋出 Gemini 2.5 Flash Imag...

還記得此前在 LMArena 測試中被稱為“神秘香蕉模型(nano-banana)”的 AI 影像編輯工具嗎?如今它終於揭開面紗,Google 宣佈正式釋出 Gemini 2.5 Flash Image —— 一款能夠兼顧生成與編輯的全能 AI 影像模型。

徹底解決“角色一致性”難題

傳統 AI 繪圖工具常常在保持角色一致性上翻車——同一個人物在不同場景裡畫風突變。Gemini 2.5 Flash Image 在這一點上實現了突破,它能讓同一個角色自然地出現在多個場景,或從不同角度展示同一款產品。
這對於 品牌素材製作、產品目錄生成、連續故事創作 來說,幾乎可以稱得上革命性。

Google 甚至為開發者提供了現成的模板應用,上傳一張人像就能快速生成不同年代的復古照片。

句子級修圖:自然語言就能完成複雜編輯

除了角色一致性,Gemini 2.5 Flash Image 最大的亮點是 自然語言精準編輯
使用者只需一句話,就能完成專業級別的操作,比如:

  • 模糊背景
  • 去除衣服上的汙漬
  • 從合照中移除某個人
  • 給黑白照片上色
  • 調整人物姿勢

無需 Photoshop 的複雜操作,效果卻能媲美專業修圖。

讓 AI 更懂世界:多模態語義理解

Gemini 2.5 Flash Image 不只是“會畫”,它還 理解現實世界語義
模型能夠識別手繪草稿、理解文字說明,並直接執行跨步驟的複雜編輯指令。
Google 在 AI Studio 演示了一個互動教育應用:在畫布上隨意畫圖,模型不僅能識別,還能結合現實知識進行講解,像一個隨身的智慧導師。

多影像融合:真正的「無縫」拼貼

新版本還帶來一項酷炫功能——影像融合
只需拖拽即可把一個物體“放入”另一個場景,生成結果自然得像原本存在。
例如,把產品放到不同環境裡,或把一張圖的風格渲染到另一間房間。

成本低廉 + 內建水印

Gemini 2.5 Flash Image 已可通過 Gemini APP、API、Google AI Studio 和 Vertex AI 使用。
定價為 每百萬輸出 token 30 美元,生成一張圖片約需 1290 token,成本僅 0.039 美元(不到人民幣 3 毛錢)
所有生成或編輯的圖片都會自動嵌入 SynthID 隱形水印,確保可溯源和內容真實性。

總結:AI 修圖工具的轉折點

Gemini 2.5 Flash Image 不僅是一次常規迭代,而是讓 AI 影像從“玩具”真正跨入 生產力工具 的關鍵一步。
它解決了長期困擾使用者的痛點(角色一致性、複雜編輯門檻),同時引入了更多創意可能(多圖融合、語義理解)。

未來,基於這款模型的新應用很可能會層出不窮——從品牌設計到教育娛樂,再到個人創作,都將迎來新的可能性。

接著讀

馬斯克的夢醒時分:當“科技狂人”碰撞現實政治

星艦再爆、特斯拉下滑、X平臺宕機、X.AI融資艱難……2025年,對埃隆·馬斯克而言是充滿失衡與挫敗的一年。從太空探索到自動駕駛,從科技佈局到政壇博弈,他在商業帝國與政治力量之間“失速轉向”,親手攪動的局面正反噬自身——這是一場關於野心、賭局與清醒代價的現實劇。

444 天前

熱鬧去哪兒了?今年那些曾經火爆的酒店年會正悄然消失

“今年我們酒店接到的企業年會訂單量,簡直可以用慘不忍睹來形容。” 來自華北某城市的一位高星級酒店銷售人員 A,最近忍不住向勁旅君吐槽。往年這個時候,整個團隊都會被企業年會訂單忙得團團轉,而今年卻完全反...

229 天前