閱界資訊

第367期:Nano Banana 的幾個妙用

閱閱界編輯部2閱讀2分鐘

上個月,谷歌發佈了圖像模型 Gemini 2.5 Flash Image(項目名 Nano Banana)。谷歌稱它是目前“最先進的圖像生成和編輯模型”。我試用後,感覺確實很強,而且免費使用,打開官網(下圖)就能用。(備註:如果你訪問不了官網,週刊討論區也有接入官方 API 的第三方網站,不過大部分要收費。)對於這個模型,網友發現了各種神奇的用法,有人甚至收集成了一個 Awesome 倉庫。

我從這個倉庫裏面,挑了幾個很實用的例子,分享給大家。需要說明的是,我想其他圖像模型也能做這些事,大家可以試試。(1)人像處理圖像模型的最常見任務,一定是人像處理。我們先上傳一張生活照片。然後,讓模型將其轉成證件照,提示詞如下。請爲照片裏面的人物生成1寸證件照,要求白底,職業正裝,睜眼微笑。這個效果有點驚人啊。它意味着,人物的表情、髮型、妝容、服飾、姿勢都是可以改變的。下面就是改變人物表情,讓其側臉對着鏡頭微笑。

改變人物的姿勢,“將下面第二張圖片的人物,改成第一張圖片的姿勢。”照相館以後危險了,肖像照、旅遊照、集體照都可以交給 AI 了。(2)建築處理圖像模型的另一個用途是家居裝潢,要看家裝效果圖就讓 AI 生成,更改裝潢配色和傢俱,都是小 case。下面是一個難度更高的例子,上傳一張戶型圖,讓它變成 3D 模型渲染圖。從照片提取建築模型,也挺神奇。(3)包裝處理

下面,讓模型更改物品的包裝,“將圖二的漫畫形象,貼到圖一的包裝盒,生成一張專業的產品照”。書籍的封面、軟件的包裝盒,也可以同樣生成。(4)地圖處理圖像模型的另一個大市場是地圖應用(地理信息),只不過還沒想到可以收費的玩法。下面就是一個創新的用例。上傳一張地圖,上面用箭頭標註你選定的地點,讓模型“生成沿着紅色箭頭看到的場景。”它甚至可以從地形等高線圖,生成紅色箭頭處的實景圖。

來源|阮一峯科技愛好者週刊第 367 期,

每週精選周刊头条

評論(0)

暫無評論,來搶第一條。