偷偷摘套内射激情视频,久久精品99国产国产精,中文字幕无线乱码人妻,中文在线中文a,性爽19p

愛(ài)因斯坦霉霉同框只需15秒,最新可控AI一玩停不下來(lái),在線試玩已出

人工智能 新聞
這個(gè)最新MultiDiffusion模型,不管選的區(qū)域位置有多離譜,它都能給你畫(huà)出指定的東西來(lái)。

本文經(jīng)AI新媒體量子位(公眾號(hào)ID:QbitAI)授權(quán)轉(zhuǎn)載,轉(zhuǎn)載請(qǐng)聯(lián)系出處。

現(xiàn)在,AI繪畫(huà)完全可以做到指哪打哪了!

這邊哈士奇,那邊牧羊犬,背景在下雪天。

啪嘰!一幅畫(huà)就這么完成了。

圖片

這個(gè)最新MultiDiffusion模型,不管選的區(qū)域位置有多離譜,它都能給你畫(huà)出指定的東西來(lái)。

比如,你能看到大象和奶牛同時(shí)握草??

圖片

而且在線可試,親測(cè)大概15秒就能出,你甚至可以看到泰勒與愛(ài)因斯坦跨時(shí)空同框。

圖片

要知道以前AI繪畫(huà)最大的一個(gè)bug就是不可控,但現(xiàn)在人類擁有了更多的控制權(quán)。

總之就是,想畫(huà)什么就畫(huà)什么,想往哪畫(huà)就往哪畫(huà)!

有網(wǎng)友趕緊上手試了試:Not Bad!

想往哪畫(huà)就往哪畫(huà)

從效果來(lái)看,主要有三個(gè)方面的應(yīng)用。

  • 文本到高分辨率全景生成;
  • 精確區(qū)域生成;
  • 任意長(zhǎng)寬比粗略區(qū)域生成。

首先,只需要一句話,就可以生成512*4609分辨率的全景圖。

一張有滑雪者的雪山頂峰的照片。

圖片

攝影師也不用爬樓了,直接獲得城市夜景圖。

圖片

當(dāng)然更為主體功能,那就是給特定區(qū)域單獨(dú)提示,然后AI繪畫(huà)就來(lái)指哪畫(huà)哪。

比如在黑色部分是一個(gè)明亮的盥洗室,紅色區(qū)域是一面鏡子、藍(lán)色部分是花瓶、黃色部分是白色的水槽。

圖片

就這么隨手一個(gè)拼圖畫(huà),結(jié)果就生成了真實(shí)場(chǎng)景。

不過(guò)也有一些bug,像一些超現(xiàn)實(shí)的,他就有點(diǎn)太天馬行空了。

比如三體人在宇宙中大戰(zhàn)人類。

圖片

當(dāng)然也可以無(wú)需那么精確,只需標(biāo)個(gè)大致位置,還支持任意長(zhǎng)寬比的圖像。

圖片

藍(lán)色部分是埃菲爾鐵塔、紅色是粉色的云、綠色是熱氣球 。

圖片

關(guān)鍵是各種構(gòu)圖都十分地合理、場(chǎng)景效果以及實(shí)際物體相對(duì)大小也都十分精準(zhǔn)。

圖像生成可控

背后的這個(gè)模型叫做MultiDiffusion,這是一個(gè)統(tǒng)一的框架,能實(shí)現(xiàn)多功能和可控的圖像生成。

以往即便Diffusion模型給圖像生成帶來(lái)變革性影響,但用戶對(duì)生成圖像的可控性、以對(duì)新任務(wù)的快速適應(yīng)仍是不小的挑戰(zhàn)。

研究人員主要是通過(guò)重新訓(xùn)練、微調(diào),或者另外開(kāi)發(fā)工具等方式來(lái)解決。前不久爆火插件ControlNet正是解決了圖像生成的可控性,

而MultiDiffusion無(wú)需進(jìn)一步訓(xùn)練或微調(diào),就可一次實(shí)現(xiàn)對(duì)生成內(nèi)容的多種靈活控制,包括期望的長(zhǎng)寬比、空間引導(dǎo)信號(hào)等。

圖片

簡(jiǎn)單來(lái)說(shuō),MultiDiffusion的關(guān)鍵在于,在預(yù)先訓(xùn)練好的擴(kuò)散模型上定義一個(gè)全新的生成過(guò)程。從噪聲圖像開(kāi)始,在每個(gè)生成步驟中,解決一個(gè)優(yōu)化任務(wù)。

然后再將多個(gè)擴(kuò)散生成過(guò)程與一組共享的參數(shù)或約束結(jié)合起來(lái),目標(biāo)是將每個(gè)部分都盡可能去接近去噪版本。

即便有時(shí)候每個(gè)步驟都可能會(huì)將圖像拉向不同的方向,但最終融合到一個(gè)全局去噪步驟當(dāng)中,得到一個(gè)無(wú)縫圖像。

圖片

來(lái)自魏茨曼科學(xué)研究所

這篇論文主要來(lái)自位于以色列雷霍沃特的魏茨曼科學(xué)研究所。

圖片

兩位共同一作Omer Bar-Tal、Lior Yariv分別是魏茲曼科學(xué)研究院計(jì)算機(jī)科學(xué)和應(yīng)用數(shù)學(xué)系的研究生和博士生,后兩位分別是他們的導(dǎo)師。

圖片

△左:Omer Bar-Tal;右:Lior Yariv

好了,感興趣的旁友可戳下方試一試哦!

?https://huggingface.co/spaces/weizmannscience/MultiDiffusion?
主頁(yè)鏈接:
?https://multidiffusion.github.io/?
論文鏈接:https://arxiv.org/abs/2302.08113

責(zé)任編輯:張燕妮 來(lái)源: 量子位
相關(guān)推薦

2020-02-19 08:08:24

Nginx功能

2020-05-25 08:05:11

KafkaActiveMQRabbitMQ

2020-01-13 12:30:40

服務(wù)器開(kāi)發(fā) 架構(gòu)

2015-08-17 09:44:30

reactivecocios框架實(shí)用

2017-02-17 14:12:21

存儲(chǔ)閃存顆粒固態(tài)硬盤

2018-08-01 14:33:56

微信小游戲小程序

2018-08-27 15:57:54

技術(shù)短視頻碎片化

2019-07-29 08:22:59

程序員格子衫代碼

2022-03-21 09:32:03

AI游戲代碼

2014-10-21 13:13:30

SSL中間人攻擊中間人攻擊Yahoo

2014-09-29 16:17:05

易信免費(fèi)通話

2020-08-17 08:39:12

VSCode開(kāi)發(fā)工具

2018-11-12 09:00:33

2019-10-11 20:15:43

LEGION Y900

2020-08-04 07:45:52

Linux系統(tǒng)游戲

2025-05-20 08:45:00

2018-04-06 09:37:49

2023-10-23 12:27:51

AI模型

2024-03-18 09:15:31

2024-01-15 13:33:00

數(shù)據(jù)訓(xùn)練
點(diǎn)贊
收藏

51CTO技術(shù)棧公眾號(hào)