AI 文章配圖 Skill:GPT Image 3D 材質圖一鍵生成
摘要
藏師傅介紹全新開源的文章配圖 Skill,透過 Codex 內建的 GPT Image 2.0 生成統一 3D 材質風格插圖。支援工作彙報、數據圖表美化、教育解釋圖及人文配圖等多種類型,並針對冷門概念自動網路檢索補圖、強制圖內中文標籤生成,以及交付前自動審核,大幅降低手動修圖成本。
完整逐字稿
大家好,我是貴藏,今天給大家介紹一下剛開源的一個材質文章配圖的 Skill,主要會介紹一下這個 Skill 的能力,還有我做這個 Skill 上有一些獨特的思考。
剛開始是這樣的,我昨天給 Claude 的一篇文章用我那個社交媒體卡片 Skill 做圖的時候,就想因為它裡面有一些涉及到技術的概念,就想讓 Codex 基於我那個社交媒體卡片的風格,用 GPT Image 2.0 去生成一些配圖。沒想到它生成出來的配圖效果還挺好的,你可以看一下,這個是它昨天生成的配圖,這個是我用它的配圖和我的社交媒體卡片 Skill 做的 3 比 4 圖片,效果還挺好的。發出來以後大家都很喜歡,我索性就給大家做一個配圖的 Skill。
你可以用 Codex 裡面內建的 GPT Image 2.0 去讓它生成各種各樣的配圖,主要解決的什麼問題,就是把文章筆記或者數據,還有產品說明,變成這種非常簡潔的 3D 帶有中文的字體標籤、箭頭和流程的這種關係的解釋圖,讓讀者非常清楚地能看懂。
來看一下我是怎麼做的,或者 Skill 有哪些能力。首先來看它支援的圖片類型。
第一點,你可以用它去做你的工作彙報和產品說明,就比如說你的進展。比如說大家都要寫週報,甚至極端的,我看很多大人開始寫日報了,那這個時候你就可以用一些這種圖片去展示你的進展。比如說第一張圖片,這種進展、風險、決策,還有下週需要做的事情,就來做頭圖。包括說你看這個流水線上的一些異常類的,就非常直觀,就能看到是哪個問題。
第二個是數據圖表,我專門針對數據圖表也做了一些優化,你可以讓它去幫你美化你的數據圖。你可以給到它數據以後,它就會畫對應圖表,而且會加上這種 3D 的小人和場景,讓這個數據圖看起來更直觀、更生動。比如說第一個甘特圖,第二個這種非常冷門的煤的熱力圖。
第三個是教育的一些解釋圖,比如說我們經常給小孩、小朋友想介紹一些物理概念或數學概念,那個時候你畫圖經常是需要去自己畫,而且可能畫得不好。這個時候有這種非常好材質的方面的,就可以去幫你展示這種類型的教學圖片。比如說物理的線圈磁鐵,包括說你的槓桿原理——支點、力臂、用力點、阻力點,它很清楚、很直觀地就標注出來了。
人文配圖其實也可以做,比如說在解釋一些物理概念或者是一些社會學概念的時候,就可以用它去生成配圖。比如說這裡是絲綢之路,可以看到它會很生動地把絲綢之路的每一個部分都放在上面。
另外,它會是統一的視覺風格,包括說白底、非常克制的一個 3D 材質,還有一個描邊,就是帶描邊的 3D 材質。如果你玩過《無主之地》的話,可能會感覺很像《無主之地》那種 3D 的風格。還會有一些非常小的點綴色和短的中文標籤,方便大家理解,一致性是做得非常好的。
接下來看一下我做這個 Skill 時候解決了哪些問題,或者是專門去做了哪些優化。
比如說第一個就是冷門概念。我們在用 GPT Image 2.0 做圖的時候,雖然說它很強,它很多東西都知道長什麼樣,但是非常多冷門或者生僻的概念它不知道,還有一些是在它訓練之後出現的東西,比如說訓練之後出現的一些新的公司的 logo、新的一些產品,它是不知道的。那這個時候它有可能會給你亂畫。我這個 Skill 它會判斷說一些冷門或者生僻的概念,如果它不知道,它就會去網上檢索相關的圖片,找到這個東西長什麼樣,再把這個圖片墊進去,讓模型理解這個圖長什麼樣。比如說一些新產品的 logo 之類的,或者說這種小眾的產品或標識,它就會先檢索,然後再轉譯成統一風格,再給你生成圖片。比如這種冷門的概念它不知道,它就會先搜。
第二個,由於它過於聰明了,或者說自作聰明,它老覺得圖像模型寫不好文字,所以它就不往裡生成文字,它一直都是堅持說不寫文字,每次都讓 HTML 往裡寫字。那這樣它肯定對不準,所以加了一些要求讓它去往裡面寫字,因為 HTML 在生成這種短標籤文字的時候,錯字率基本上非常小,不可能錯。
是圖表的話,刚才說過了,它能生成圖表。圖表我是不去做美化和換皮的,不把原來的圖墊進去,而是把原來圖上的數據和內容分析出來,然後變成提示詞輸入進去,這樣會確保它即使原來的數據圖表畫得再醜,也跟新生成的數據圖表沒有關係。可以看到,美化前這是 OpenAI 的一張圖表是這樣的,美化後你看,非常豐富,而且數據也都是對的,還加上對應的模型 logo。
最後,我加了一些交付前的審核,就是 Codex 會去看它生成的圖有沒有問題,比如說錯字了、缺東西了,然後它都會看到,如果出問題它會幫你重新生成。這個時候你就可以完全不用管,但是你如果擔心它過度消耗,你可以明確要求它不進行交付前的審核。
能做什麼、不能做什麼,這個也規定得比較清楚。我們就只做這些解釋圖、圖標美化、配圖這些東西,你像整頁排版、照片修圖,或者是人像寫真這些,我們不管,它只是用來給文章配圖的。
這個其實很有意思。前面第一次初始的風格,還記得我剛才說給 Claude 配圖那個初始的風格,它其實不是我很精細地要求它生成的,而是它從我的另一個 Skill 裡總結出來的風格,自己搭配了一個它覺得適合的風格提示詞。那這個時候我覺得又是一個湧現的證據,當上下文足夠的時候,它就會自己在內容、風格、顏色和表達之間找到統一。因為我之前那些媒體的 Skill 其實非常大,它有很多的功能,所以這個我覺得也是很有意思的。
好,今天的內容就到這裡,如果你覺得你剛好需要一個這樣的配圖的 Skill,或者你剛好需要這種配圖,可以試試藏師傅的材質長圖 Skill。
剛開始是這樣的,我昨天給 Claude 的一篇文章用我那個社交媒體卡片 Skill 做圖的時候,就想因為它裡面有一些涉及到技術的概念,就想讓 Codex 基於我那個社交媒體卡片的風格,用 GPT Image 2.0 去生成一些配圖。沒想到它生成出來的配圖效果還挺好的,你可以看一下,這個是它昨天生成的配圖,這個是我用它的配圖和我的社交媒體卡片 Skill 做的 3 比 4 圖片,效果還挺好的。發出來以後大家都很喜歡,我索性就給大家做一個配圖的 Skill。
你可以用 Codex 裡面內建的 GPT Image 2.0 去讓它生成各種各樣的配圖,主要解決的什麼問題,就是把文章筆記或者數據,還有產品說明,變成這種非常簡潔的 3D 帶有中文的字體標籤、箭頭和流程的這種關係的解釋圖,讓讀者非常清楚地能看懂。
來看一下我是怎麼做的,或者 Skill 有哪些能力。首先來看它支援的圖片類型。
第一點,你可以用它去做你的工作彙報和產品說明,就比如說你的進展。比如說大家都要寫週報,甚至極端的,我看很多大人開始寫日報了,那這個時候你就可以用一些這種圖片去展示你的進展。比如說第一張圖片,這種進展、風險、決策,還有下週需要做的事情,就來做頭圖。包括說你看這個流水線上的一些異常類的,就非常直觀,就能看到是哪個問題。
第二個是數據圖表,我專門針對數據圖表也做了一些優化,你可以讓它去幫你美化你的數據圖。你可以給到它數據以後,它就會畫對應圖表,而且會加上這種 3D 的小人和場景,讓這個數據圖看起來更直觀、更生動。比如說第一個甘特圖,第二個這種非常冷門的煤的熱力圖。
第三個是教育的一些解釋圖,比如說我們經常給小孩、小朋友想介紹一些物理概念或數學概念,那個時候你畫圖經常是需要去自己畫,而且可能畫得不好。這個時候有這種非常好材質的方面的,就可以去幫你展示這種類型的教學圖片。比如說物理的線圈磁鐵,包括說你的槓桿原理——支點、力臂、用力點、阻力點,它很清楚、很直觀地就標注出來了。
人文配圖其實也可以做,比如說在解釋一些物理概念或者是一些社會學概念的時候,就可以用它去生成配圖。比如說這裡是絲綢之路,可以看到它會很生動地把絲綢之路的每一個部分都放在上面。
另外,它會是統一的視覺風格,包括說白底、非常克制的一個 3D 材質,還有一個描邊,就是帶描邊的 3D 材質。如果你玩過《無主之地》的話,可能會感覺很像《無主之地》那種 3D 的風格。還會有一些非常小的點綴色和短的中文標籤,方便大家理解,一致性是做得非常好的。
接下來看一下我做這個 Skill 時候解決了哪些問題,或者是專門去做了哪些優化。
比如說第一個就是冷門概念。我們在用 GPT Image 2.0 做圖的時候,雖然說它很強,它很多東西都知道長什麼樣,但是非常多冷門或者生僻的概念它不知道,還有一些是在它訓練之後出現的東西,比如說訓練之後出現的一些新的公司的 logo、新的一些產品,它是不知道的。那這個時候它有可能會給你亂畫。我這個 Skill 它會判斷說一些冷門或者生僻的概念,如果它不知道,它就會去網上檢索相關的圖片,找到這個東西長什麼樣,再把這個圖片墊進去,讓模型理解這個圖長什麼樣。比如說一些新產品的 logo 之類的,或者說這種小眾的產品或標識,它就會先檢索,然後再轉譯成統一風格,再給你生成圖片。比如這種冷門的概念它不知道,它就會先搜。
第二個,由於它過於聰明了,或者說自作聰明,它老覺得圖像模型寫不好文字,所以它就不往裡生成文字,它一直都是堅持說不寫文字,每次都讓 HTML 往裡寫字。那這樣它肯定對不準,所以加了一些要求讓它去往裡面寫字,因為 HTML 在生成這種短標籤文字的時候,錯字率基本上非常小,不可能錯。
是圖表的話,刚才說過了,它能生成圖表。圖表我是不去做美化和換皮的,不把原來的圖墊進去,而是把原來圖上的數據和內容分析出來,然後變成提示詞輸入進去,這樣會確保它即使原來的數據圖表畫得再醜,也跟新生成的數據圖表沒有關係。可以看到,美化前這是 OpenAI 的一張圖表是這樣的,美化後你看,非常豐富,而且數據也都是對的,還加上對應的模型 logo。
最後,我加了一些交付前的審核,就是 Codex 會去看它生成的圖有沒有問題,比如說錯字了、缺東西了,然後它都會看到,如果出問題它會幫你重新生成。這個時候你就可以完全不用管,但是你如果擔心它過度消耗,你可以明確要求它不進行交付前的審核。
能做什麼、不能做什麼,這個也規定得比較清楚。我們就只做這些解釋圖、圖標美化、配圖這些東西,你像整頁排版、照片修圖,或者是人像寫真這些,我們不管,它只是用來給文章配圖的。
這個其實很有意思。前面第一次初始的風格,還記得我剛才說給 Claude 配圖那個初始的風格,它其實不是我很精細地要求它生成的,而是它從我的另一個 Skill 裡總結出來的風格,自己搭配了一個它覺得適合的風格提示詞。那這個時候我覺得又是一個湧現的證據,當上下文足夠的時候,它就會自己在內容、風格、顏色和表達之間找到統一。因為我之前那些媒體的 Skill 其實非常大,它有很多的功能,所以這個我覺得也是很有意思的。
好,今天的內容就到這裡,如果你覺得你剛好需要一個這樣的配圖的 Skill,或者你剛好需要這種配圖,可以試試藏師傅的材質長圖 Skill。