AI 圖片生成
構圖、參照法、YAML 解構圖片生成的三個維度
「請幫我生成一張登山的圖片」遠不夠用。詳細的 Prompt 才能生成有細節的圖片。
請生成一張具有電影海報風格的圖片,畫面中有四位英勇的消防員穿著全套消防裝備(含頭盔、氧氣瓶、防火衣),正步出火場背景,背景是燃燒的大樓與濃煙密布的天空,色調偏冷色系(藍色、鋼鐵灰)搭配高對比光影,呈現出緊張與英雄氣息。畫面視角略低角度,讓人物看起來高大挺拔,構圖中人物呈現前後層次,有明顯光線與火花效果,整體風格類似電影《烈火英雄》的宣傳海報。
沒有畫面感?用參照法
找到想仿製風格的圖片(可到 AI 社群尋找),讓 AI 解構它:
請扮演 Prompt Engineer, 解構這張圖片的生成細節, 並以程式碼區塊顯示 Prompt。
複製指定視覺風格(YAML 解構法)
想讓同一風格可以重複使用,讓 AI 將視覺規範轉換為 YAML:
請使用 YAML 格式解構上傳內容的視覺風格, 並轉化為圖片生成的設計規範, 但不要在 Prompt 中指定圖片內容或文字。 讓使用者只要輸入想要呈現的文字內容和這段 Prompt, 就能夠生成指定視覺的中文資訊圖像。
實用圖片生成應用場景
影像生成工具
Recraft、Pixverse、Flow九宮格分鏡法
先讓 AI 創造九宮格分鏡腳本,再帶入 Flow 生成高一致性影片。分鏡明確後,AI 的畫面轉場更流暢、角色一致性更高。
網頁插件
ReadFrog、KortexReadFrog(陪讀蛙)
一鍵翻譯外文網站,以中英對照方式呈現,不用擔心幻覺。適合需要閱讀英文醫學文獻或 AI 技術文章的場景。
- 安裝 ReadFrog Chrome 插件
- 打開英文網站,一鍵切換雙語對照
- 進階:申請 Google AI Studio API Key 帶入插件,獲得更高品質翻譯
Kortex(知識管理)
當瀏覽器的書籤和筆記本逐漸失控,Kortex 幫助你統整 AI 工具的學習筆記、合併重複資料、建立個人知識庫。
任務分兩類:發想型(撰寫文案 / 簡報內容 / 客服信件)用 AI 加速;流程型(自動回信 / 每日回報 / 新聞彙整)用自動化工具執行。
自動化工具
Zapier、Make.com、n8n、Google App Script自動化工具的難點
不要把自動化想像得太美好。主要困難點有三:
- 串接過程:各系統之間的 API 授權和格式轉換
- 穩定流程:一旦上游資料格式改變,自動化就會中斷
- 需求變化:業務邏輯改變,自動化流程需要跟著調整
三種主流自動化工具
Google App Script(免費 Google 生態圈自動化)
不需要外部工具,直接在 Google Workspace 內執行自動化,適合以下場景:
Vibe Coding(用嘴巴寫程式)
Canvas、Claude、Lovable不需要懂程式碼,用自然語言描述你想要的功能,讓 AI 生成並部署。三種可生成的對象:
- 批次轉檔
- 加浮水印
- 螢幕截圖
- 番茄鐘
- 聲音轉錄
- 多檔合併
- 廣告攔截
- 網頁剪藏
- 暗色閱讀
- 標籤管理
- 影片增強
- 衛教互動頁
- 活動宣傳頁
- 簡易行政工具
- 個人網頁
Canvas(Gemini)
在 Gemini 開啟 Canvas 模式,輸入需求後直接進入 HTML 編輯器,可視覺預覽並即時修改,適合快速製作活動宣傳頁或個人網頁。
Claude(HTML 生成)
請將這段文字內容, 以排版過後的 HTML 格式呈現。
Lovable(完整部署)
用嘴巴設計並部署到線上。輸入需求後,Lovable 自動生成前端網頁,按下 Publish 即可上線,不需要任何主機設定。
衛教與病患互動頁面 / 行銷品牌活動頁面 / 預約確認工具 / 延伸個人品牌網頁
Agent 工具
Codex、MCP、長期記憶Codex 等 Agent 工具具備更進階的能力,超越單次對話的限制:
AI 工具的演進方向:從生成內容(Prompt 輸入 → 文字輸出)→ 到Agent 自主執行(目標輸入 → 多步驟自動完成)。現在正是從前者切換到後者的關鍵過渡期。