跳至主要內容
HK Learn AI
生成式 AI 教學

17 款 AI 工具工作流指南:寫作、圖像、語音、研究點樣揀

不是再做一張工具排行榜,而是把 17 款 AI 工具按對話寫作、視覺影片、語音會議、研究執行四類任務重新編排。本文提供逐項適用情境、測試任務、替代方案、免費限制、私隱風險,以及 4 條可直接落地的香港工作流程。

HK Learn AI 編輯部標誌

HK Learn AI 編輯部

編輯部

發佈於 2026年7月19日

最後審閱:2026年7月20日

分享這篇文章
17 款 AI 工具按對話寫作、視覺影片、語音會議和研究執行分類的工作流封面

難度

中階

所需時間

約 60–90 分鐘完成選型及首輪低風險測試

你需要準備

Claude · ChatGPT · Gemini · Grok · Nano Banana 2 · Seedance 2.0 · Veo 3.1 · Lovart · Google Mixboard · Napkin AI · MiniMax Audio · Fathom · Genspark Speakly · Manus · Gemini Notebook · Genspark · Perplexity

開始之前

  • 先列出一個真實但不含個人資料、客戶秘密或未公開財務資料的測試任務
  • 為任務定義輸入、合格輸出、截止時間、人工覆核人和可接受成本
  • 確認公司批准的帳戶、資料地區、保留期、分享權限及錄音或聲音使用規則
  • 準備同一份匿名測試材料,避免用不同資料比較工具而得出失真的結論
  • 願意核對官方方案及功能頁;本文截至 2026 年 7 月 20 日,配額和供應會變

看到十幾款 AI 工具同時出現,最容易犯的錯是逐個註冊,最後每天在多個對話、credits 和檔案庫之間切換。更實際的做法,是先拆開工作:哪一步需要整理長文、哪一步需要即時訊號、哪一步要引用、哪一步要圖像或影片、哪一步涉及聲音、會議或系統操作,再把工具放到最適合的位置。

本文不是「最好用」排名。17 款工具來自同一組實際示範,但功能、名稱、免費限額和供應情況已按截至 2026 年 7 月 20 日的官方資料重新核對。文章中的截圖和兩段預覽經原尺寸人工覆核,已移除可識別人物、帳戶、頻道、宣傳、燒錄字幕、載入畫面及模糊幀,亦沒有重複使用相同畫面。

先做四項時效校正:NotebookLM 已改名為 Gemini Notebook;Nano Banana 2 現時是 Gemini 3.1 Flash Image,而 Nano Banana Pro 仍是另一個型號;Mixboard 是 Google Labs 實驗,地區和功能供應可變;所有「免費」描述都只代表當日官方方案,不等於永久、無限或適合敏感資料。

一、不要問哪款最強,先用六個準則揀工具

  1. 任務配合:工具是否專門處理你的主要輸入和輸出,而不是只在示範中看起來漂亮?
  2. 證據:需要最新資料、第一方來源、逐句引用,還是只做創意草稿?
  3. 可控程度:可否鎖定格式、修改單一元素、保存版本和重現結果?
  4. 匯出:輸出能否進入 Docs、PPTX、PNG、MP4、CSV 或現有系統,還是被困在平台內?
  5. 資料風險:會否涉及個人資料、聲音、會議、客戶素材、登入權限或代理操作?
  6. 總成本:除了月費,還要計算 credits、生成失敗、人工修改、培訓、審批和工具切換時間。
工具最適合的缺口主要輸入/輸出開始前要核對簡單替代
Claude長文、寫作與程式脈絡文件/草稿、artifact、程式碼搜尋、檔案和方案限制ChatGPT、Gemini
ChatGPT通用結構化任務文字、檔案、圖像/表格、草稿訊息與工具配額Claude、Gemini
Gemini多模態與 Google 生態文件、圖像、音訊、影片/分析上載時長、大小和方案ChatGPT
Grok公開 X 訊號與即時網頁查詢/公開貼文及摘要來源質素、日期、私隱Perplexity、一般搜尋
Nano Banana 2含文字的快速圖片提示、參考圖/海報、商品圖型號、版權、文字正確度現有設計工具
Seedance 2.0短片動作及多素材參考文字、圖、片、聲/短片素材授權、連續性、供應Veo 3.1
Veo 3.1參考圖、直向及高質影片提示、參考圖/影片Flow、API 與輸出選項差異Seedance 2.0
Lovart整套品牌或 campaign 畫布brief、brand kit/多個設計資產逐項可編輯、商用權和輸出設計師加現有工具
Mixboard視覺探索和 mood board概念、參考圖/視覺板Labs 實驗、地區與配額Slides、FigJam、Miro
Napkin AI文字快速轉流程圖段落/圖解免費匯出品牌標記、credits手動畫流程圖
MiniMax Audio多語語音及獲授權聲音文字、聲音樣本/音訊同意、發音、冒認風險真人錄音
Fathom會議錄音、轉錄和待辦會議/逐字稿、摘要與會者同意、平台、保存期平台內建轉錄
Speakly跨應用語音輸入語音/整理後文字麥克風權限、敏感內容作業系統聽寫
Manus多步代理任務目標、連接器/報告或成品credits、權限、批准點人工 checklist
Gemini Notebook來源限定研究和多種成品來源/引用回答、Studio 輸出來源版本、配額、引用覆核文件庫加通用助手
Genspark生成及修改簡報brief、參考/簡報頁生成 credits、逐頁可編輯度PowerPoint、Google Slides
Perplexity即時網頁研究與引用問題/帶來源回答引用是否支持主張搜尋引擎加人工筆記

如果只需比較 ChatGPT、Claude、Gemini 和 Microsoft Copilot,可先看四大 AI 助手香港用家比較。本篇重點是如何把通用工具和專用工具串成流程。

二、對話與寫作:先建立一個穩定主力

1. Claude:長文、寫作修改與程式脈絡

Claude 專案內以 SKILL.md 定義程式碼審查規則
畫面以一份 code review 規則示範如何把可重用指令寫成明確標準,而不是每次只輸入一句模糊要求。

何時用:要讀長文件、維持寫作語氣、整理大段脈絡,或把程式和規格放在同一個工作區時。Artifacts 適合把生成內容放到獨立畫布再反覆修訂;需要網頁資料時,要確認當前帳戶已啟用 web search。

測試任務:提供一份匿名政策草稿和目標讀者,要求 Claude 先列出模糊、矛盾和缺證據之處,再按「原句、問題、修改、理由」四欄重寫。不要一開始就要求完整新稿,否則難以知道改動原因。

不適合:只需要最新公開訊號、逐條社交貼文或高度結構化試算表時,不必因寫作流暢就強行用同一工具完成全部步驟。

2. ChatGPT:通用任務和嚴格輸出格式

ChatGPT 按評分、現況、問題和改善建議輸出四足機器人分析
結構化提示把一個寬泛市場問題拆成固定評分和可覆核欄位,方便比較不同輪次。

何時用:要把混亂材料整理成表格、checklist、教學、數據分析或跨格式草稿時。免費層現時可用搜尋、檔案及圖像上載、資料分析和圖片等能力,但各項有獨立或變動配額。

任務:評估一個新產品是否適合切入香港市場。輸出:1–10 分、現況、潛在問題、建議改善、需要補查的證據。每個數字標示來源日期;未知填「未有資料」,不要自行估算。
預覽一:由分析維度收斂成評分和改善方向。片段只保留清晰文字區域,沒有帳戶、人物、宣傳、字幕或載入狀態。

不適合:當公司只批准 Microsoft 或 Google 受管環境,或工作必須保留在既有文件權限內,應先用已批准平台,而不是額外複製資料。

3. Gemini:多模態分析與 Google 工作環境

Gemini 分析一段會議錄音並整理 CRM 轉型背景
示範把音訊內容整理成背景、流程、選型原因與協作模式;人名和帳戶區域已不在畫面內。

何時用:輸入同時包含文件、圖片、音訊或影片,或團隊主要使用 Google 服務時。官方上載時長、大小、檔案數和分析能力會按方案而異,長片和多檔案尤其要先看限制。

測試任務:用一段獲准的三分鐘產品 demo,要求列出「畫面可見事實、旁白主張、兩者不一致、需要人工確認」四部分。這可測試它是否把看見和推論分開。

不適合:如果材料只是一組正式來源,需要逐句引用和長期來源管理,應把 Gemini Notebook 加入後段,而不是只靠一般聊天。

4. Grok:公開 X 貼文和即時網頁訊號

Grok 整理過去 24 小時 AI 熱門 X 貼文的方法說明與結果欄位
即時訊號適合發現話題,不適合直接當成市場真相;畫面只保留方法說明和表格欄位,沒有顯示個別帳戶或貼文身份。

何時用:要快速了解公開 X 討論、突發事件或產品反應,並需要同時搜尋公開網頁時。把它定位成 signal discovery,而不是最終證據庫。

測試任務:要求列出指定 24 小時內的十項公開主張,為每項提供原始連結、時間、是否第一方、可獨立核對來源和相反觀點。沒有第二來源的內容標為「未核實」。

風險:熱門不等於具代表性;貼文可刪除、內容可誤導,互動量亦可能受演算法或非自然活動影響。涉及個人資料時還要評估是否有必要收集。

三、視覺與影片:由概念、靜態圖到動態成品

5. Nano Banana 2:速度和含文字圖片的平衡

Nano Banana 生成包含中文品項和價格的咖啡餐牌
含大量文字的視覺最能暴露錯字、價格和版面問題;示範只可作草稿,發布前要逐字校對。

名稱校正:Nano Banana 2 是 Google 目前的 Gemini 3.1 Flash Image,主打快速生成和編輯;Nano Banana Pro 仍是另一個高階選項。不要把錄製時的產品稱呼、介面標籤或第三方包裝當成模型正式名稱。

測試任務:提供自家品牌色、合法字型、三項已核對產品資料和一張版面草圖,要求生成三個 4:5 方案。逐字核對名稱、價格、單位、標點和圖像內容;任何錯誤都要在設計檔中修正,不要只相信下一次重生。

不適合:正式商標、法定聲明、精密圖表或需要完全可編輯向量稿的工作,仍應由設計工具和專業人員完成。

6. Seedance 2.0:短片動作和多種參考素材

Seedance 2.0 Precise Action Replication 功能標題
功能重點是參考動作與多素材控制;最終畫面仍要逐鏡檢查人物、手部、物件與時間連續性。

官方介紹指出 Seedance 2.0 可混合文字、圖片、影片和音訊參考,並生成最長約 15 秒內容;參考素材數量亦有上限。適合 storyboard 已清楚、需要測試動作複製或多個視覺元素的短片。

鏡頭長度 8 秒,16:9。角色只做三個動作:拿起產品、轉向鏡頭、放回桌面。保持產品標籤、手部數量、背景光線和衣服一致。不要加入文字、商標或額外人物。

驗收:以 0.5 秒間隔抽幀,再完整播放聲畫;官方亦提醒模型仍可能出現物理、動作和敘事錯誤。參考人物、音樂、品牌和原片都要有授權。

7. Veo 3.1:參考圖、直向影片與 Flow 工作流

Veo 3.1 官方頁說明多張參考圖和直向影片生成
Veo 3.1 可用多張參考圖引導角色、物件和風格,也支援由直向圖片生成直向片段。

Veo 3.1 適合要在 Google Flow 或相關介面中,用多張參考圖維持角色、物件和場景方向的團隊。官方亦提到 1080p 和 4K 等輸出,但可用解像度取決於 Flow、API、Vertex AI 或實際帳戶,不應概括成每個入口都有 4K。

測試任務:用三張自行擁有的產品角度圖,先生成 6–8 秒靜止運鏡,再逐步加入動作和聲音。若第一輪已出現標籤變形或物件漂移,不要在錯誤基礎上繼續延長。

8. Lovart:一個 brief 產生整套品牌資產

Lovart 畫布顯示咖啡品牌配色、字體、杯具和品牌說明
與單張圖片生成不同,Lovart 的價值在於把配色、字體、mockup 和多個成品放在同一畫布比較。

Lovart 官方把流程描述為:輸入 prompt、參考檔或 Brand Kit,由 agent 選用模型,再在 infinite canvas 產生和修改多個資產。它適合 campaign 概念和品牌系統草稿,不代表每個標誌、字型、包裝和商用權自動合格。

測試任務:要求一套包含 mood board、配色、兩個標誌方向、杯具 mockup 和門面示意的咖啡品牌概念。每個元素要可單獨替換,並另列出使用的字型、素材來源、輸出格式和未解決風險。

不適合:已進入註冊商標、印刷打樣、包裝法規或無障礙審查階段的項目,仍要由相應專業人員接手。

9. Google Mixboard:先探索方向,再決定是否製作

Mixboard 以多張冬季門面和燈飾圖片組成概念板
同一板上比較門環、燈串、雪景和門面,有助團隊先對齊方向,避免直接生成成品後才爭論風格。

Mixboard 是 Google Labs 的視覺概念板實驗,適合把文字和參考圖放在同一畫布做 mood board、變體和提案。它的地區、配額和功能會變,不能把實驗入口寫成所有帳戶都可依賴的正式生產系統。

測試任務:建立「香港冬季零售門面」概念板,分成可落地、成本高、只供氣氛三區;每張參考圖記錄來源和可用權。最後只把獲批准方向交給正式設計流程。

10. Napkin AI:把文字轉成可理解的流程圖

Napkin AI 文字區列出用戶註冊流程五個步驟
先把文字寫清楚,再選取需要視覺化的段落;如果原文邏輯混亂,圖像只會放大問題。

Napkin AI 適合把流程、框架和關係快速轉成圖解。官方現時免費方案提供每週 credits、編輯和匯出,但免費 PNG/PDF 可能帶 Napkin 品牌,配額和方案要以當日頁面為準。

驗收:檢查步驟順序、箭嘴方向、遺漏節點、用詞和可讀性;正式簡報最好在可編輯設計檔重建,而不是直接把低解像度草稿放大。

四、語音與會議:先處理同意,再談效率

11. MiniMax Audio:Speech 2.8 語音生成與獲授權聲音樣本

MiniMax Voice Cloning 的音訊上載和錄音介面
介面接受聲音檔或即場錄音,不代表任何聲音都可合法或合乎道德地複製。

MiniMax 在 2026 年 1 月推出 Speech 2.8;官方重點包括 Native Sound Tags、以短至 10 秒樣本作高保真 voice cloning、錄音室級清晰度與降噪,以及改善跨語言表現(官方特別提到普通話與日語)。真正測試只可用自己錄製或已取得書面同意的聲音;廣東話、中英夾雜、專有名詞和數字讀法,仍要在實際帳戶可用型號逐項測試。

最低要求:記錄聲音擁有人、同意用途、素材來源、有效期、可發布地區、是否可再訓練、撤回方式和生成檔保存期。不可用於冒認、假客服、未標示代言或繞過身份驗證。

12. Fathom:會議錄音、摘要與待辦

Fathom 可連接 Zoom、Google Meet 和 Microsoft Teams 的示意圖
會議工具支援不等於可以無通知錄音;先取得與會者同意,再開啟錄影、轉錄和 AI 摘要。

Fathom 個人免費方案現時包括不限量錄音和儲存等基本能力,進階摘要、團隊和管理功能屬其他方案;官方計劃可變。選它的理由應是確實改善會後跟進,而不是因為錄音容易。

安全流程:邀請中預告 → 開會時再次說明 → 只錄必要部分 → 會後限制存取 → 由主持人核對決定、責任人、數字和日期 → 設定刪除或保留期。香港公司可另看AI 會議紀錄安全指南

13. Genspark Speakly:跨應用語音輸入與自訂模式

Speakly 設定頁顯示翻譯成英文、終端助手、專業潤色和抽象模式
自訂模式可把同一句口述轉成翻譯、命令或職場文字;先逐個啟用,避免快捷鍵做錯操作。

Speakly 官方定位是跨應用 AI dictation,支援自動移除填充詞、格式化、翻譯和自訂指令,並提供 Mac、Windows、iPhone 和 Android 版本。宣傳中的速度倍數不應當成每位用家都能達到的事實。

測試任務:口述一封包含三個人名、兩個日期和一個表格的廣東話電郵,再比較原始轉錄、專業潤色和翻譯結果。麥克風權限只給需要的應用,避免在開放辦公室口述客戶或員工敏感資料。

五、代理、來源研究與簡報:讓工具做事,也要設批准點

14. Manus:把目標拆成多步代理任務

Manus 輸入市場調研和功能價格比較報告任務
一個可執行任務應寫清地區、年份、候選數量、比較欄位和交付物,並在外部操作前停下來批准。

Manus 適合要跨多步研究、整理和產生成品的任務。免費和付費方案使用 credits,日常或活動配額會變;代理能連接工具並不代表應取得整個帳戶權限。

只讀模式研究 2026 年香港市場五款候選工具。先交來源清單和比較欄,不要登入、寄信、購買、下載可執行檔或修改雲端資料。完成草稿後停下,等我批准下一步。

不適合:付款、刪除、批量寄信、改權限、發布和正式資料寫入,不應成為首次試點。先用測試帳戶、最小權限和可回復操作。

15. Gemini Notebook:以來源為核心的研究工作區

Gemini Notebook 來源、引用對話與 Studio 成品三欄工作區
左側選來源,中間以引用回答,右側產生音訊、影片、報告、測驗和資料表等成品。

Google 已把 NotebookLM 更名為 Gemini Notebook。它適合把一組可追溯來源整理成回答、筆記和多種 Studio 成品,而不是無邊界搜尋。Standard 方案現時一般有 100 個 notebooks、每本 50 個來源和每日對話及成品配額,但官方明確表示限額可變。

測試任務:加入三份已核對第一方文件,要求把「來源明確寫出、跨來源推論、仍未知道」分開,每個重要主張附引用。若需要完整來源治理、Fast/Deep Research 和 Studio 教學,可看Gemini Notebook 完整工作流

16. Genspark:生成簡報後修改指定元素

Genspark AI Slides 顯示修改後的 AGI 簡報頁完整預覽
真正有用的測試不是看第一版多漂亮,而是修改指定元素後,標題、圖像和其他版面是否仍然完整。

Genspark AI Slides 的 Select mode 可點選元素後要求修改;官方說明目前生成消耗 credits,而手動修改本身不消耗。方案、模型和 credits 仍會變,匯出前要逐頁檢查字型、圖像、數據和可編輯程度。

預覽二:先以箭嘴標示要改的元素,再由對話欄整理修改指令。片段經 16 幀接觸表檢查,沒有帳戶、可識別人物、字幕、spinner 或模糊畫面。

測試任務:生成四頁簡報後,只修改第二頁標題、第三頁圖表單位和全稿品牌色;記錄它有沒有誤改其他元素。若需要法定數據、公司模板或高度可編輯交付,應回到 PowerPoint 或 Google Slides 做最後版本。

17. Perplexity:即時網頁研究與可追查引用

Perplexity 專利搜尋介面顯示可專利性、技術格局和研發入口
專利等高風險研究可用來發現候選資料,但不能取代專業檢索、法律判斷或原始資料庫核對。

Perplexity 會即時搜尋網頁並在回答旁提供引用,適合快速建立研究地圖。官方現時免費方案提供基本搜尋及有限 Pro/Research 使用,數量和方案可變。引用是 traceability,不是 accuracy guarantee。

測試任務:要求用第一方和原始資料建立五欄表:主張、來源、發布日期、支持句子、仍未解決。每個引用都親自開啟;找不到原文、日期不符或引用只支持部分句子時,把主張降級或刪除。

六、四條可直接落地的組合工作流

工作流 A:由即時訊號到可審核文章

  1. 用 Perplexity 找第一方資料;若話題依賴公開 X 反應,再用 Grok 補充即時訊號。
  2. 把已核對來源放入 Gemini Notebook,建立引用摘要、反例和資料缺口。
  3. 用 Claude 寫長文初稿,或用 ChatGPT 按固定欄位產生表格和 FAQ。
  4. 由人打開每個引用,核對日期、數字、推論和措辭,再發布。

關鍵:不要把 Grok 或 Perplexity 的摘要直接複製成來源,也不要把模型生成文章重新加入來源庫,造成循環引用。

工作流 B:由 campaign 概念到短片

  1. 在 Mixboard 對齊 mood、受眾、場景和禁用方向。
  2. 用 Nano Banana 2 製作含文字的海報草稿;用 Lovart 整理品牌系統,或用 Napkin 把流程變成圖解。
  3. 先寫 6–15 秒 storyboard,再選 Seedance 2.0 或 Veo 3.1 做單一鏡頭測試。
  4. 逐字校對靜態圖,逐鏡檢查影片的手部、物件、標籤、聲畫和連續性,最後做素材權利審查。

關鍵:同一 campaign 不必同時購買全部視覺工具。先看缺口是「方向不清」「文字圖錯」「品牌不一致」還是「動態成品」,只補相應一步。

工作流 C:由會議到可執行待辦

  1. 會前取得同意並說明用途、存取和保存期。
  2. 用 Fathom 或公司平台記錄;敏感段落暫停錄音。
  3. 把獲准逐字稿交 Gemini 或 Gemini Notebook 整理決定、待辦、責任人和截止日期。
  4. 用 ChatGPT 轉成 action table,但由主持人核對後才進入項目系統。
  5. 按政策刪除不再需要的錄音和中間檔。

關鍵:AI 摘要不是正式會議紀錄;漏掉反對意見或寫錯責任人,都可能比節省的整理時間更昂貴。

工作流 D:由口述到代理執行

  1. 用 Speakly 把口述整理成清晰 brief,先人工修正人名、日期和專有名詞。
  2. 需要旁白時,只用已授權聲音交 MiniMax Audio 生成。
  3. 把經批准 brief 交 Manus 做只讀研究,或交 Genspark 產生簡報草稿。
  4. 在寄信、發布、付款、改權限或正式寫入前停下,由指定人員批准。

關鍵:語音輸入、聲音生成和代理執行涉及三個不同風險面;不要因流程連得起來,就把三種權限一次過開盡。

七、用 14 日試點決定是否留下工具

選三個低風險、每週重複的工作,用同一份匿名資料測試兩個候選。每次記錄以下數據,而不是只問同事「好不好用」:

指標記錄方法不合格例子
完成時間由準備輸入到可交付版本生成很快,但整理素材更久
人工修改修改輪次及分鐘每次重生都破壞已核對內容
準確度錯誤、漏項、引用不符數字和來源錯,但語氣很肯定
可控和匯出格式、元素、版本是否可改只能截圖,不能進入正式文件
資料風險上載內容、權限、保留、分享要求整個 Drive 或郵箱權限
總成本月費、credits、人工、培訓一個任務跨四個訂閱才完成

試點結束只保留符合三個條件的工具:每週有穩定任務、總時間真的下降、風險和權限可以管理。提示詞需要範本時,可參考香港職場 AI prompt 實例

八、私隱、版權和批准點

  • 個人和客戶資料:先匿名化和最小化;不把身份證明、登入資料、完整人事、醫療、法律、投訴或未公開商業資料放進未批准服務。
  • 會議:錄音、轉錄和摘要前說明目的、存取者和保存期;處理拒絕和敏感段落。
  • 聲音:只有聲音擁有人明確同意的用途才可生成,並禁止冒認和未標示代言。
  • 圖像與影片:參考人物、品牌、音樂、素材、字型和訓練輸出都要做權利檢查;生成不等於自動取得商用權。
  • 即時搜尋:公開可見不等於應該收集或重新發布;刪除貼文和個人資料要特別小心。
  • 代理:以最小權限、只讀、測試環境開始;外部訊息、付款、刪除、發布、改權限和正式寫入前必須批准。

香港公司可把資料分類、員工使用規則、供應商審查和事故處理寫入正式政策;可配合香港公司 AI 私隱指南建立底線。

九、發布前完整 QA

  1. 主張:每個重要事實有日期和可開啟的原始來源;引用真的支持相鄰句子。
  2. 數字:單位、年份、分母、貨幣和計算由另一人或原始表核對。
  3. 圖片:用原尺寸逐張開啟;沒有半截 UI、模糊、載入、重複、帳戶、人物或宣傳識別。
  4. 影片:完整播放並以固定間隔抽幀;沒有 spinner、轉場糊幀、燒錄字幕、身份或重複片段。
  5. 聲音:核對授權、發音、專有名詞、合成標示和撤回安排。
  6. 匯出:實際打開 PPTX、PDF、PNG、MP4 或 CSV,檢查字型、版面、連結和可編輯性。
  7. 權限:用最低權限帳戶測試分享;不把內部檔案誤設為公開。
  8. 責任:記錄來源版本、生成時間、使用工具、人工審核人和最終批准人。

本篇媒體的實際驗收

  • 18 張最終圖片包含封面和 17 個工具畫面,另有 2 張影片海報;全部以原始解像度重新開啟。
  • 刪除或重裁帶半截標誌、會議姓名、可識別人物、模糊動態、載入、字幕和資訊不足的候選。
  • 2 段 MP4 均為 1280×720,分別抽取 16 個時間點檢查,並已移除原片聲音;海報和 inline 圖並非同一畫面。
  • 每段影片附繁體中文 WebVTT 重點字幕;發布資料夾只保留文章實際引用的檔案。

結語:好工作流會減少工具,而不是增加分頁

17 款工具最有價值的用途,是幫你看清工作可以分成哪些不同環節;它們不是要求每個人建立 17 個帳戶。先用一款通用助手完成低風險主流程,再按實際缺口加入研究、視覺、語音、會議或代理工具,通常已足夠。

每次新增工具,都要能回答:它取代了哪一步、節省多少人工、引入甚麼資料和授權風險、誰負責最後批准。當來源、版本、權限和人工覆核都可追查,AI 才由「很多功能」變成真正可交接、可更新和可負責的工作流程。

資料來源與引用

我們附上第一手及官方來源,方便你逐一核實。

  1. 1.What are artifacts and how do I use them?Anthropic Support
  2. 2.Enabling and using web searchAnthropic Support
  3. 3.Using ChatGPT's Free TierOpenAI Help Center
  4. 4.ChatGPT pricingOpenAI
  5. 5.Upload and analyse files in Gemini AppsGoogle Gemini Help
  6. 6.About GrokX Help Center
  7. 7.Gemini 3.1 Flash Image modelGoogle AI for Developers
  8. 8.Image generation with GeminiGoogle AI for Developers
  9. 9.Nano Banana 2Google
  10. 10.Seedance 2.0ByteDance Seed
  11. 11.Seedance 2.0 official launchByteDance Seed
  12. 12.Veo 3.1 Ingredients to VideoGoogle
  13. 13.How Lovart worksLovart
  14. 14.Mixboard public betaGoogle
  15. 15.Google Labs experimentsGoogle Labs
  16. 16.Napkin AI pricingNapkin AI
  17. 17.What are AI credits?Napkin AI Help Center
  18. 18.MiniMax Speech 2.8MiniMax
  19. 19.What is included in Fathom's free version?Fathom Help Center
  20. 20.Genspark SpeaklySpeakly
  21. 21.Manus membership pricingManus Help Center
  22. 22.NotebookLM is now Gemini NotebookGoogle
  23. 23.Gemini Notebook usage limitsGemini Notebook Help
  24. 24.Genspark AI SlidesGenspark Help Center
  25. 25.Which Perplexity plan is right for you?Perplexity Help Center
  26. 26.How does Perplexity work?Perplexity Help Center

常見問題

我需要同時使用 17 款 AI 工具嗎?

不需要。先選一款通用助手處理大部分文字工作,再用一個真實任務找出缺口。只有當影片、來源管理、會議紀錄、語音或代理執行能帶來清楚收益,才加入一款專用工具。工具太多會增加訂閱、培訓、資料散落和權限管理成本。

哪些工具有免費方案?

多款工具提供免費入口或試用,但訊息、生成、研究、匯出、儲存、品牌標記及每日或每週 credits 各有不同限制,而且會變。建立流程前要在官方方案頁核對當日配額,不要把錄製畫面的免費字樣當成長期承諾。

NotebookLM 是否已改名?

是。Google 在 2026 年 7 月 16 日把 NotebookLM 更名為 Gemini Notebook。既有教學仍可能顯示舊名;選工具和寫內部文件時應使用新名稱,並在第一次出現時註明原名方便同事辨認。

Nano Banana 2 和 Nano Banana Pro 是同一個模型嗎?

不是。Google 目前把 Nano Banana 2 對應到 Gemini 3.1 Flash Image,定位是速度、成本與品質的平衡;Nano Banana Pro 仍是另一個較高階影像模型。實際可用型號、解像度和價格要看使用介面或 API 當日文件。

Grok 或 Perplexity 顯示即時資料和引用,是否代表答案可信?

不代表。即時搜尋和引用只令追查更方便,仍可能引用低質來源、誤讀內容、混淆日期或跳過反例。重要結論要開啟原始頁,核對機構、日期、方法、數字和上下文,再由人決定是否採用。

Seedance 2.0 和 Veo 3.1 應如何選?

先用同一個短 storyboard 測試。Seedance 2.0 適合需要混合多種參考素材和短片動作控制的情境;Veo 3.1 可測試多張參考圖、直向影片和 Google Flow 生態。兩者都可能出現動作、人物、物件或連續性錯誤,必須完整播放及逐鏡核對。

用 Fathom 記錄會議前需要做甚麼?

先清楚通知與會者會錄音、轉錄和用 AI 摘要,說明目的、存取者、分享範圍和保存期,並按公司政策處理拒絕或敏感議題。完成後由會議負責人核對決定、責任人、數字和截止日期。

可以複製同事、客戶或公眾人物的聲音嗎?

不要在未取得明確授權時複製任何人的聲音。即使工具技術上接受短錄音,亦要確認聲音擁有人同意、素材授權、用途、地區、保存期、撤回機制和發布標示。涉及冒認、欺詐或誤導的用法應完全避免。

公司應如何做 14 日 AI 工具試點?

選三個低風險任務,用同一份匿名資料測試候選工具;記錄完成時間、修改次數、事實錯誤、人工覆核時間、匯出品質、資料風險和總成本。兩週後只保留明顯改善工作流而又符合管治要求的工具。

AI 代理可以直接代表我寄信、發布或改資料嗎?

初期不要。先限制為只讀或草稿模式,使用最小權限、測試帳戶和明確批准點。任何寄信、付款、刪除、發布、改權限或寫入正式系統的動作,都應在執行前由指定人員確認,並保留操作記錄和回復方案。

本文遵循我們的 編輯準則.

HK Learn AI 編輯部標誌

關於作者

HK Learn AI 編輯部

HK Learn AI 編輯部負責研究、查證同編寫每一篇內容,並引用官方及第一手來源。