標籤: Gemini

  • Google 把手機交給 Gemini,是升級還是賭博?

    Google 把手機交給 Gemini,是升級還是賭博?

    📌 本文重點

    • Google 以 Gemini 接管行動助理入口,屬平台級賭注
    • 從 deterministic 助理轉向機率式代理,日常操作先退步
    • 未把服務能力抽象成 API 的 App,將被 LLM 平台邊緣化
    • Apple/Amazon 或以穩定 deterministic 骨架反向突圍

    Google 把整個行動體驗主入口交給不可預測的大模型,這不是單純的 AI 升級,而是一場平台級賭注。短期內,語音助理這個品類有很高機率在「更聰明」的名義下,先變得更難用。問題不在技術,而在產品路線與治理選擇。


    一:從「指令式助理」到「機率式代理」,使用者要先付出痛苦成本

    2026 年 9 月 4 日起,Google Assistant 將在 Android 手機、平板、Wear OS、Android Auto 上被全面關閉,由 Gemini 接管。表面上是「更強 AI」的升級,實際上是從可預測、可測試的指令系統,切換到機率式大模型代理的結構性轉變。

    💡 關鍵: 從 deterministic 系統改為機率式大模型,代表「幾乎 100% 成功」的日常操作會變成「有機率出錯」的高腦力互動。

    傳統 Google Assistant 的設計,本質是「語音殼包住一套 API」:

    • 使用者說「開 Spotify」,背後是明確的 intent:OPEN_APP_SPOTIFY
    • 說「導航回家」,就是 NAVIGATE_HOME

    這些都是有限集合的 deterministic 行為:可以寫測試、可以保證延遲在數百毫秒、可以在低網路甚至離線情境運作。錯誤雖然存在,但分布穩定且可預期。

    Gemini 則完全不同。它不是「語音指令解析器」,而是通用生成式模型

    • 你說「今天晚點提醒我買牛奶」,模型要理解語境 → 解析意圖 → 映射到行事曆 / Reminder API
    • 你說「幫我總結這篇 PDF 然後寄給同事」,中間牽涉閱讀、生成、郵件 API 呼叫與權限管理

    這意味著:

    • 可靠度不再是二元(成功/失敗),而是分布(模糊成功、部分成功、錯誤成功)
    • 延遲不再是一個穩定的 SLA,而是取決於模型大小、雲端負載、網路狀況與 prompt 複雜度

    對一般使用者來說,最大風險是:日常「低腦力」操作被「高腦力」系統接管

    過去你可以毫不思考地說:「設定 7:30 鬧鐘」,成功率幾乎 100%。未來你得思考:「我要不要多解釋情境?」、「Gemini 這次會不會理解成提醒而不是鬧鐘?」。當使用者開始「為了配合 AI 改變講話方式」,其實就是在替產品的設計債買單。

    Google 的賭注是:讓大模型同時處理簡單命令與複雜任務,最終用「一個超強助理」取代所有分散功能。但在模型可靠度依然是機率遊戲、成本與延遲尚未壓平之前,這會讓最常被使用的那一層——最簡單的日常操作——率先退步。


    二:從 intents/actions 到 Agents/Plugins:誰被邊緣化,誰有新機會?

    Google Assistant 曾經提供給開發者的,是一套相對乾淨的語音平台:

    • 明確的 intent schema(例如音樂播放、智慧家居控制、車載命令)
    • 透過 Actions on Google 或後續的 App Actions 接軌 Android

    這套機制有兩個重要特性:

    1. 契約清晰:開發者知道自己要實作什麼,觸發方式可預測
    2. 權力分散:Assistant 只是入口,真正的體驗在各 app 與服務裡

    把 Assistant 換成 Gemini + Plugins + Agents,整個權力結構改寫:

    1. LLM 插件變成新的「首頁」

    使用者說「幫我訂機票」,Gemini 可能直接透過某個預設插件(例如 Google 自家或大型 OTA)完成,不再需要跳出到你的 app。這對長年投資自家 UI 與品牌的服務,是被平台吸成「一個 API」的邊緣化風險。

    1. 語言優先,UI 次要

    在 Assistant 模式下,語音只是「一種入口」,最終還是導向 App。在 Gemini 模式下,語言本身就是操作界面

    • 開發者要思考的是「如何讓模型理解我的能力範圍」,而不是「如何設計 onboarding flow」
    • 如果你的服務不能被模型簡潔描述、能力邊界不清,將很難被當成可靠插件使用

    • 新機會在「LLM 原生能力提供者」

    真正得利的會是這兩類玩家:

    • 垂直 API 提供者:例如 AI 行程規劃、財務分析、醫療諮詢,只要有乾淨的 API 與明確的安全邊界,就能成為 Gemini 的「工具型插件」
    • Agent 編排平台:幫企業把既有系統包裝成一組「可被 LLM 使用的工具」,並處理權限、審計、成本控管

    💡 關鍵: 從「裝在手機上的 App」進化為「被 LLM 調用的能力」,是下一輪平台抽象層級的核心門檻。

    被邊緣化的,會是只把 Assistant 當作流量來源,而沒有把自己的服務能力抽象成清楚 API 的傳統 App。換句話說,從「裝在 Android 上的 App」,到「被 Gemini 使用的能力」,是一次結構性抽象;沒跟上的,就會從桌面 icon 退化成大模型的背景資料。


    三:產業格局:Apple/Siri、Amazon/Alexa 是落後者還是反向突圍者?

    Google 把整個行動助理層交給 Gemini,看起來是在追趕 OpenAI 與其他大模型競爭者,但也把自己暴露在三個軸線上:體驗、成本、治理

    這反而給了 AppleAmazon 一個不那麼顯眼、但關鍵的戰略選項。

    Apple:把「穩定」與「隱私」變成顯性賣點

    Siri 一直被嘲笑「聽不懂人話」,但也有兩個優勢:

    • 深度整合到 iOS 系統 API,在鬧鐘、提醒、HomeKit 等任務上,仍是高度可靠的 deterministic 系統
    • 具備強烈的 on-device AI 敘事空間,可以把大部分語音命令與個人化理解放在本機執行

    Apple 不必追著 Google 把 Siri 全面大模型化,它可以走的是:

    • 將大模型局部嵌入 Siri 背後,但維持前端的指令穩定性
    • 把「你說『開手電筒』永遠不會被當成寫詩」這種穩定性,升級為正式的產品承諾

    在隱私與可信度日益被放大的語境下,Apple 有條件把「不冒險的大模型整合」變成差異化,而不是落後。

    Amazon:Alexa 從家庭中樞到多雲 AI 中介

    Alexa 在手機上失敗,但在家中仍有相當的存在感。Amazon 的問題從來不是語音技術,而是:

    • 如何在家庭場景之外找到下一個平台位階

    如果 Google 把手機入口交給 Gemini,Amazon 反而可以定位 Alexa 為:

    • 家庭設備的穩定控制層(燈、門鎖、影音、購物)繼續維持 deterministic 邏輯
    • 在需要「複雜推理」時,接上多家大模型(Anthropic、OpenAI、自家模型),但保持語音控制的管控權

    也就是說,Alexa 可以用「多模型後端 + 單一穩定前端」反向壓制「單一大模型前端 + 不確定後端」的 Google 路線。

    產業上會形成一個有趣的分裂:

    • Google 路線:一切都交給大模型,再用 policy 與 UX 補洞
    • Apple/Amazon 潛在路線:把 deterministic 系統當作骨架,大模型只是器官,不是大腦

    💡 關鍵: 若使用者對大模型助理產生「不敢完全信任」的心理,保留 deterministic 骨架的陣營,將可能因「穩定」而取得策略優勢。

    如果未來幾年因為治理失敗、成本飆升、錯誤分布難以收斂,導致使用者對大模型助理產生「不敢完全信任」的心理,語音助理這個品類可能不是被 AI 變強,而是被 AI 的不可預測性先毀掉。


    結論:這不是「更聰明的助理」,而是「更難治理的平台」——接下來該怎麼做?

    Google 把行動平台入口交給 Gemini,是一場高槓桿賭注。如果治理、成本與體驗沒有處理好,結果可能是:

    • 語音助理在短期內變得更慢、更不穩、更難預期
    • 開發者與第三方服務被迫重寫與平台的關係,從 App 開發者 變成 LLM 能力供應者

    對不同角色,我的具體建議是:

    對一般使用者:

    • 把助理當成「有創造力但不可信任的實習生」,而不是「可靠的遙控器」
    • 在關鍵任務(鬧鐘、行程、金流操作)上,暫時多一道人工確認,不要全權交給語音指令
    • 若你在乎隱私與穩定,刻意嘗試具備 on-device AI 的生態(例如 iOS),讓市場看到你願意為穩定付費

    對開發者與服務提供者:

    • 立刻把你的服務能力抽象成乾淨 API,並明確定義邊界,好讓任何 LLM 能安全調用
    • 把「被 Gemini/其他模型當成插件使用」視為主要場景,而不是附加功能
    • 投資在 觀測與治理:建立 prompt/工具使用的 log、成本監控、風險告警,把「跟大模型合作」當成工程問題,而不是行銷口號

    對產業決策者與產品經理:

    • 不要把「換成大模型」當作 KPI,要問的是:哪些行為可以接受機率式結果,哪些必須維持 deterministic?
    • 留一條退路:確保核心關鍵路徑仍有非 LLM 的 fallback 機制,而不是把所有東西硬塞進模型

    語音助理時代並沒有結束,但「把所有助理都變成大模型」的時代剛開始。這是一個技術與治理難度都遠高於過去的平台轉折點。誰能在「更聰明」之前先守住「好用、可信、可控」,誰就會拿走下一輪人機介面的話語權。

    🚀 你現在可以做的事

    • 檢查自己常用的語音助理任務(鬧鐘、行程、金流),改為搭配手動確認一次,觀察未來 Gemini 變動對體驗的影響
    • 若你是開發者,立即盤點現有服務功能,設計一組乾淨的 API 介面,並撰寫能力與邊界說明文件,準備給 LLM 插件/Agent 使用
    • 若你負責產品或決策,列出產品中不能接受機率式結果的關鍵路徑,為每一條設計非 LLM 的 fallback 流程與技術實作方案
  • Google 把搜尋變成 AI 入口,開發者被邊緣化了嗎?

    Google 把搜尋變成 AI 入口,開發者被邊緣化了嗎?

    📌 本文重點

    • Google 把搜尋框變成 AI 對話與行動入口
    • 開放網路正被壓縮為「模型原料池」
    • 產品需轉向「為 Agent 設計」與結構化服務層
    • AI 搜尋與代理人需要新一層中立性監管

    這不是「搜尋小改版」,而是一次對整個網路分發權的再集中。Google 把 25 年來幾乎沒變過的搜尋框,升級成可以接收文字、圖片、PDF、影片、甚至 Chrome 分頁的 AI 對話入口,真正被重寫的不是 UI,而是「誰擁有使用者意圖、流量與交易」。對開發者與內容創作者來說,這是一場體驗上的利多,也是生態上的硬著陸考題。


    一個會「做事」的搜尋框,正在抽乾開放網路的水

    根據 VentureBeatThe Verge 的報導,新的搜尋框不再只是關鍵字欄位,而是 AI Overviews + AI Mode + Agents 的總入口:

    • 你貼上一段長文或一份 PDF,它幫你摘要與對比;
    • 你丟入幾個候選連結,它幫你總結、評估優缺點;
    • 你問一個模糊任務,它不只回答案,還呼叫 Spark / information agents 幫你訂行程、整理信箱、規劃活動。

    使用者體驗的確會變好:少跳頁、少比對、少被 SEO 垃圾站浪費時間。Wired 形容未來搜尋是「Vibe-coded results、Super widgets、Bots that never sleep」,本質就是:讓你盡量待在 Google 的結果層,把任務完成在 Google 的 UI 裡。

    問題是:當使用者不再需要點進你的網站,內容與服務的價值是被「引用」了,還是被「抽取」了?

    💡 關鍵: 搜尋結果層完成更多任務,意味著「流量與變現」從網站轉移到 Google 介面本身。

    傳統搜尋模式是:

    使用者意圖 → 搜尋關鍵字 → Google 排序 → 外部網站承接流量 → 在自己場域完成轉化與變現。

    AI 搜尋 + Agents 之後變成:

    使用者意圖 → Gemini / Agents 直接理解與行動 → 在 Google 介面完成絕大部分資訊吸收與操作 → 僅在必要時,少量導流或 API 呼叫外部服務。

    開放網路從「使用者第一站」退位成「模型的原料池」。對資訊消費者是福利,對生態卻是一次結構性抽稅:

    • 廣告與轉化被前置到 Google 層,你只拿到被切薄的尾端流量;
    • 你的內容被整理成 AI Overview 的一行答案,品牌記憶幾乎歸零;
    • 你的工具被代理人「用過」,但使用者從未真正「來過」。

    AI Overviews + Agents:壓縮的不只是媒體,還是整個 SaaS 中層

    TechCrunch 說得很直接:「Google 正在把 Search 從連結列表,變成一個充滿對話答案與自治代理的體驗。」這不只是在頂部多一塊摘要,而是把網路產品的「中層價值」整個吃掉。

    想像幾個本來長得很健康的商業模式:

    • 比價網站、行程規劃工具、學習筆記 SaaS、模板型生產力工具;
    • 甚至許多靠 SEO 拉新、靠 freemium 轉付費的中小產品。

    「搜尋框就是超級 AI 助理」 的世界裡,這些產品的功能會被代理人拆解成幾行「指令」:

    • 使用者不需要逛你的旅遊網站,只要對 Gemini 說「幫我排三天京都行程,偏文青咖啡」;
    • 不需要打開你的待辦工具,Spark 在 Gmail / Calendar 裡就幫他整理成行動項目;
    • 不需要你的比價頁面,AI 直接在 Overview 裡告訴他哪個方案 CP 值最高。

    你被保留的,只剩兩種角色:

    1. 底層供應商:像雲端 API、一個被呼叫一次就付一次錢的「功能積木」,完全在 Google UI 背後工作;
    2. 強品牌或強社群的目的地:使用者是「特地來」你的服務,而不是順便被搜尋結果丟過來。

    中間那一大片靠 SEO + 一般 UX 存活的「中型服務層」,會被 AI Overview + Agents 擠壓得非常難受。這輪浪潮傷的不是沒技術的人,而是只有技術、沒有「被 AI 需要」設計的人。

    💡 關鍵: 介於「底層 API」與「強品牌目的地」之間的中層 SaaS,將是被壓縮最嚴重的一群。


    從搶排名到「為 Agent 設計」:新時代的產品功課

    如果你今天還在開會討論「要不要再請一個 SEO 顧問」,那思路已經落後這波變化至少五年。

    下一階段的關鍵不是「我怎麼在 SERP 上排第一」,而是:

    我怎麼讓 AI 助理與 Agents 更願意、也更容易使用我的服務?

    具體來說,有幾個方向是現在就可以動手的:

    1. 從「給人看的頁面」到「給模型讀的結構」。
    2. 不是只加 schema.org 而已,而是:內容要有穩定結構、清楚標註、可機器解析的上下文;
    3. 把 FAQ、步驟、規格、限制寫得「模型友善」,不要把關鍵資訊藏在 JS 動態或圖片裡。

    4. 把產品拆成清晰的「動作 API」。

    5. 代理人需要的不是你的整個 App,而是一組可被編排的動作:搜尋、比價、預約、支付、匯出報告……
    6. 提供簡潔清楚的 API、Webhook、甚至專門給 AI 用的「意圖對應文件」,讓模型容易學會如何調你。

    7. 為 AI 助理設計「任務型服務層」。

    8. 把自己想像成一個要接入 Gemini / OpenAI / OpenClaw Agents 的第三方技能(類似舊時代的 Alexa Skills,但要更真實地能完成任務);
    9. 你不是在蓋一個入口網站,而是在打造一個能被 Agent 信任、持續呼叫的「專業模組」。

    10. 內容與工具的「品牌化」與「不可替代化」。

    11. AI 可以總結誰都能寫的旅遊資訊,但總結不出你的獨家數據、實測實驗、社群洞察;
    12. 讓別人引用你時,必須連帶提到你的名字與來源,否則就少了關鍵價值。

    未來的流量不是自然長出來的,而是被 Agents 主動路由的。你要做的,是讓自己在這個路由圖裡,變成一個被頻繁選用的節點,而不是一個等人「搜到」的孤島頁面。


    當搜尋巨頭握住「意圖 + 行動 + 交易」:AI 也需要中立性監管

    從公共利益與監管角度看,Google 把搜尋框變成「做所有事的介面」的同時,其實也在握緊三個關鍵環節

    1. 意圖:使用者不只問問題,還把整個上下文、偏好、文件、郵件都交給它理解;
    2. 行動:透過 Gemini SparkInformation agents,讓它代你操作 Gmail、Calendar、Docs、甚至第三方服務;
    3. 交易:搜尋結果裡的推薦、預訂、購買、訂閱,越來越多可以在 Google 的結果層直接完成。

    這意味著什麼?

    • 排序不再只是「哪個連結排前面」,而是「哪個行動被優先執行」。
    • 當它同時是裁判(排序)又是球員(自己的服務與廣告主),「AI 推薦」很容易變成一個更黑箱、更強勢的導流機器。

    如果我們曾經為搜尋廣告、App Store 排名、瀏覽器預設搜尋引擎吵過一輪平台壟斷,那 AI Search + Agents 是更需要提前討論的一層:

    • 是否需要某種形式的 「AI 中立性」要求,例如標註推薦來源、標明自家服務與第三方服務、提供透明的偏好設定?
    • 是否需要強制開放 多家模型、多家代理人供應商 的選擇,而不是只能綁在單一巨頭?
    • 對於依賴搜尋分發的中小內容與產品,是否應有 最基本的能見度與報酬機制,避免被整個「AI 概括回答」吃乾抹淨?

    搜尋巨頭如果成為「AI 時代的作業系統」與「預設代理人」,就不該只用舊時代搜尋引擎的規則來監管。這是下一輪數位監管的核心議題,而不是附帶條款。

    💡 關鍵: 當單一平台同時掌握意圖、行動與交易,傳統搜尋監管框架已不足以制衡其影響力。


    給開發者與創作者的底線建議:停止只做 SEO,開始為 AI 設計

    最後把話說白:這不是「Google 搜尋的升級」,而是「網路分發權的再集中」。

    如果你還在用 2010 年的 SEO 心態 做內容與產品——

    • 把預算花在關鍵字佈局、反向連結、標題黨;
    • 產品設計只想到人類訪客的導覽,不管模型能不能看懂;
    • 成功指標只有「自然流量成長」而不是「被多少工具與 Agent 調用」,

    那麼在未來三到五年,你會發現:

    使用者問題被 AI 在 Google 裡直接解決,你的網站與產品甚至連登場機會都沒有。

    相反地,現在就可以開始:

    • 把你的內容、數據、服務封裝成 結構化、可調用、可組合的服務層
    • 讓你的產品成為 AI 助理與 Agents 的「專業外掛」,而不是等人來點的資訊孤島;
    • 在公司內部 KPI 上,加入「被多少 AI/Agent 使用」這種新指標,而不是只看 Google Analytics 的自然流量圖。

    AI 搜尋與代理人時代並不必然是中小創作者與開發者的末日,但前提是:你願意承認遊戲規則已經換了,並主動把自己變成這個新遊戲裡「不可忽視的一塊」。


    🚀 你現在可以做的事

    • 審視現有網站與內容結構,為模型增加清楚標註與 schema.org 等機器可讀結構
    • 將核心功能整理成清晰的動作型 API 與文件,方便未來被 GeminiOpenAI 等 Agents 調用
    • 在團隊 KPI 中加入「被多少 AI/Agent 使用」指標,重新評估只依賴 SEO 的風險
  • 把常用 Prompt 變成一鍵技能:Chrome AI Skills 實測

    把常用 Prompt 變成一鍵技能:Chrome AI Skills 實測

    📌 本文重點

    • Chrome Skills:把常用 Prompt 變成一鍵工具
    • 可跨網站、多分頁套用同一個 Skill
    • 非技術同事也能用的標準化 AI 工作流程
    • 適合團隊共用固定模板與報表解讀

    一句話先說清楚:Chrome 的「AI Skills」= 把你常用的 Prompt,變成可以隨時一鍵呼叫的小工具,不用再到處找、複製貼上。

    官方介紹: Turn your best AI prompts into one-click tools in Chrome(Google AI Blog)


    核心功能:把 Prompt 做成「可重複的一鍵技能」

    1. 儲存 / 命名 / 重用你的 Skills

    你在 Gemini 側邊欄打的任何 Prompt,都可以存成一個 Skill:

    • 操作概念
    • 先在側邊欄對 Gemini 下指令(例:請幫我用禮貌英文回覆客戶…)。
    • 覺得這個 Prompt 之後會常用,就直接存成 Skill。
    • 下次在任何網頁,只要一鍵點這個 Skill,就能套用到當前頁面的內容。

    • 能客製化的部分:

    • 幫 Skill 取一個好記的名字(例:「英文客服回覆」、「報表解讀」)。
    • 說明它是拿來做什麼的,方便同事看得懂。

    💡 關鍵: 把高頻重複的 Prompt 存成 Skill,可以用「一鍵點擊」取代每次複製貼上與重寫指令。

    你可以立刻做的事
    先想 3 個你每天都會重複貼給 AI 的 Prompt,等一下在「怎麼開始」小節,直接把它們變成 Skills。

    2. 官方預設技能庫:先用現成的再改

    Google 在 Chrome 的 Gemini 側邊欄,內建了一批「預設 Skills」,常見例子(見 Wired 介紹):

    • 食譜優化:例如「最大化蛋白質含量」或改成純素、低卡版。
    • YouTube / 長文總結:幫你抓重點,整理成條列。

    你可以:

    • 先直接用這些現成 Skills。
    • 再把你調整過的 Prompt 版本,存成自己的自訂 Skills(Google 官方文也強調可「discover, save and remix AI workflows」)。

    你可以立刻做的事
    打開 Gemini 側邊欄,先試用 1 個預設 Skill(例如「Summarize this video」),再把回答風格微調後存成自己的版本。

    3. 在任何網頁側邊欄一鍵呼叫

    根據 TechCrunch 與 The Verge 的說明,Skills 的重點是:

    • 跨網站、跨分頁 使用同一個 Skill。
    • 勾選多個 Tab,一次對多個頁面跑同一個 Skill(例如一口氣總結 3 則產品更新頁)。

    實際效果:

    • 你不用再:
    • 開 Notion / Google Docs 找那段老 Prompt。
    • 複製貼上到 Gemini。
    • 只需要:
    • 打開側邊欄 → 點你命名好的 Skill → 選擇要套用的分頁。

    你可以立刻做的事
    打開 2–3 個需要處理的頁面(例如不同客戶信、不同產品頁),試一次「同一 Skill 跑多個分頁」。


    適合誰用?4 個實際場景示範

    1. 批改英文 Email:固定語氣、固定格式

    使用方式:

    1. 在 Gemini 側邊欄寫一個完整 Prompt,例如:

      「請幫我把選取的英文 Email 改寫成禮貌、簡潔、B2B 科技公司口吻,保留原本資訊,但語氣更友善、用詞自然。」

    2. 存成 Skill:命名為「英文客服回信優化」。
    3. 之後每封英文信:
    4. 在 Gmail 開信 → 開側邊欄 → 點這個 Skill → 貼入草稿內容或讓它讀取頁面內容。

    行動建議:
    – 先為 「英文回覆」和「英文道歉信」 分別各做一個 Skill,之後全部照這兩種模板改。

    2. 食譜轉成低卡 / 純素版

    The Verge 舉例,過去你每換一個食譜頁面,就要重新輸入「幫我改成純素版」。現在可以:

    1. 建立 Skill:

      「閱讀這個網頁中的食譜,將其改寫成純素版本,提出必要的食材替代方案,並計算每份大致卡路里。」

    2. 命名為「純素 & 低卡改寫」。
    3. 之後遇到任何食譜頁面,只要一鍵點這個 Skill。

    行動建議:
    – 如果你有特定飲食需求(低醣、高蛋白),為每種飲食習慣做一個專屬 Skill。

    3. 總結長文 / YouTube:變成「固定摘要格式」

    基於 Wired 的範例,你可以把「摘要」做得更標準化:

    1. 在一篇長文章或 YouTube 頁面上,對 Gemini 說:

      「請用繁體中文,幫我整理為:1)三點重點;2)一段 100 字內摘要;3)列出適合轉貼到 Slack 的一句話。」

    2. 存成 Skill「內容三段式摘要」。
    3. 之後任何長文 / 影片都可以套用同樣格式。

    行動建議:
    – 為「給自己看的摘要」和「給團隊看的摘要」各自定義格式,做成兩個 Skills。

    4. 固定格式報表 → 自動生成解讀摘要

    你可能每週都要解讀一份長得很像的數據報表(GA4、廣告報表、CRM 匯出):

    1. 建立 Skill Prompt:

      「閱讀當前頁面的數據表格,幫我用以下格式解讀:
      1)本週 vs 上週差異;2)異常指標與可能原因(列出 3 點假設);3)下週建議行動(列出 3 個具體操作)。請用條列,長度控制在 300 字內。」

    2. 命名為「每週數據解讀 300 字」。
    3. 套用在每週固定打開的報表分頁上。

    行動建議:
    – 先選一份你 最常被問要解釋的報表,為它設計一個專用 Skill,讓 AI 先產出初稿,再微調。


    Workflow 範例:為公司建立一套「團隊共用 Skills」

    雖然 Google 尚未完全打開「公開 Skill 市集」,但你可以先用很簡單的方法做「團隊半共用」。

    1. 客服回覆模板

    1. 在文件中定義好客服回覆規則,例如:
    2. 語氣(專業、溫和、不推責)。
    3. 固定結尾句(例如邀請進一步聯絡)。
    4. 把這段規則寫進 Prompt,存成 Skill「客服標準回覆」。
    5. 把這段 Prompt 原文和「如何新增 Skill」的教學,傳給全團隊,讓大家在各自的 Chrome 裡建一模一樣的 Skill。

    2. 產品 Changelog 生成流程

    假設你每次發版,都要:

    • 從 issue tracker / Git log 撈出變更。
    • 寫成「用戶看得懂的版本更新說明」。

    可以這樣設計 Skill:

    「根據這個頁面的變更紀錄,幫我生成一份產品 Changelog,格式為:1)標題一句話;2)三個重點功能更新;3)一段給現有用戶看的說明(100 字內);4)一段給內部同事看的技術摘要(150 字內)。」

    流程建議:

    1. PM 在自己瀏覽器裡先調到滿意的 Prompt,再存成 Skill。
    2. 把 Prompt 原文放進團隊知識庫(Notion / Confluence),讓其他同事照樣建立。

    你可以立刻做的事
    選一個你們團隊「每週都會重複做、但內容每次都不一樣」的工作(公告、週報、教學信),先為它寫一個完整 Prompt,再交給全員自己建 Skill。


    實作教學:如何在 Chrome 開啟、建立與使用 Skills

    注意:Skills 目前在 桌面版 Chrome 並搭配 Gemini 側邊欄 的環境下提供,實際入口可能會隨版本更新微調,以下以官方 Blog 和多家媒體描述整理出典型流程。

    1. 在哪裡開啟 Skills(設定路徑)

    1. 更新 Chrome 至最新版本。
    2. 登入你的 Google 帳號。
    3. 在右上角找到 Gemini 圖示 或從側邊欄開啟 Gemini(有些版本是「使用 Gemini」按鈕)。
    4. 若已開放 Skills 功能,會在側邊欄看到 Skills 區塊或「Save as Skill」類似選項(可持續留意:TechCrunch 報導)。

    行動建議:
    – 先確認你能在 Chrome 裡正常使用 Gemini 側邊欄,再來找 Skills 相關選項。

    2. 如何從現有 Prompt 儲存成 Skill

    1. 打開任一網頁(例如 Gmail、文件、報表)。
    2. 開啟 Gemini 側邊欄,輸入你想重複使用的 Prompt,先讓它跑一次,調整到你滿意的回答風格。
    3. 在這則對話附近,尋找「Save as Skill」或「Create Skill」按鈕(介面可能是三點選單裡的選項)。
    4. 設定:
    5. Skill 名稱(簡短但具體,例如「GA4 每週報告摘要」)。
    6. 說明 / Tag(方便未來辨識)。
    7. 儲存後,它就會出現在 Skills 清單中。

    行動建議:
    – 第一次先存 1 個 Skill,不要一次做太多,確保你真的會用它,之後再慢慢擴充。

    3. 如何在多個 Tab 上使用 Skills

    根據 The Verge 的說明,Skills 可以在多個分頁上重複使用,典型操作如下:

    1. 開啟多個相關分頁,例如:3 篇產品更新文章、或 3 份不同客戶的簡報頁。
    2. 打開 Gemini 側邊欄 → 選擇你要用的 Skill。
    3. 在 Skills 介面中,選擇要套用的 Tab(有些版本可能支援勾選多個)。
    4. 按下執行,AI 會依序對每個分頁運行該 Skill,生成各自的結果。

    行動建議:
    – 嘗試在 兩個很相似的頁面(例如兩個競品產品頁)使用同一個 Skill 做比較分析,快速得到可對照的結果。


    與「複製貼上 Prompt」相比的優勢

    傳統做法

    • 在 Notion / Google Docs / 備忘錄保存一堆 Prompt。
    • 每次要用時:切換視窗 → 複製 → 回到瀏覽器 → 貼上 → 再調整。

    用 Skills 的差別

    1. 少一步切換工具:Prompt 就在 Chrome 裡,直接點名字就套用。
    2. 減少 Version 混亂:不用在多個文件裡找「最新版 Prompt」,你只維護同一個 Skill。
    3. 跨分頁一致性:同一個 Skill 直接套在不同頁面,輸出風格一致,特別適合報表解讀、客服回覆、摘要格式。
    4. 更適合非技術同事:他們不需要理解什麼是 Prompt Engineering,只要知道「遇到這種工作,就點這個 Skill」。

    💡 關鍵: 把分散在文件裡的常用 Prompt 收斂成少量核心 Skills,可以同時解決「效率低」與「輸出不一致」兩個問題。

    你可以立刻做的事
    – 把你目前收藏 Prompt 的文件打開,挑出 最常用的前 3 個,優先轉成 Skills,其餘的保持在文件裡即可。


    和其他瀏覽器 AI 外掛有什麼不同?

    目前許多 AI 外掛(如各種 ChatGPT / Gemini / Claude 插件)也能在網頁上跑 Prompt,但 Chrome 原生 Skills 有幾個實際差異:

    比較項目 Chrome AI Skills 一般瀏覽器 AI 外掛
    整合程度 直接整合在 Chrome 與 Gemini 側邊欄 需額外安裝擴充功能
    Prompt 儲存方式 以「Skill」形式命名、可跨分頁一鍵呼叫 多為歷史記錄或簡單書籤,重用流程較散亂
    多分頁操作 官方說明可對多個 Tab 套用同一 Skill 多數外掛只對目前分頁或需逐一操作
    團隊共用 目前以「共用 Prompt 文本、各自建立 Skill」為主 有些外掛有雲端模板共享,但使用體驗不一
    安全與權限 跟隨 Google 帳號與官方隱私設定 視外掛開發者而定,需額外確認權限

    如果你已經習慣用某個外掛,可以:

    • 把外掛裡最常用的 Prompt,手動搬到 Chrome 的 Skills,讓「真正會每天用到的那幾個」留在瀏覽器原生工作流程中。

    💡 關鍵: Skills 的優勢不是「功能更多」,而是「離真實工作場景更近」,把 AI 變成瀏覽器內建的工作按鈕。


    怎麼開始:3 步驟快速上手

    1. 確認環境
    2. 更新 Chrome → 登入 Google 帳號。
    3. 確認你能在瀏覽器右側打開 Gemini 側邊欄。

    4. 選出你的「前三名常用 Prompt」

    5. 例如:
      • 英文 Email 改寫。
      • 報表摘要。
      • 網頁 / 影片整理成重點筆記。
    6. 先在 Gemini 裡照平常方式下指令,調整到滿意。

    7. 存成 Skills 並實際跑一次

    8. 用前面教的方式,將這三個 Prompt 各存成一個 Skill。
    9. 立刻在兩種不同頁面上試跑(例如兩封不同的信件、兩篇不同文章),看輸出是否符合期待,必要時再回頭微調 Prompt。

    這樣設定完,你之後在 Chrome 裡看到任何「值得用 AI 幫忙處理」的頁面,就不用思考要怎麼下指令,只要想:「這件事有沒有對應的 Skill 可以點?」

    🚀 你現在可以做的事

    • 打開你存 Prompt 的 Notion 或文件,挑出 3 個最高頻使用的指令,準備轉成 Skills
    • 在桌面版 Chrome 更新並登入 Google 帳號,確認 Gemini 側邊欄與 Skills 入口是否已可使用
    • 選一個固定重複的工作(如週報、Email 模板),寫成完整 Prompt,存成第一個可重複使用的 Skill
  • 🚀 Gemini 網頁版太難用?神級 Chrome 擴充套件「Voyager」讓效率飆升 500%

    🚀 Gemini 網頁版太難用?神級 Chrome 擴充套件「Voyager」讓效率飆升 500%

    隨著 AI 工具的普及,Gemini 已經成為許多人工作、寫程式與學習的得力助手。但老實說,Gemini 網頁版原生的使用體驗真的讓人不敢恭維!身為重度使用者的你,是否也常常遇到以下抓狂的狀況:

    • 對話紀錄像一本爛帳: 左側欄完全沒有資料夾分類,想找幾天前有價值的對話簡直像大海撈針。
    • 長對話翻找純屬折磨: 跟 Gemini 深度探討一個專案後,想回頭找前幾段的某個回答,滑鼠滾輪滑到快起火還是找不到。
    • 偶發的資料遺失: 辛辛苦苦調教出來的絕佳回答,隔天居然神秘消失?

    如果你對這些痛點也深有同感,那麼今天我要大推的這款完全免費的瀏覽器擴充套件——Voyager,絕對是你必裝的生產力「救星」!裝上它之後,上述的反人類設計不僅迎刃而解,還能讓你的 AI 詠唱效率直接翻倍。

    🛠 Voyager 核心功能全解析:把陽春網頁變身專業級 AI 工作台

    1. 📂 告別混亂:無限層級資料夾管理

    原生 Gemini 最讓人頭痛的就是毫無組織的歷史紀錄。Voyager 直接在介面左側植入了非常強大的資料夾功能。你不僅可以隨意新增資料夾,甚至支援建立「子資料夾」來達成多層級的精細分類。

    • 操作極度直覺: 只需選取或直接「拖曳」聊天紀錄,就能將工作、學習、生活分門別類,再也不用瞎找。
    • 多帳號隔離模式: 若你同時持有多個 Gemini 帳號(例如公司用與私人用),點擊右上角人像圖示即可開啟隔離模式。每個帳號的資料夾設定都是獨立的,完全不打架!

    2. ☁️ 無縫跨機作業:雲端同步與本地備份

    在公司電腦好不容易設定好的分類,回家還要重弄一次嗎?完全不用!

    • Google 雲端同步: 點擊「上傳到雲端」,綁定你的 Google 帳號後,即可將設定檔同步到雲端硬碟。到另一台電腦下載擴充功能後,一鍵就能恢復所有熟悉的環境。
    • 本地備份: 如果你高度注重隱私、不想上傳雲端也沒關係,Voyager 支援一鍵匯出至本地端備份,給足你滿滿的安全感。

    3. ⚡️ 生產力外掛:專屬「常用提示詞(Prompt)」面板

    安裝 Voyager 後,介面上會多出一個不遮擋視線的綠色懸浮圖示。點開它,這就是為你準備的專屬 Prompt 彈藥庫!

    • 一鍵呼叫: 你可以將自己高頻率使用的提示詞(例如特定翻譯指令、文章改寫模板或程式碼 debug 起手式)新增進去並打上標籤。下次要用時,一鍵點擊就能直接貼上對話框,省下大量複製貼上的重複勞動。
    • 格式匯出: 這些提示詞可以匯出成 JSON 格式,方便你管理或無縫套用到其他的 AI 工具上。

    4. 🔍 深度探討必備:引用回覆 & Fork 話題分岔

    當對話越來越深入,這兩個進階功能絕對會讓你愛不釋手:

    • 引用回覆: 以往要請 Gemini 針對某段話深入解釋,只能手動反白、複製、貼上再提問。現在只需選取目標文字,上方會自動彈出「引用回覆」按鈕,點擊即可帶入對話框,體驗極佳。
    • Fork(話題分叉): 跟 AI 聊到一半想追問一個「支線問題」,又怕破壞原本完美的主線脈絡?只要開啟 Fork 功能,點擊對話旁的圖示,Voyager 會幫你自動開啓一個新分頁,並無縫帶入前文脈絡。主線支線分開聊,思路再也不混亂!

    5. ⏳ 終結滾輪地獄:可拖曳時間軸導航

    進行長篇對話時,這是最具革命性的痛點殺手!開啟功能後,右側會出現一條時間軸。

    • 時間軸上的每一個「節點」代表你輸入過的一道指令。
    • 滑鼠懸停可以預覽文字,點擊節點就能直接跳轉到該段對話的位置。就像是這篇對話的「迷你目錄」,徹底拯救你的滑鼠滾輪與眼力!

    6. 💾 資料防護網:一鍵完整匯出對話

    有價值的對話心血,一定要掌握在自己手裡!現在只要將滑鼠移動到對話區左上角的 Gemini Logo 上,就會浮現下載圖示。支援將對話完整匯出為 JSON、PDF、圖片等多種格式,再也不怕系統當機吃掉你的心血結晶。

    📥 如何安裝 Voyager?

    這款強大的神級工具安裝非常簡單,且目前完全免費:

    1. Chrome 用戶: 點擊瀏覽器右上角選單 ➡️ 擴充功能 ➡️ 前往 Chrome 線上應用程式商店。
    2. 搜尋「Voyager」即可一鍵安裝。
    3. 重新整理 Gemini 頁面,將擴充功能「釘選」在瀏覽器頂部,馬上享受極致的 AI 體驗!

    💡 小提醒:除了 Chrome 之外,Firefox、Safari 等主流瀏覽器也都支援這款套件喔!

    🎯 結語

    總結來說,Voyager 這款擴充套件完美填補了 Gemini 原生介面的各種缺陷,一次解決了混亂、難找、操作繁瑣等絕大多數的痛點。如果你希望把 AI 真正變成提升生產力的利器,少走一點彎路,強烈建議你立刻安裝體驗!

    👇 讀者互動時間

    你在使用 AI 工具時,還有遇過哪些讓你抓狂的反人類設計呢?或者你手邊有什麼私藏的神仙擴充套件?歡迎在下方留言區跟大家分享交流喔!