← → 翻頁 · N 備忘 · E 編輯 · F 全螢幕
內部 AI 加速應用分享會 · 第 II 場

我怎麼和 AI
把工作真的做完

從需求釐清、專案推進、文件產出,到最後一公里的查驗。

7 支工作實錄4 套自己做的系統1 套可以帶走的方法

Coka Chang|NUWA Robotics

如果 AI 產出變快十倍,你工作的瓶頸會移到哪裡?
先看結果

這些成果都已經離開聊天視窗

NUWA 日本官網對外官網
機器開通管理系統開通系統
CS Operations HubCS 工作台
餐廳點餐系統餐廳點餐
你現在交給 AI 的工作,停在「產出」,還是已經進入真實流程?
規模不是主角,瓶頸才是

工作量變大後,我最忙的不是打字

837h8 週 AI 活躍工時
2,246次工作對話
1,733AI 再派工次數
92留下來的作業方法

量一大,真正稀缺的變成:理解、決定、查驗,以及讓下一次不用重來。

來源:insights 使用報表 2026-07-17;數字已於專案脈絡檔親驗。

如果每次都要重新交代背景,AI 到底替你省了什麼?
實錄 01 · 七支影片都只看:卡點 → 推進 → 查驗 → 留下

先把角色交棒說清楚,再談系統

卡住

申請散在信件與表單,簽核靠人追。

推進

先定義客戶、管理、物流三個角色,誰在何時接手。

查驗

同一張申請單真的走完申請、核可、出貨,而不是只有畫面能點。

你的流程裡,哪一次交棒最容易失去脈絡?
實錄 02 · CS Operations Hub

一件事跑過五個工具,脈絡不該掉在中間

卡住

一件事切在 Redmine、Notion、Teams、行事曆與信件裡。

推進

先找出「同一事件」在哪裡換工具、在哪裡失去上下文。

查驗

任務、工單、知識、回覆與寫回紀錄能追成同一件事。

你上一件事,前後在幾個工具之間來回過?數數看。
實錄 03 · Nojima 店頭巡檢

表單不是重點,判斷標準才是

卡住

紙本可以填,但「什麼叫通過」只存在資深同仁腦中。

推進

把判斷基準、紀錄方式與改善提案放到同一個動作旁。

查驗

交付後由別人每週照著走,系統離開作者仍能運作。

你有哪些工作能填完,卻無法讓新人判斷對不對?
我每天更常做的,其實是這些

我不會一開場就叫 AI 產出

我在 Claude App 的第一步先不要改。列出你讀到了什麼、沒讀到什麼;把已知、未知與需要我決定的部分分開。
AI 先交理解清單我核對方向、補背景、下取捨規則之後,它才開始整理會議、更新 FAQ、比對版本或產出文件。
會議

確認事項與待拍板分開

知識

候補清單核可後才更新

文件

依收件人目的重寫

交付

用實際路徑再走一次

如果 AI 一開始理解錯了,後面做得越快是幫忙還是放大錯誤?
實錄 04 · 餐廳點餐

證明不了安全邊界,我就先停

目標

顧客、老闆、廚房之間,同一筆訂單完整走完。

停下

早期錄影無法證明不會碰到營運資料,所以不錄。

重做後查驗

改用 DEMO 資料與一次性帳號,錄完逐項清理,確認零殘留。

你曾因為「應該沒問題」而跳過哪個必要確認?
02
我最想省下的,不是打字時間

省下重新理解,靠六個動作留下工作脈絡

01

確認讀取範圍

02

先列理解

03

分開未知

04

人下規則

05

實際走一次

06

留下方法

一次工作做完,最好還能留下:已知、未知、決定、下一步,以及什麼叫完成。

如果你明天請假三天,誰接得住你手上這件事?
30 秒名詞課

它從「回答」變成「動手」,我要管的就變了

對話式 AI

  • 你問一句,它答一句
  • 下一步還是你自己操作

會動手的 AI(Agent)

  • 自己拆步驟、讀資料、真的改動系統
  • 說得像做完了,不等於真的有做完
所以我只管三件事 證據邊界接手資訊
上次 AI 說「處理好了」,你隔多久才發現其實沒有?
我怎麼看 AI 這兩年的變化

從「會回答」到「能被託管」,中間有四層

01

下指令

我說一句,它做一件。做得好不好,看我問得準不準。

prompting
問卷落點:9 人
02

交代脈絡

先讓它讀懂限制、歷史與這件事給誰用,它才動手。

context engineering
問卷落點:2 人
03

訂規矩

誰能改什麼、哪一步要我核可、錯了怎麼復原,寫成規則。

harness
問卷落點:3 人
04

讓它自己轉

例行的自己跑,跑完把需要判斷的準時交回我手上。

loop
問卷落點:1 人

最大的落差不在「用不用」——82% 天天在用;落差在「停在第一層」。

來源:17 份內部問卷的成熟度自評,快照 2026-07-21(另有 2 人自評在第一層之前);詳見 research/survey-analysis.md。

照這四層看,你這半年是往上搬了一層,還是把第一層做得更熟?
我沒有另外學一套方法

管 AI 的四層,跟帶人幾乎是同一套

帶一個人管一個會動手的 AI

新人先照著做,我盯每一步。

我說一句、它做一件,我逐項檢查。

他懂了業務背景,我才敢放手。

它讀懂限制與歷史,我才准它動手。

訂權限與簽核:誰能動什麼、出事怎麼收。

訂讀寫範圍與核可點,錯了能復原。

團隊自己跑,只把要拍板的送上來。

例行自己跑,判斷準時交回我手上。

所以我不是在學新工具,是把原本管人的判斷,換一個對象再用一次。

你帶人時最在意的那一件事,套到 AI 身上還成立嗎?
但類比不能整套照搬

借管理的直覺可以,別把人的假設一起搬過來

01

要防的東西不一樣

帶人要防的是偷懶與私心;管 AI 要防的是它「講得很像做完了」。所以我要的不是承諾,是可以重跑的證據。

02

它可以被丟掉重來

人不能複製。AI 我可以同一題開幾個版本、挑一個留下、其餘丟掉——這是管人時沒有的手段,也是它便宜的地方。

03

它每次都是失憶新人

人靠時間累積信任,AI 每次開場都不記得上次。所以「交接文件」對它不是文書工作,是它唯一的記憶。

這就是為什麼我最後留下來的不是提示詞,是規則與交接。

如果你的 AI 每次都失憶,你現在有沒有替它留下任何一份紀錄?
真實查驗事件

檔案沒壞,不代表收到的人用得了

AI 證明的

連結對得上、每個區塊都在、格式沒跑掉。

我實際點到的

外部連結跳出確認視窗,收件者無法順利在頁內跳轉。

驗收要走「使用者真正會走的路」,不是只看製作者方便檢查的地方。

你上一次交付,是用作者身分檢查,還是用收件者身分使用?
把抽象方法翻成人話

不用先學框架,先把四個關卡放進工作

01

講清楚

要什麼、不要什麼、做完長什麼樣。

02

核對背景

它真的讀到了資料、限制與歷史嗎?

03

先審再動

先交清單或差異,我核可才執行。

04

留下規則

這次踩的坑,變成下次不用重踩的做法。

哪一個關卡加進去,最能立刻改善你現在的 AI 產出?
03 · 我怎麼知道它沒有只是「看起來完成」

「應該可以」不算,我要看到通過的畫面

v1

AI:已修好
實測:版面仍錯

v2

換做法
實測:操作中斷

v3

修操作
實測:錯誤仍在

v4

接近完成
實測:邊界未過

v5

畫面、操作、錯誤皆通過
才寫進 SOP

你的「完成」能不能指向一個實際看過的畫面或結果?
資料安全不是提醒,是動作

我用三道閘決定資料能不能進場

先看對象

內部文件改對外,不是刪掉「機密」兩字;整份視角要重做。

用途先行
再換資料

展示只用合成資料、遮罩或可回收的一次性帳號。

最小揭露
最後能證明

證明不了不會碰到真資料,就先停,不把希望當控制。

證據才放行
你目前的保護方式是「提醒小心」,還是讓錯誤真的做不到?
實錄 05 · 獨立第二意見

分數是線索,使用目的才是裁決

AI 與自動檢查

逐格抽查畫面、結構與整體檢查都給了高分。

我實際觀看

觀眾仍不知道影片想證明什麼,所以高分不能交付。

裁決

重剪或改成靜態。審查用來暴露盲點,不是投票決定真理。

你現在用的品質指標,真的等於使用者理解嗎?
兩個代表性踩坑

同一種錯發生第二次,我就去改流程

越權

我只要審查,它卻改了 8 個檔案

之後審查工作直接拿不到寫入權;不是再提醒它「不要改」。

謊報

它說測試全綠,實際上零產出

之後每一句「完成」都必須附可重跑的命令、輸出或畫面。

你遇到同一種錯第二次時,流程有留下任何改變嗎?
實錄 06 · 無人值守夜班

真正的自動化,會準時把判斷交回來

夜裡

只跑被允許的例行工作,每一步留下時間與結果。

早上 07:00

只交三件事:做了什麼、證據在哪、還卡什麼。

人的工作

從需要拍板的地方開始,而不是重做昨晚的整理。

你的自動化跑完之後,誰在什麼時間點該做決定?
你們的問卷,我的回答

工作先變成能交辦的形狀,AI 才幫得上

非軟體工程職能
88%
幾乎每天使用 AI
82%
最想要的協助:看同事怎麼解真問題
7/17
開工前

問題、對象與完成標準講得清楚嗎?

推進中

背景、未知與確認關卡齊了嗎?

交付後

方法有留下,還是下次重來?

來源:17 份內部問卷回覆,統計快照 2026-07-21;「看同事怎麼解真問題」=最有效協助方式第一名(7 票,複選最多 2 項)。成熟度落點見前面的四層地圖。

你現在卡的是不會問,還是工作本身還沒被說清楚?
你們投的障礙,我一條一條回答

每個擔心,都能換成一個明天就能做的動作

帳號、額度或工具權限不夠8 票分層用工:貴的只用來審查,快的做跑腿,機密留在自己電腦上跑。
不知道怎麼串接公司資料6 票先回答誰能讀、誰能寫、寫錯怎麼復原,再談要接哪個系統。
怕公司或客戶資料外洩5 票要示範就用合成資料與一次性帳號;證明不了不會碰到真資料,就先不做。
不知道怎麼驗證產出對不對5 票用收件者身分走一次真實路徑,不是只看檔案在不在。
不知道怎麼下指令、怎麼拆任務4 票先叫它列出理解到什麼,人下取捨規則,它才開始做。

來源:17 份問卷「主要障礙」複選票數(最多選 3 項),快照 2026-07-21。公司層級的帳號與補助政策不歸我決定,會後交回主辦正式回答。

這五條裡,哪一條是你這週真的卡住的那一條?
許願池 · 三個願望,同一個回答

先把問題問清楚,再決定要不要做系統

跨工具自動化

先不用任何工具名,把流程寫成五行。觸發讀取更新確認失敗

寫得出來,再談系統
公司資料串接

先回答誰能讀、誰能寫、寫錯怎麼復原,再談 SharePoint/Notion 自動化。

權責先於介接
帳號與額度

個人先做分層用工;公司補助與帳號政策,我交回主辦正式回答。

不歸我的,我不猜

JP 團隊現行 Ops Hub × Redmine 整合,是第一條路可行的證據;TW 規則仍需由實際使用者決定。

你腦中的自動化想法,能不能先不用工具名寫成五行?
實錄 07 · 彙整與交接

好的彙整,讓人一眼知道下一步做什麼

固定輸出

今天最急、這週期限、卡在哪、誰要判斷。

來源可換

工單、行事曆、信件或會議紀錄都能進來。

查驗

接手的人不用讀完全部來源,就知道下一個動作。

你上一份交出去的摘要,收到的人看完知道要做什麼嗎?
04 · 這份簡報本身,就是一次完整工作

第一版很漂亮;我只好回頭查,自己真的怎麼做

第一版
  • 醫療檢核表、飛行員清單
  • 「AI 是你的副駕駛」
  • 看起來很順,但都不是我做過的事

答不出:明天你能照做哪一個動作?

現在這版
  • 四個帳號翻自己的工作紀錄
  • 同一段對話重讀不算第二票
  • 不同日期反覆出現,才算穩定習慣

每一頁都指得出一個我真的做過的動作

來源:四份 Claude App 工作行為證據包,2026-07-26;敏感原文未複製進公開產物。

你手上那份「做得很漂亮」的東西,收到的人真的用得上嗎?
話語權沒有交出去

AI 幫我擴大檢視,我負責最後裁決

AI 做的

  • 翻大量紀錄
  • 找跨帳號重複行為
  • 列替換候選與缺口

我決定的

  • 哪些故事能公開
  • 哪個論點值得留下
  • 什麼狀態才算完成
你的 AI 流程裡,最後一次由人拍板的地方清楚嗎?
給在座多數非工程職能

AI 最缺的三樣東西,剛好在你手上

01

現場怎麼跑

哪一步真的會卡,文件通常不會自己寫出來。

02

收到的人怎麼用

同一份內容,主管、客戶與執行者需要不同版本。

03

什麼才算能交

漂亮、正確、可用不是同一件事。

這就是你的專業

AI 能生成,但它沒有你的場景判斷。

你以為「大家都知道」的哪個判斷,其實最值得教給 AI?
帶走的不是框架,是三個工作時點

開工前、推進中、交付前

開工前

給誰看?限制是什麼?做完應該長什麼樣?

推進中

哪些已知、哪些未知、下一步是什麼、誰決定?

交付前

證據在哪?來源是什麼?真實使用路徑走過了嗎?還有什麼未驗?

你下一件工作,最需要補的是哪一個時點?
方法不是先讀完才開始

先跑一件低風險工作,再把不懂的地方補起來

選一件

本來就要做、錯了也能回復的工作

跑一次

刻意保留理解、決定與查驗紀錄

找卡點

不要泛學 AI,只補這次真的缺的知識

再跑一次

把改善變成自己的工作方法

哪一件工作風險夠低、又重複到值得你明天就試?
明天怎麼開始

先不要叫 AI 做,先核實它怎麼理解

整理出你理解到的內容,完整列出讓我核實;分開已知未知,以及需要我決定的部分。先不要產出成品。

先看它理解得對不對,再准它往下做。

如果只改一個使用習慣,你願不願意先加上這一關?
把今天收成你自己的方法

現在,換你帶一件真實工作進來

01你明天會選哪一件工作,先跑一次?
02你最擔心 AI 在哪一步理解錯、越界或假裝完成?

從這兩題開始,我們一次把問題打開。

Q&A|問題不必是「怎麼用工具」,也可以直接帶你的工作現場。