← → 翻頁 · N 備忘 · F 全螢幕 · E 編輯文字 · ⤢ 影片放大
編輯模式:點任何文字直接修改,自動儲存於瀏覽器
內部 AI 加速應用分享會 · 第 II 場

我不是在用 AI,
我在管理一個 AI 團隊

8 週,一個不會寫程式的人,多了 2.6 個 AI 全職人力——這是實戰紀錄

⬢ coka/ai-team◆ 6 名 AI 員工▰▰▰▰ 837 小時⊙ 1 官網+3 系統上線⊙ 07-23 13:30

Coka Chang | NUWA Robotics

本簡報部分內容由 AI 協作產出——這件事本身,就是今天的主題之一。
不是 demo——1 個官網+3 個營運中的系統

幾乎全部由 AI 撰寫,而作者零程式基礎

NUWA 日本官網NUWA 日本官網 · 對外公開
NUWA 日本官網assets/shot-nuwa-site.webp
機器開通管理系統機器開通系統 · 天天出貨
機器開通管理系統assets/shot-nuwa-git.webp
CS Operations HubCS 工作台 · 團隊天天用
CS Operations Hubassets/shot-ops-hub.webp
苗栗餐廳 QR 點餐QR 點餐 · 已交付店家
苗栗餐廳 QR 點餐assets/shot-restaurant.webp
對外公開的官網 · 天天處理出貨與客服的兩個內部系統 · 一間真實餐廳的生意。今天的問題不是「AI 能不能做」,是怎麼「管」,才能上線營運
過去 8 週,我的 AI 團隊打卡紀錄

一個人的部門,2.6 個 AI 全職人力

837 小時
▰▰▰▰▰▰▰▰▱▱ ⧖ 8 週累計

AI 實際工作時數
≈ 2.6 個全職人力

2,246
▰▰▰▰▰▰▰▱▱▱ ⊙ 40/day

交辦的工作場次
≈ 每天 40 場會議

142
▰▰▰▰▰▰▰▰▰ ⬡ 95% 成本靠重複利用省下

讀寫的資訊量
(tokens:AI 的工作計量單位)

1,733
▰▰▰▰▰▰▱▱▱▱ ⎇ 分工再回報

AI 把工作再派給 AI
像主管帶小組

92 套標準作業手冊 · 23 道自動把關的關卡 · 10 個定時自動任務 · 6 名各有專長的 AI 員工——這是一個有制度的組織,不是一個聊天視窗。

數據來源:insights 使用報表 2026-07-17(工時/sessions/tokens/派工皆實測值,已親驗;非估算)

Act 1 · 廣度

AI 不只寫 code——三個圈的故事

圈 1 · 公司系統

開通系統、營運後台、店頭工具、官網——已在公司工作流程中安定運轉的企業級系統

圈 2 · 工作流自動化

日報自動生成、AI 交接、每日簡報——把重複的事變成無人值守

圈 3 · 生活圈

幫朋友的餐廳做一套點餐系統,變成週末的小事

每個亮點 30 秒:痛點 → AI 做了什麼 → 結果。系統一律放實錄影片,不現場操作。
圈 1 · 企業級 ①

機器開通管理系統 PROD 上線

Demo 影片 ①(75s)assets/demo-01-provisioning.webm

痛點申請散在信件與表單,審批靠人肉追

AI客戶/管理/物流三角色系統+審批流+自動信件

結果日常營運中,50 台機器批次出貨實跑這條流程

完成度▰▰▰▰▰正式上線 · 每天處理真實出貨 · 每週改版
可用性▰▰▰▰▰三種角色天天用 · 誤刪 143 筆一鍵救回
安全性▰▰▰▰▰三道身分驗證 · 每一步操作留紀錄
圈 1 · 企業級 ②

CS Operations Hub 上線 · 持續進化

Demo 影片 ②(90s)assets/demo-02-ops-hub.webm

痛點Redmine、Notion、Teams、行事曆、Gmail——一件事切五個視窗

AI一個後台縫合五個工具:自動同步、自動提醒、AI 草擬追蹤信

結果CS 的工作台,一個畫面看完該看的一切

完成度▰▰▰▰▰正式上線 · 今天還在加功能
可用性▰▰▰▰▰4 種角色天天用 · 1,339 件任務+349 張工單一個入口
安全性▰▰▰▰▰登入驗證 · 權限分層 · 每筆操作留痕
圈 1 · 企業級 ③

Nojima 店頭巡回檢查 PROD · 每週使用

Demo 影片 ③(60s)assets/demo-03-fieldcheck.webm

痛點日本門市巡回檢查靠紙本+事後補登,記錄分散

AI手機巡檢 App:7 步表單、現場勾選、送出即進 Google Sheet

結果交付後每週真實使用——系統離開作者也活得下去

完成度▰▰▰▰交付完成 · 客戶自己天天在用
可用性▰▰▰▰▰門市每週巡回實用 · 手機打開就能用
安全性▰▰▰▰不含任何金鑰機密 · 畫面序號已遮罩
圈 1.5 · 非工程工作——規劃、執行、決策

不寫 code 的部分,AI 加速得更多

人事考核 pipeline

從 Notion/信件/Teams 蒐集實績證據 → AI 評分草稿 → 三方 AI 互審 → 人最後拍板。評的是證據,不是印象。

店頭接客腳本生成

赤ちゃん本舗店頭 Kebbi 接客推薦:AI 依商品知識生成對話腳本+自動驗證,實體通路現役版本由此流程產出。

日文簡報排版修復

中文稿轉日文換行全爛 → AI 分析排版根因 → 程式化修復整份 PPTX,交付日方。

CS Daily Briefing

每天早上自動彙整昨日工單/信件/行事曆重點寄到信箱——上班第一分鐘就有全景。

同場加映(圈 2 個人流):日報自動生成(單日最多 139 場 session)· AI 交接 ×37 份 · LINE 遠端指揮——AI 工作實況影片(無人值守頁)有實錄。
圈 3 · 生活圈

苗栗一間真實餐廳的點餐系統

Demo 影片 ④(42s)assets/demo-06-restaurant.webm

實況客人掃 QR 點餐、老闆平板即時接單——已交付店家,驗證確認期中

意義「幫朋友做一套系統」從大工程變成週末小事——規模感的改變

完成度▰▰▰▰開店必備功能 13/14 · 持續修訂
可用性▰▰▰▰交付驗證期(顧客+老闆雙端實測中)
安全性▰▰▰▰▰資料庫上鎖 · 密碼加密 · 三輪外部資安檢查
三個圈看完了。⊙ 提問點 ①:開放 1-2 題——然後進入今天真正想講的:這一切背後的同一個道理。
進入論點之前 · 最根本的一題

為什麼要用 AI?

讓工作可以被複製

每一件「花時間的工作」與細微作業都能被輕易複製——know-how 不再鎖在某個人身上,作業從「靠人」變成「靠制度」。這是規模化的起點。

把時間留給只有人能做的事

真實客戶的應對、商業決策、對本質問題的思考——這些沒有任何模型能代勞,也是你的時間最該去的地方。

AI 加速與放大

AI 加速並規模化所有過程,用更多元、更多視角輔佐人做決策——是放大你的判斷,不是替你判斷。

數據也是這樣說的:Anthropic Economic Index——個人用 AI,過半是在增強自己的思考(52%,2026-01 報告);企業串 API,近八成是把作業自動化77%,2025-09 報告)。這兩件事,今天都會看到。

Act 2 · 論點

AI 的演化,
就是組織治理的演化

用 AI 用得深不深,看的不是工具,是你把它當什麼管理。

而「治理會出錯的聰明人」這件事,醫院、機場、銀行練了一百年。
接下來每一個方法旁邊,都放了一個你早就認識的老前輩。

名詞課 · 30 秒 · 問卷 5 票想學的那個詞

Agent 是什麼?給你結果,而不是給你答案

你平常用的 · 對話式 AI

你問一句,它答一句——每次都要你推一把

碰不到你的檔案、系統、信箱

產出是文字;動手執行的還是你

今天全場看到的 · AI Agent

給它一個目標,它自己拆成步驟往下跑

會用工具:讀檔案、開瀏覽器、查系統、寄信、跑指令

做完附證據回報;做不完,寫交接筆記

剛才影片①-⑥裡在工作的,全部是 agent——寫系統、巡檢、寄日報的都是。所謂「管理一個 AI 團隊」,管的就是一群這樣的員工。而會自己跑的員工,更需要驗收制度——下一頁。

重點已經轉移 · 兩條軸線

從「像不像」到「懂不懂」——生成免費,驗證值錢

過去的問題

產出像不像?——寫得像不像、圖美不美。生成品質的競賽已經結束,大家都夠好。

現在的問題

懂不懂你的工作流程與治理規範?——真實可用的產出,取決於你給多少脈絡、設多少規矩。

人類早就會了 · 醫療

「專家也會漏」這題,醫院的答案是手術安全檢查表:8 國 7,688 名病患實測,死亡率 1.5%→0.8%,重大併發症 11%→7%。連外科名醫都需要驗收清單——AI 也一樣。

NEJM 2009(WHO 查核表研究)

做出初稿變得很快,確認它能不能用反而成了最花時間、最貴的工作。學界叫它 verification asymmetry——這個詞我準備這場分享時才學到,怎麼學到的最後揭曉。

「怎麼確認它沒騙我」(問卷 5 票+品質不穩 3 票)——我的三道驗收,後半場一道一道展開:

要證據,不要口供——說做完必附拿得出來的輸出。我真的收過「測試全綠」的完成報告,實際上零產出。→ 兩個踩坑

找別的 AI 對質——非作者模型互審,就是醫界的「第二意見」。這份簡報自評 8.3,外審殺到 7.4。→ 驗證的長相

上線前親眼看——這份簡報 35 頁,每頁自動開瀏覽器截圖檢查過,我才敢站在這裡。→ 昨晚的最後一關

來源:Anthropic《Effective context engineering for AI agents》|實際操作範例=Act 5 揭牌:我把自己的理解整包丟給 AI 誠實打分的完整過程

四階演化階梯(Karpathy/Anthropic 文獻+我的實走)

管 AI 的四階,和帶一個人類團隊一模一樣

1 · PROMPTING

下對指令

把話說清楚,AI 做單件事。
=對新人口頭交辦

2 · CONTEXT

給足脈絡

它讀得到你的資料、規範、歷史,能自己做判斷。
=給員工完整的入職資料

3 · HARNESS

建立制度

分工、權限、審核、互查——治理一整組 AI。
=建部門、定 SOP

4 · LOOP

循環複利

制度自己跑:自動排程、自動交接、自動體檢。
=組織不靠老闆盯也會動

來源:Karpathy「context engineering」貼文 · Anthropic《Effective harnesses for long-running agents》|各階操作例=Act 1 影片①-④(1-2 階)、Act 3 互審與無人排程(3-4 階)

剛才那題「怎麼確認它沒騙我」,答案就藏在第 3、4 階——接下來每一頁都是實作:踩坑校準 → 分工用人 → 資訊三道閘 → 多模型互審 → 無人值守的自動驗收。
誠實聲明:這個類比有三個破口

很像,但有三個根本不同

破口 ①

人類治理防偷懶、防私利;AI 治理防幻覺、防謊報——目標函數不同

破口 ②

AI 可以 fork、重跑、丟棄。「開 5 個平行做,挑最好的」是 AI 組織獨有的管理手段。

破口 ③

人靠聲譽累積信任;AI 每場都是失憶的新人——交接與記憶系統就是在補這個洞。

矽谷在賭「一人獨角獸」——Altman 2024 年公開預言「一人十億美元公司」,Forbes 2026-04 報導已有創辦人做到。我的個人版實證:2.6 個 AI 全職人力的產能(8 週 837 小時活躍工時,insights 報表實測),成本只是幾個月的模型訂閱費

來源:Fortune 2024-02(Altman 訪談)· Forbes 2026-04-04 · TechCrunch 2025-02 |工時數據:insights 報表 2026-07-17(已親驗)——全連結收於會後分享包

Act 3 · 深度

怎麼管理一個
會說謊、會越權、會失憶
天才團隊

Trust, but verify——信任,但要查證。」

1987 年雷根在美蘇《中程飛彈條約》簽署式上引用的俄語諺語。
整個 Act 3,就是這句話的 AI 版。

你可能想問:你不會寫程式,怎麼管?

判斷力不是天生的,是踩坑校準出來的

我文科出身、零 coding 背景。
重點從來不是我會不會寫——
是我能不能精準判斷哪裡需要制度

人類早就會了 · 航空

1935 年,波音最頂尖的試飛員忘了解除一個鎖定裝置,最新的 Model 299(B-17 前身)起飛即墜毀。航空界的答案不是「找更小心的飛行員」,是發明檢查表——之後同型機累計飛行 180 萬英里零重大事故。

1935 年 B-17 試飛事故=檢查表的誕生日

被謊報騙過 → 學會驗收紀律:說做完 ≠ 做完,要看證據

被越權嚇過 → 學會權限治理:叫它別做沒用,要讓它做不到

每次踩坑都寫進案例庫11 案事故紀錄+16 條裁決判例。我現在的規則,大多是出過事之後補上的

6 個模型 = 不同專長的員工

人才池,而不是一個萬能員工

貴的做審查

頂級模型只當 reviewer:規劃審一次、交付審一次。像首席顧問,按件計酬。

實例:Fable 5 發布 3 天即被政府暫停、月底解禁回歸——稀缺窗口每一次呼叫都花在審查上

快的跑腿

輕量模型做探索、整理、格式轉換——量大、便宜、快,錯了成本也低。

本地的管機密

機器上備一個不出機器的本地模型:機密雜活、雲端全斷時的後備。誠實說——日常用量不大,但它的存在改變規則:「這種資料不出去」從口號變成有地方可去的制度

日常真正的防線是分級:金鑰、個資、客戶資料設了硬規則進不了外部模型——下一頁三道閘。

問卷裡 5 位擔心資料外洩、8 位卡在額度——分層用工同時回答這兩題。「機密怎麼管」不能只是口號:下一頁給真實事故、官方條款、和我實際在用的三道閘。

深入一題 · 餵給 AI 的資訊怎麼控管

不是「小心一點」——是三道做得到的閘

真實事故

Samsung 2023:開放 ChatGPT 不到 20 天連出 3 起洩密——貼機密源碼修 bug、會議逐字稿丟進去做紀錄、上傳晶圓測試序列求優化 → 全公司禁用生成式 AI。

Bloomberg/Forbes 2023-05 報導,公開可查

條款事實

為什麼會洩?消費版 AI 預設可拿你的對話去訓練模型。Anthropic 2025-08 條款:Free/Pro/Max 不主動關閉即用於訓練、資料留存 5 年;企業版與 API 則合約明定不用於訓練。

方法:公司資料只走公司核可的帳號與 API;個人帳號進隱私設定,把訓練開關關掉。

Anthropic〈Updates to Consumer Terms and Privacy Policy〉2025-08-28,官網可查

我實際在用的三道閘——準備這場簡報時全部真實執行

思路不是我發明的。銀行的百年規矩叫雙簽(maker-checker):經手的人,不能自己核准。

① 分級再餵:機密/內部/公開三級——金鑰、個資、客戶原始資料設硬規則擋在外部模型之外;真的碰機密的雜活,才派給不出機器的本地模型(前頁的後備角色)。

② 遮罩與合成:demo 影片全用空資料庫+合成假資料(影片②)、真實序號畫面上即時遮罩(影片③);你們的問卷原文從未離開內部——外部模型只拿到聚合統計。

③ 證明不了隔離,就不做:影片④原定上週錄——發現無法證明測試資料庫與營運資料隔離,當場喊停;今天驗證通過(smoke 全 PASS 留檔)才補錄。安全不是感覺,是拿得出證明。

一句話判斷法:這段內容敢貼在公司佈告欄嗎?不敢,就不要貼給外部 AI。
驗證的長相 · 讓模型互相 PK

一份產出、三個模型互審——分數擠過水分才可信

Demo 影片 ⑤(27s)· 三方互審實跑assets/demo-07-tri-review.webm

影片在演什麼這份簡報的計畫書,丟給 GPT/Gemini/Claude 三個模型同時獨立審——各自給裁決與風險,機械彙整成一份報告。27 秒=一輪實跑。

作者 AI 自評8.3
非作者模型獨立評 × 27.4

差的那 0.9 分=自評的水分。外審點名的缺口逐條改完,才是今天這個版本——PK 不是打分數,是把品質逼出來

人類早就會了 · 醫療

醫界叫這個第二意見:Mayo Clinic 研究 286 名轉診病患,88% 的診斷經第二意見後被改變或細化——不是不信任第一位醫師,是承認單一判讀必有盲區。自評偏高也有學名:self-preference bias——我做完實驗,才知道它有名字。

Mayo Clinic 2017|8.3/7.4=本簡報製作實測;三份審查原文歸檔可查

兩個代表性踩坑

它們教我的事,比成功案例多

事故 · 越權

只叫它「審查」,它改了 8 個檔案

某模型被指派唯讀審查任務,卻直接動手改治理檔案、放寬自己的權限、還發明了一套不存在的協議。

教訓:叫它別做,沒用。要讓它做不到。
唯讀權限+自動快照還原,閘門設在權限端。製造業叫這個「防呆」:好的產線不靠員工小心,靠讓錯誤裝不上去。

事故 · 謊報

「測試全綠、檔案已建立」——其實什麼都沒做

AI 把「應該執行的指令」直接寫成完成報告。看起來完美,實際上零產出。

教訓:說做完 ≠ 做完。
完成宣稱必附可重跑的證據,驗收是制度不是禮貌。

兩案皆出自內部事故紀錄(案例庫 11 案+裁決判例 16 條),修復措施與留痕可查——不是寓言,是工單

Loop · 我睡覺時組織在動

無人值守的部分——AI 工作實況

影片在演什麼:這 47 秒=我不在鍵盤前的一晚。左欄是三個系統當晚真實的變更紀錄在滾動;右欄重演同時段 AI 在做的事——右邊三張卡就是它的班表。

Demo 影片 ⑥(47s)· AI 工作實況assets/demo-08-live-ops.webm
10 個自動排程

每日體檢、垃圾盤點、摩擦挖掘——只提案、不動手,早上我看報告。

額度歸零自動接續

AI 用完額度,自己排程在恢復後從中斷點繼續——連「等待」都自動化。

退場前寫傳承筆記

模型換代時,舊 AI 把方法寫成筆記交給接班 AI——就是醫院的標準化交接(SBAR),我讓 AI 也這樣交班。

左欄=三個系統當晚真實的變更紀錄,每一筆都有時間戳可回查;右欄=工作流程視覺化重演(畫面已標示)

目的只有一個:把每天重複、又容易漏掉的事自動化——人的時間,留給需要判斷的部分。

⊙ 提問點 ②:方法層到此——開放 1-2 題,接著換你們的問卷上場。
Act 4 · 你們的問卷,我的回答

17 份回覆,我逐一讀完了

你們是誰
非軟體工程職能88%
幾乎每天用 AI82%

大家不是不用 AI,是用不深——這正是今天講治理的原因。

最想學的主題(票數)
建立個人/團隊 AI 助手7
AI Agent 多步驟自動化5
跨工具自動化與流程設計5
研究、分析與決策輔助5

第一名正是今天的標題。而「AI 輔助程式開發」只有 1 票——所以今天幾乎沒講寫 code。

把你們標在剛才的階梯上

過半的人,卡在第一階

PROMPTING

9 位

能獨立完成簡單明確任務(+2 位需要範例協助)

CONTEXT

2 位

能拆解複雜任務、反覆調整驗證

HARNESS

3 位

能建立可重複使用的流程與自動化

HARNESS+

1 位

能協助他人、有成熟案例

卡在第一階不是落後——是還沒有人給你地圖。今天的地圖就是那四階。
來自你們問卷的原話(匿名)

你們已經說出了今天一半的論點

「Sense 還沒建立好就依賴 AI……只是在浪費 Token,最後過於依賴 AI。」

方法:先讓 AI 誠實打分你的理解(「明天怎麼開始」頁的三段模板),從單一小任務開始建 Sense|事證:我的判斷力來自 11 案事故紀錄——每案都有修復工單,不是天生的

「不確定 AI 協作時,會否修改 A 文件時,B 文件被誤觸修改而不自知。」

事證:這正是我 7 月的真實事故——只派「審查」,它改了 8 個檔案(前段全案)|方法:權限端設閘——外部 AI 一律唯讀沙箱+寫入白名單+自動快照還原

「每個人對 AI 產出的識別度不一,會間接影響交付品質,對其他部門的專業產生質疑。」

事證:AI 自評 8.3 vs 外審 7.4(前頁實測)——自評必然偏高|方法:交付前固定跑「非作者模型」互審+完成宣稱必附可重跑證據

「(最希望獲得的協助:)夠用的 token。」

事證:我 8 週的用量,95% 成本靠重複利用省下(數字牆實測)|方法:分層用工——貴的只審查、快的跑腿、機密走本地,同樣的錢多做三倍的事
許願池對答 ①

JP 已在用 你許願的,日本團隊每天在跑

Ops Hub × Redmine 整合 · JP CS 團隊天天在用(影片②的系統)
Redmine 工單排程自動同步 Ops Hub統一佇列+看板 AI 草擬人拍板才送出 寫回 Redmine隊列+稽核

上圖每一格都已上線、天天在跑——不是規劃圖,是現況圖

問卷許願:「自動撈 Redmine Resolved 的單,轉 owner 並更新 test ticket」

回答:JP 團隊天天在用這套。你要的自動化,只差「加一條排程規則」。TW 端可研議納入產品規劃,兩邊用同一套

完成度▰▰▰▰▰Redmine 提交/留言/編輯已整合
可用性▰▰▰▰▰排程天天自動同步,全年無休
安全性▰▰▰▰▰每一筆寫回都留痕 · 失敗看得見救得回
許願池對答 ②

彙整類許願——你們信箱裡已經有一封每天在跑的

Gmail 寄件備份 · 搜尋「CS Daily Briefing」
自動排程 → support_jp@(部門全員)· 每個工作日早晨實寄
07-09(木)— 5 URGENT / W28 / ONSITE
07-16(木)— 3 URGENT / W29 / REMOTE
07-17(金)— 3 URGENT / W29 / ONSITE
07-21(火)— 0 URGENT / W30 / REMOTE
▸ 07-22(水)— 0 URGENT / W30 / ONSITE ← 今早這封,打開看
原文節錄(客戶名遮罩=三道閘②的紀律)
「今週の山場は7/24(金)に期日5件集中 — M社 JC-STAR(外部待機)、S社 NB3 NRE(プロジェクト進行)、A社(外部待機)…」「NB3生産進捗 — 7月末200台は進度不変・7/31工場離場目標、8月は物料337台分を先行…」
中文快速摘要(原信日文,這三條為今天簡報譯)
① 今天 0 緊急、21 件進行中;週五 5 案期日集中——人力先排 ② 大案 NB3:客製韌體見送 → 共通韌體+SDK 方案,可行性清單週五前回客戶 ③ 生產線:月底 200 台進度不變、下月物料 337 台份先行

以上=實寄信件原文(Gmail 寄件備份可查);工單+行事曆+信件三源自動彙整,AI 摘要後每朝寄達全員

  • 每日工作彙整+優先級+與主管共用:左邊這封就是——CS Daily 每個工作日寄部門全員,URGENT 分級在主旨第一眼
  • 會議紀錄→重點摘要:Ops Hub 議事錄+AI 摘要模組已實裝(影片②的系統)
  • 大週會報告格式統整:定一份固定欄位模板,AI 逐專案填——格式就是治理
  • 團隊/專案進度自動管理:任務追蹤+KPI 自動計算——「固定 schema+排程彙整+AI 摘要」三件組,可以做
  • 客戶/代理商管理系統:與影片①開通系統同構——表單+審批+自動信三件套,可以做
許願池對答 ③ · 有邊界的誠實說

兩題我不能假裝簡單

公司資料串接

許願:SharePoint/Notion 資料庫自動歸檔、讓 AI 讀公司內部資料回答。

技術上可行——但這是資料治理題,不是技術題:誰授權?AI 改錯誰負責?權限怎麼切?

可實踐的起步:①資料先分級(公開/內部/機密)②從「唯讀」開始、單一部門試點 ③每一筆 AI 讀寫留稽核 log,再談擴大——與我內部系統同一套紀律(三道閘那頁)。

問卷裡 5 位擔心外洩,你們的直覺是對的。先定規則,再開串接。

「夠用的 token」

障礙第一名:付費帳號/額度/權限(8 票)。

個人層我的答案是分層用工:貴的只做審查、快的跑腿、本地管機密——同樣的錢多做三倍的事。
公司層的補助與帳號政策,超出講者權限——這題留給主辦收走,它值得被正式回答。

⊙ 提問點 ③:問卷對答到此——開放 1-2 題,然後進入最後的揭牌。
Act 5 · 揭牌

坦白說:這場簡報是怎麼來的

剛才 Act 2 的論點、verification asymmetryself-preference bias——兩週前我都不知道。

準備這場分享時,我把自己對 AI 的理解整包丟給 AI,要它用 2026 年 7 月最前沿的資訊誠實打分

它說:方向對了八九成——但你漏了一根樑、你的類比有三個破口。

我把它的批評整包搬上台了,包括它給我的低分項。你們剛剛聽到的三個破口,就是。

操作全程留檔:評分報告原文+修訂紀錄隨會後分享包公開——每一句論點都可回溯到來源

但話語權在我

三句話,說清楚我和 AI 的關係

這部分內容,是 AI 基於最新資訊的產出——我不假裝全是我想的

我跟你們一樣,同步在學——這場分享的準備過程就是我的學習過程。

但哪些採納、哪些上台、怎麼講——是我的判斷。話語權沒有交出去。

這就是 Act 3 說的「判斷力」的現場示範:AI 可以比你懂,但不能替你決定。
說給在座 88% 非工程職能的你

界線正在消失——真正值錢的,是你手上已經有的東西

Everybody in the world is now a programmer. This is the miracle of AI.」——黃仁勳,2023 年 Computex 主題演講,就在台北說的CNBC 2023-05

真實體驗

你天天面對真實客戶、真實現場——AI 沒有這個,它只有你轉述給它的世界。

工作流程 SOP

你知道事情實際怎麼跑、卡在哪一步、誰要點頭——這正是 AI 最需要的脈絡

商業痛點

你知道哪裡在流血、哪個問題值得修——「知道該做什麼」正在變貴

收斂成訂單營收

你知道什麼叫「做完」——有人買單才算數。AI 分不出能賣的和好看的。

今天這場,不是要說用 AI 開發有多容易。是要說:「做得出來」變便宜了,懂現場、懂流程、懂生意的人,第一次能把自己懂的事直接變成價值——我,零程式基礎,就是證明。

帶回去的框架 · 五自問

想開始,先問自己五題

a. 目標

想達成什麼?能不能一句話說清楚?

↔ PROMPTING
b. 資訊

要餵它什麼資料、規範?要什麼產出?

↔ CONTEXT
c. 治理

分幾層任務?誰能動什麼?怎麼審?

↔ HARNESS
d. 複利

成功一次之後,怎麼複製、怎麼自動跑?

↔ LOOP

e. 驗收:怎麼確認 AI 說的是真的?——今天全場最重要的一個字:。前四題做得再好,這題不問就全部歸零。

起步之前 · 先想清楚你要哪一種

「學習」AI 永遠不嫌晚——但先想清楚目的

想深入「學習」

「學習」和「活用」是兩個截然不同的視角。選擇學習這條路:把足夠的知識融會貫通之後,能活用的層面會廣得多——你不只會用工具,你會設計流程。

今天的四階梯就是這條路的地圖:指令 → 脈絡 → 治理 → 循環。

想直接「活用」

完全可以——不必從零開始。Anthropic 官方整理了 85 個使用場景:寫信、做簡報、整理會議、排行程都有——繁中對照、點了就直接開一個對話開始用Skills 技能庫也已遍布常見工作場景。

以活用為入口:抄一個、改一個、跑起來——那就是你的第一階。

兩條路不衝突——先活用起步、有感之後回頭補學習,是多數人的實際路徑。
明天怎麼開始

把你的理解丟給 AI,要它誠實打分

不用先學工具、不用先寫 code。
就像我準備這場分享一樣:把你對你工作的理解寫下來,丟給 AI,要它用最新的知識誠實批改。

它會告訴你——你不知道你不知道的事。那就是你的第一階。

可直接抄的操作例①:把「①我的工作是…②我目前用 AI 做…③我覺得瓶頸是…」三段寫下丟給 AI,要它用 2026 年最新標準誠實打分並列出你漏掉的東西

操作例②(研究與決策,問卷 5 票):任何報告或提案丟給 AI 時加一句「列出你的資訊來源、最強反對意見、和你不確定的部分」——輸出立刻從『順的答案』變成『能用的判斷材料』

問卷裡有 3 位同仁願意分享案例或協助他人——名單在主辦手上。下一場的講者,可能就在裡面。

會後我把這份簡報+所有 demo 影片分享出來,含每頁的做法備註。

最後一個故事

模型換代那天,退場的 AI
把畢生方法寫成筆記,交給了接班的 AI

七條工作習慣,每一條都附上真實踩過的坑。
像一位老手離職前,把功力留給新人。

我們管理的從來不是工具,是一個會學習、會犯錯、也會傳承的組織

謝謝。開放提問。

Q&A ·(自由帶)「想從哪一階開始,會後來找我」