
過去談 Markdown 與 HTML,多半是在比較哪一種比較容易寫、哪一種適合文件、哪一種適合網站。到了 AI Agent 與生成式 AI 快速發展的階段,問題開始改變:今天讀取網站的,不再只有人類與搜尋引擎,還有 LLM、RAG 系統與可以自行瀏覽網頁的 Agent。
這讓一個新的網站架構問題浮現:網站是不是除了 HTML,也應該準備一個更乾淨、更容易讓 AI 取得內容的表示方式?
1. 為什麼 Markdown vs HTML 又重新成為熱門話題?
HTML 一直是 Web 的核心格式。瀏覽器依靠 HTML 建立文件結構,搜尋引擎從 HTML 取得標題、段落、連結、圖片與語意資訊,網頁上的按鈕、表單、導覽與互動也建立在 DOM 之上。
Markdown 的定位不同。它把標題、清單、連結、程式碼與段落濃縮成容易書寫的純文字結構。當 AI 只是想「讀懂文章」時,這種較少 boilerplate 的格式就非常有吸引力。
內容優先
結構短、容易閱讀、容易 chunk,適合文章、文件、RAG 與 LLM context。
Web 優先
保留語意、DOM、表單、導覽、Structured Data 與互動能力,適合瀏覽器、SEO 與 Agent 操作。
2. HTML 是為 Web 而生,Markdown 更接近內容表示
HTML 不只是「另一種文字格式」。像 <nav>、<article>、<form>、<button>、<label> 這些元素,都在描述頁面角色與互動關係。
<nav>...</nav> <article> <h1>AI Web Design</h1> <p>...</p> </article> <form> <label>Email</label> <input type="email"> <button type="submit">Sign in</button> </form>
Markdown 可以非常乾淨地保存文章內容,卻不會完整保存「這是一個可送出的表單」、「這個 label 對應哪個 input」、「這個按鈕目前是否 disabled」等瀏覽器狀態。
3. 為什麼 AI Agent 會喜歡 Markdown?
一個真實網頁的 HTML 往往還包含導覽、Cookie banner、追蹤碼、CSS class、SVG、推薦卡片、UI wrapper 與大量非正文資訊。對只需要摘要文章或建立知識索引的模型來說,這些都是額外 context。
因此 Markdown 在「純內容讀取」場景的優勢通常來自三件事:資料比較乾淨、token 使用較少、內容結構容易保留。2025 年的 ReaderLM-v2 研究甚至專門訓練模型將複雜 HTML 轉為乾淨 Markdown 或 JSON,反映 HTML → AI-friendly representation 已成為實際需求。
4. AI 閱讀網站與 AI 操作網站,是兩種不同任務
閱讀 / 摘要 / RAG
文章正文、文件與知識內容,Markdown 通常更有效率。
導覽 / 輸入 / 執行
需要 DOM、表單狀態、ARIA 與互動結果時,HTML / browser environment 更重要。
所以「Agent-friendly」不能簡化成「把 HTML 全部改成 Markdown」。一個能真正幫使用者登入、搜尋、選擇方案或送出資料的 Agent,仍需要理解網頁介面。
5. `Accept: text/markdown`:一個網址,兩種表示方式
2026 年 Cloudflare 推出 Markdown for Agents。啟用後,AI 系統可以對同一個網址送出 Accept: text/markdown,Cloudflare 會在可行時把來源 HTML 即時轉換為 Markdown 回傳。
GET /article Accept: text/markdown HTTP/2 200 Content-Type: text/markdown Vary: Accept
這個方向的重要性在於:網址本身可以不變。對瀏覽器提供 HTML,對偏好 Markdown 的 Agent 則提供精簡內容。網站不一定需要多維護另一套文章 URL。
6. 但 Google Search 並不要求 Markdown
Google 在 2026 年更新的生成式 AI Search 官方指南中明確說明:網站不需要建立 llms.txt、AI text files、特殊 markup 或 Markdown,才能出現在 Google Search 與其生成式 AI 功能中;這些檔案對 Google Search 的 visibility 或 rankings 不會帶來特殊加成。
Google 的生成式 AI Search 仍建立在既有 Search index、ranking 與 quality systems 之上。因此網站原本的 SEO 基礎——可索引頁面、清楚技術結構、獨特且有價值的內容——仍然重要。
它可以是其他 Agent / LLM 的內容介面,但不應取代正常 HTML SEO。
7. 那 llms.txt 放在哪裡?
/llms.txt 是一項以 Markdown 編寫的提案,希望提供網站摘要與重要內容連結,讓 LLM 或 Agent 更容易找到適合閱讀的資源。它更接近「AI-readable discovery layer」,而不是 sitemap.xml 的替代品。
目前最合理的做法,是把它視為可以服務特定 AI 工具的額外介面,而不是 Google ranking factor。
8. Markdown vs HTML:不同使用場景該選哪一個?
| 使用場景 | Markdown | HTML | 建議 |
|---|---|---|---|
| 人類瀏覽一般網站 | 有限 | ★★★★★ | HTML |
| 新聞/部落格正式發布 | ★★★ | ★★★★★ | HTML 為主 |
| SEO 與 Google Search | ★★ | ★★★★★ | HTML |
| Structured Data | ★ | ★★★★★ | HTML + JSON-LD |
| AI Agent 閱讀文章 | ★★★★★ | ★★★ | Markdown |
| LLM Context / RAG | ★★★★★ | ★★★ | Markdown |
| 大量正文擷取 | ★★★★★ | ★★★ | Markdown |
| 降低非必要 Token | ★★★★★ | ★★ | Markdown |
| 技術文件/知識庫 | ★★★★★ | ★★★★ | Markdown 很適合 |
| 表單與使用者輸入 | ★ | ★★★★★ | HTML |
| 按鈕與 Web UI | ★ | ★★★★★ | HTML |
| AI Agent 操作網站 | ★★ | ★★★★★ | HTML / DOM |
| Accessibility 語意 | ★★ | ★★★★★ | HTML |
| 複雜 Web App | ★ | ★★★★★ | HTML |
| AI-readable 純內容層 | ★★★★★ | ★★★ | Markdown |
| 同時服務搜尋與 Agent | ★★★★ | ★★★★★ | HTML + Markdown |
如果目標是顯示、搜尋與互動,HTML 仍是核心。如果目標是撰寫、傳遞與讓 AI 高效率讀取內容,Markdown 更有優勢。
9. 更合理的架構:HTML + Markdown
下一代網站不一定要選一邊。更有彈性的方式是維持單一內容來源,再輸出多種 representation。
Single source of truth
│
├── HTML → Humans / Browsers / Search
│ UI / semantics / structured data / interaction
│
└── Markdown → Agents / LLM / RAG
clean content / lower overhead / easier ingestion這個架構的重點不是維護兩篇文章,而是讓同一份內容可以根據不同讀取者輸出不同格式。
10. 網站經營者現在應該做什麼?
目前沒有必要把整個網站改成 Markdown。實際優先順序仍應該是先把 HTML 做好:使用清楚 heading hierarchy、semantic HTML、正常 internal links、可索引正文、正確圖片替代文字與需要時的 Structured Data。
之後,再依實際 Agent / LLM 需求評估 Markdown output、content negotiation、AI-friendly documentation 或 llms.txt。
換句話說:不要為了 AI,而破壞原本對人類、瀏覽器與搜尋引擎友善的 Web。
FAQ
Markdown 會取代 HTML 嗎?
短期內幾乎不可能。HTML 負責 Web 的文件語意、介面與互動;Markdown 更像精簡內容表示,兩者解決的問題不同。
Markdown 對 Google SEO 比較好嗎?
沒有。Google 2026 官方指南明確指出,不需要 Markdown 或 llms.txt 才能出現在 Google Search 的生成式 AI 功能中,而且這些特殊檔案不會直接提升 visibility 或 rankings。
AI Agent 一定需要 Markdown 嗎?
不一定。純閱讀或 RAG 場景中 Markdown 很有效率;若 Agent 需要操作網站,HTML、DOM、ARIA 與瀏覽器狀態反而更重要。
llms.txt 是新的 sitemap.xml 嗎?
不是。sitemap.xml 主要服務 URL discovery;llms.txt 是希望提供 LLM / Agent 一個人與機器都容易閱讀的內容導覽。
網站需要人工維護 HTML 和 Markdown 兩份內容嗎?
不一定。比較合理的方向是 Single Source of Truth,再由系統輸出 HTML 與 Markdown。
Accept: text/markdown 會建立另一個網址嗎?
不一定。HTTP content negotiation 的重點正是可以對同一個 URL 根據 Accept header 回傳不同 content type。
結語:下一代網站可能同時服務人類與 AI
Web 過去主要為人類瀏覽器建立。現在,AI Agent 正逐漸成為另一種讀取者。
它們不一定需要動畫、漂亮卡片與完整視覺層;很多時候只需要乾淨、結構清楚、容易處理的內容。這就是 Markdown 再次受到關注的原因。
但 HTML 並沒有因此失去價值。更可能的未來是:HTML 繼續成為 Web 的介面與語意層,Markdown 則成為部分 AI 系統偏好的內容層。
資料方向參考:Google Search Central 2026 Generative AI optimization guide、Cloudflare Markdown for Agents、llms.txt proposal、ReaderLM-v2 research。