關於這個站

一個小工具,以及它背後的想法

Docs to MD 把文件轉成 Markdown。產品就這一件事。

由一名獨立開發者做和維護,轉換全程跑在你自己的瀏覽器裡。

生效日期 2026-08-04

為什麼會有這個東西

寫東西在 Word、Google 文件和試算表裡,發佈卻在 Markdown 裡 —— 靜態站、Wiki、README、git 倉庫裡的 docs 目錄。這中間那道坎,被手工跨過去的次數遠比應該的多,而手工意味著重新敲一遍標題、重新拼一遍表格、把連結一個個補回去。

能做這件事的轉換器不少。它們幾乎都是同一套路:你把檔案上傳到伺服器,那邊的程式轉好,你再下載結果。這個設計本身沒問題,但它同時意味著你的文件會在別人的機器上待一會兒。對一篇部落格草稿來說無所謂,對一份合約、一份病歷、一組內部數字、一部還沒發表的稿子來說就不是。

所以這個站反過來做。轉換用 JavaScript 跑在你的瀏覽器裡,在你自己的機器上。沒有上傳這一步,因為壓根沒有可上傳的地方。

實際是怎麼跑的

你把檔案丟進來,瀏覽器在本機讀它,把位元組交給同樣跑在瀏覽器裡的解析器。解析器把文件變成一個結構,這個結構再寫成 Markdown。整條鏈路只在你的檔案和你的螢幕之間。

解析器都是開源套件,按格式各選一個:

  • Mammoth 讀 .docx。舊的 .doc 由我們自己寫的讀取器逐位元組解析 —— 那是 2007 年前的二進位格式,沒有能在瀏覽器裡跑的現成套件。
  • PDF 用 Mozilla 的 pdf.js。它和它需要的字型、字元對應表都由本站提供,不走 CDN —— 一個文件解析器還要去第三方拿東西,就把這件事的意義抵消了。
  • HTML 先過 DOMPurify 清洗,清乾淨之後再由 Turndown 轉成 Markdown。
  • CSV 和 TSV 用 Papa Parse;.xlsx 工作簿用 read-excel-file。

刻意不做的事

沒有帳號,因為沒有東西要存。沒有 API,因為沒有伺服器可呼叫。沒有 OCR,所以掃描版 PDF 轉不了 —— 而工具會直接告訴你,不會甩給你一個空檔案。沒有 Google 雲端硬碟對接,因為那意味著要向你索取全部檔案的存取權,並且替你保管一個權杖。

每種轉換也都有實打實的限制,各個工具頁會列自己那一份。合併儲存格會被壓平,因為 Markdown 的管線表格表達不了。修訂記錄會被丟掉。PDF 的標題層級是從字級推的、不是讀出來的,因為 PDF 本身不記這個。這些話寫在前面,而不是等你轉完了要緊的東西才發現。

錢從哪來

工具免費,也沒有付費方案。打算用廣告覆蓋主機成本,所以以後你可能會在這些頁面上看到廣告。廣告絕不會擺在容易被當成下載或轉換按鈕的位置,也不會在轉換完成後突然插進來、把頁面在你游標底下頂走。

廣告不改變轉換的方式。你的檔案照樣留在你機器上 —— 這不是一條為了收入就能翻過來的政策,而是「壓根沒有伺服器」這件事的必然結果。

姊妹站

Docs2HTML 做的是反方向的同一件事:把 Markdown、DOCX、CSV 和 Excel 轉成 HTML。同樣的做法,同樣的隱私模型,輸出格式不同。

這頁上有看不明白的地方,或者你想讓我們改點什麼? 聯絡