Formshift

支援格式與目前的限制

四種轉換功能目前實際支援哪些格式、還有哪些限制——會隨著產品更新調整,不是永久不變的清單。

Markdown → PDF

標準 Markdown 語法(標題、粗體/斜體、清單、引言、表格)

程式碼區塊(含語法高亮)

Mermaid 圖表

圖片(網址)

會自動縮放到符合頁面寬度。

圖片(Base64 內嵌)

會自動縮放到符合頁面寬度——Dashboard 上有內建的「本機圖片轉 Base64」工具。

圖片(本機檔案路徑,例如 ./diagram.png)

請改用網址或轉成 Base64。

任意格式 → Markdown

Word(.docx)

PDF(有文字層)

掃描或純圖片組成的 PDF 不支援,見下方常見問題。

Excel(.xlsx/.xls)

理論上支援,但還沒用真實檔案完整驗證過。

~

PowerPoint(.pptx)

理論上支援,但還沒用真實檔案完整驗證過。

~

PowerPoint 舊版二進位格式(.ppt)

請先另存成 .pptx 再上傳。

HTML(.html/.htm)

純文字/CSV/JSON/XML

CSV 會轉成 Markdown 表格,其他格式會保留原始內容。

ZIP 壓縮檔

會自動解壓縮,裡面每個檔案都會被個別轉換並合併成一份結果。

文件裡內嵌的圖片

Word/PowerPoint 來源檔會完整保留。PDF 來源檔是例外——詳見下方常見問題。

~

獨立圖片檔案(PNG、JPG 等)

詳見下方常見問題。

Outlook 郵件(.msg)

音訊檔案

任意格式 → PDF

Word(.docx)

PDF(有文字層)

掃描或純圖片組成的 PDF 不支援,見下方常見問題。

Excel(.xlsx/.xls)

理論上支援,但還沒用真實檔案完整驗證過。

~

PowerPoint(.pptx)

理論上支援,但還沒用真實檔案完整驗證過。

~

PowerPoint 舊版二進位格式(.ppt)

請先另存成 .pptx 再上傳。

HTML(.html/.htm)

純文字/CSV/JSON/XML

CSV 會轉成表格,其他格式會保留原始內容。

ZIP 壓縮檔

會自動解壓縮,裡面每個檔案都會被個別轉換並合併成一份結果。

文件裡內嵌的圖片

Word/PowerPoint 來源檔會完整保留。PDF 來源檔是例外——詳見下方常見問題。

~

獨立圖片檔案(PNG、JPG 等)

會轉出幾乎空白的 PDF,詳見下方常見問題。

Outlook 郵件(.msg)

音訊檔案

圖片 → Markdown(OCR)

英文

繁體中文

日文

自動偵測(混合語言)

會同時跑三種語言,準確度明顯低於選對單一語言。

~

其他語言(簡體中文、韓文等)

目前尚未支援。

PDF → Markdown(OCR)

掃描或純圖片組成的 PDF

使用跟「圖片 → Markdown」不同的引擎(MinerU)——會盡量還原標題、表格與閱讀順序,不只是抽出純文字。

已有可選取文字層的 PDF

請改用「任意格式 → Markdown」——更快、也更省點數,本來就處理得了這種情況。

常見問題

為什麼上傳一張照片或截圖到「任意格式 → Markdown/PDF」轉不出任何文字?

「任意格式 → Markdown/PDF」沒辦法從一張獨立的圖片檔案裡讀出文字——這個轉換類型沒有內建 OCR。轉換不會顯示錯誤,但結果會是空白的。請改用獨立的「圖片 → Markdown(OCR)」轉換功能,那是專門為此設計的。這跟「文件裡已經內嵌的圖片」(例如貼在 Word 文件裡的照片)是兩回事,內嵌圖片會被「任意格式 → Markdown/PDF」正確保留——但有一個例外:PDF 來源檔,詳見下一題。

「圖片 → Markdown(OCR)」準確度如何?支援哪些語言?

目前支援英文、繁體中文、日文三種語言模式,選擇跟圖片內容相符的語言可以得到最好的準確度。也有「自動偵測」模式可以處理混合語言內容,但會同時跑三種語言,準確度明顯低於選對單一語言。準確度高度依賴圖片「版面是否乾淨」,不只是解析度高低:掃描文件、純文字截圖效果很好;但如果是 App 或網頁介面的截圖——文字旁邊混著圖示、彩色按鈕/標籤、或內嵌照片——辨識效果會差很多,緊貼圖示的文字可能整段消失,圖示本身也可能被誤判成亂碼文字。如果辨識結果看起來像亂碼,換一個更精確的語言通常沒有幫助,因為問題出在原圖版面太複雜,不是語言選錯。系統會在辨識前自動加強每張圖片(調整對比、小圖放大),對不少情況有幫助;辨識信心不足的結果也會在歷史紀錄裡標示警示,不會讓你誤以為亂碼是正確內容——但版面真的很複雜的截圖,還是建議把結果當草稿看待,不要直接當作正確答案使用。另外有一個「高精度」引擎選項(4 點數,只能用付費點數),專門針對這種複雜截圖情境設計——圖示旁邊的文字辨識效果好很多,也能正確把內嵌照片跟文字分開,但沒有自動信心檢查機制(結果不佳不會像預設引擎那樣顯示警示),也可能偶爾漏掉極小的文字元素。這個引擎沒有語言選項。

為什麼掃描版的 PDF 用「任意格式 → Markdown/PDF」轉不出內容?

如果 PDF 是由掃描頁面或圖片組成、沒有可選取的文字層,「任意格式 → Markdown/PDF」沒有文字辨識(OCR)功能可以抽取內容,這些頁面轉出來會是空白或不完整。請改用獨立的「PDF → Markdown(OCR)」轉換功能,那是專門為此設計的。

為什麼 PDF 裡內嵌的圖片,用「任意格式 → Markdown/PDF」轉換後沒有出現在結果裡?

這是底層轉換套件的真實限制,不是 bug。Word、PowerPoint 來源檔的內嵌圖片會被保留(轉成內嵌 Base64),但 PDF 來源檔完全不會,不管圖片在原始檔案裡是用什麼方式嵌入的——這個套件的 PDF 轉換器只會抽取文字跟表格,完全沒有圖片抽取的功能。目前「任意格式 → Markdown/PDF」內沒有解決辦法。如果你的 PDF 是掃描或純圖片組成的,「PDF → Markdown(OCR)」是另一個工具、解決的是另一個問題——它會對整頁重新跑 OCR,不是用來保留「文字旁邊插了一張照片或插圖」這種情境的圖片。

「PDF → Markdown(OCR)」是怎麼運作的?準確度如何?

它使用跟「圖片 → Markdown(OCR)」(Tesseract)不同的引擎(MinerU)——這個引擎是專門設計來解析文件版面的,會嘗試還原標題、表格、以及正確的閱讀順序(包含多欄版面),不只是抽出一整段純文字。因為使用的引擎比其他轉換類型重,所需點數也比較多。這個功能專門處理掃描或純圖片的 PDF——如果您的 PDF 本身已有可選取的文字,請改用「任意格式 → Markdown」(更快、更省點數)。跟「圖片 → Markdown(OCR)」一樣,系統信心不足的結果仍可能有錯誤;請把輸出當作品質不錯的初稿,版面特別複雜的文件更要仔細檢查重要內容。

上傳檔案的大小上限是多少?

「任意格式 → Markdown」「任意格式 → PDF」「圖片 → Markdown(OCR)」「PDF → Markdown(OCR)」這四種類型共用同一個上限:單一檔案 500MB。這個上限在上傳當下就會被擋下來——超過大小的檔案會直接被拒絕,不會扣點數,Dashboard 選到過大的檔案時也會立刻提示。「Markdown → PDF」運作方式不同——它不是上傳檔案,是貼上或輸入文字內容(可以用 .md 檔案預先帶入),實際上限大約是 20MB 的內容大小,包含任何 Base64 內嵌的圖片。

舊版的 .ppt PowerPoint 檔案可以轉換嗎?

目前只確定支援新版的 .pptx 格式。舊版二進位 .ppt 格式還沒驗證過——請先在 PowerPoint 裡另存成 .pptx,再上傳那個檔案。

為什麼 Markdown → PDF 裡寫的本機圖片路徑(例如 ./diagram.png)沒有出現在輸出的 PDF 裡?

Markdown → PDF 只會收到你貼上或寫的文字內容,沒辦法讀取你電腦上的檔案。請改用圖片網址,或是把圖片轉成 Base64 直接貼進內容裡(Dashboard 上有內建的轉換工具)。