去除 HTML 標籤能如何幫助您
使用此工具可移除 HTML 標記,只保留讀者能看見的文字。適用於清理複製的網站內容、準備純文字備註、比較可見的文字內容,或在將文字貼到不接受 HTML 的系統前先移除標籤。
標題、兩個段落與一個項目符號清單會轉換為易於閱讀的獨立行,而非一整段連續的文字。腳本、樣式、內嵌框架、SVG、MathML、template、object 與 metadata 等元素會被捨棄,因此其程式碼或隱藏的備援文字不會出現在結果中。
轉換原理
瀏覽器會將輸入讀取為未啟動的 HTML 文件。轉換器會逐個走訪可見的文字節點,在標題、段落、表格儲存格和清單項目周圍加入合理的斷行,並可選擇性地附加一般連結的目的端。它絕不會將提交的標記顯示為即時運作的網頁。
可讀模式會保留有用的段落與清單分隔,並以項目符號標示清單項目。精簡模式會將空白合併為單一串連的文字流。對於文件請選擇可讀輸出;對於搜尋索引、短預覽或單行比較則選擇精簡輸出。
如何使用 Strip HTML Tags
貼上或輸入一個小型且具代表性的範例,選擇可用的輸出模式,然後執行工具。在複製或下載結果之前,請先閱讀可見的結果。Reset 會將控制項回復到範例狀態,並清除目前的輸出,這在開始不同工作時相當實用。
複製清理後的文字以立即使用,或下載 stripped-html.txt。如果你需要連結目的端和文件間距,請嘗試以可讀模式執行 HTML to Plain Text。如果你需要 Markdown 而非純文字,請使用另外的 HTML to Markdown 轉換器。
結果中應檢查的項目
請檢視結果中依賴圖片、CSS 產生的內容、表單數值或互動控制項的文字;這些並非一般的文字節點,因此可能無法保留。當連結的目的端很重要時也應一併檢查,因為可見的錨點文字可能與其指向的網址不同。
如果結果為空或令人意外,請先檢查第一個可見錯誤、所選的模式,以及來源是否使用本頁面接受的語法。在回到重要的輸入之前,請先嘗試一個較小的已知範例;如此可區分出格式問題與對預期輸出的誤解。
隱私與重要限制
你的輸入與結果會保留在目前的瀏覽器分頁中。它們不會被傳送至 NexaCurrent、不會加入頁面網址、不會儲存至帳號,也不會在你重設或離開頁面後再次使用。在任何便利工具中,請避免貼上密碼、私密金鑰、存取權杖或個人紀錄,當使用較小的非敏感範例就能回答相同問題時更應如此。
移除標記並不等同於摘要、翻譯,或證明複製的內容是安全或正確的。由 JavaScript 之後載入的文字,除非已包含在貼上的 HTML 中,否則不會出現。複雜的視覺化表格與欄位可能會失去原本的閱讀順序。