Clean HTML From Word Documents
Anyone who’s had to convert Word docs to HTML knows it can be a real pain in the you-know-what. There are very few easy automated ways to do it.
Удаление html тегов и очистка формата WORD. Получить HTML код без лишних тэгов.
Инструкция по применению:
1. Скопируйте документ из Word или Exel в буфер обмена Windows (Ctrl+С)
2. Вставьте документ в поле Document (Ctrl+V)
3. Нажмите кнопку CLEAR HTML
4. В окне HTML Source появится очищенный от лишних HTML-тэгов код. Выделите его мышкой и скопируйте его в буфер обмена Windows (Ctrl+С)
5. Вставьте скопированный HTML в редактор (Ctrl+V)
Особо проследить, чтобы удалились:
ссылки картинки цвета align (форматирование)
Вставьте в это поле текст из WORD:
В этом поле очищенный от лишних тэгов HTML код:
Кликните на текст, чтобы выбрать весь текст, затем нажмите , чтобы скопировать текст в буфер обмена, перейдите в нужную вам программу и нажмите , чтобы вставить скопированный текст.
© Скрипт написан автором, все права принадлежат автору.
Скрипт предназначен для очищения мусора из html кода в онлайне.
HTML Cleaner – сервис очистки html тегов от «мусора», который остается в документе после сохранения страницы в формате html из программы MS Word.

Давным давно я написал подобный плагин, но он был сделан на скорую руку, сейчас механизм полностью переписан.
Очистка кода происходит методом перебора введенной строки из которой формируется новая, содержащая «чистый» код. Плагин удаляет абсолютно все из тегов, в том числе и из тегов html 5. В непарных тегах проставляется символ /(слеш). Удаляются пустые теги, например конструкция
будет удалена, так как она ничего не содержит.
Как работает html cleaner?
Есть два способа:
- В программе MS Word выберите данные, которые хотите очистить от мусора, чтобы выбрать все, нажмите Ctrl + A. Вставьте скопированный текст в поле ниже(должна быть выбрана вкладка «Вставить данные MS Office»), нажмите кнопку «Готово».
- Перед тем, как оптимизировать код выберите в Word «Сохранить как…», далее укажите Тип файла «Веб-страница с фильтром», затем откройте сохраненный файл в текстовом редакторе, скопируйте код и вставьте в поле ниже(должна быть выбрана вкладка «Вставить HTML»), нажмите кнопку «Готово».
В результате Вы получите девственно чистый html код.
Не тронутыми остаются следующие атрибуты:
Не забывайте оставлять свои комментарии, которые помогут мне исправить ошибки или сделать доработки.
| « Предыдущая запись Как определить «разрешение экрана» и «размер окна браузера» на JavaScript и jQuery |
Следующая запись » CSS меню горизонтальные и вертикальные, выпадающие и раскрывающиеся, многоуровневые |
День добрый, дорогие читатели! Надеюсь у вас также хорошо, как и у нас — солнце светит, птички поют, тепло и наступило лето! У меня пока диссертация, поэтому последних месяца полтора я пишу только раз в неделю, физически не успеваю. Но не будем о грустном, перейдём к делу!
Когда-то давно я копался в интернете на тему поиска скрипта, очищающего код HTML от мусора, который, в частности, оставляет всеми нами «горячо любимый» в этом плане Microsoft Word. Ранее я использовал очистку кода посредством Adobe Dreamweaver, но у него было два недостатка:
Второй пункт стал для меня критичен, так как мне приходилось работать с большими таблицами html, от которых на одном сайте никак нельзя было отойти, а всю информацию они предоставляли в Ворде.
Таким образом, блуждая долго по интернету, я нашёл скрипт, который справляется со всем этим хозяйством на ура, и при этом полностью настраиваем.
В целом код для очистки не сложный, разобраться проблем не должно возникнуть. Однако есть одно маленькое но: скрипт работает корректно только в Internet Exploited Explorer. А скачать в архиве пример можно по ссылке:
И напоследок поделюсь одной из любимых широкоформатных обоин (1920×1200), валяющихся бесхозно у меня на компе. Наслаждайтесь летом, обоиной, и очищайте Ваш HTML код от всякого мусора! =)