ឧបករណ៍យកស្លាក HTML ចេញ
ដកស្លាក HTML ទាំងអស់ចេញពីចំណុចអត្ថបទមួយ។
1. សេចក្តីផ្តើម
កម្មវិធីលុបស្លាក HTML គឺជាឧបករណ៍អនឡាញដ៏សាមញ្ញមួយដែលលុបស្លាក HTML ទាំងអស់ចេញពីប្លុកអត្ថបទ។ ប្រសិនបើអ្នកមានមាតិកាដែលបានចម្លងពីគេហទំព័រ អ៊ីមែល CMS ឬកម្មវិធីកែសម្រួលកូដ ដែលមានធាតុ HTML ដូចជា <p>, <div>, <strong> ឬ <br> ឧបករណ៍នេះនឹងបម្លែងវាទៅជាអត្ថបទធម្មតាដែលស្អាតភ្លាមៗ។
ស្លាក HTML មានប្រយោជន៍សម្រាប់ការរៀបចំទម្រង់ទំព័រវេបសាយ ប៉ុន្តែមិនតែងតែសមស្របទេ នៅពេលដែលអ្នកត្រូវការអត្ថបទសុទ្ធ (Raw Text)។ ឧទាហរណ៍ អ្នកអាចចង់បិទភ្ជាប់អត្ថបទទៅក្នុងមូលដ្ឋានទិន្នន័យ បញ្ជូនមាតិកាទៅកាន់ API សម្អាតទិន្នន័យដែលបានទាញយក ឬរៀបចំអត្ថបទសម្រាប់ការវិភាគ។ ជំនួសឱ្យការលុបស្លាកដោយដៃម្តងមួយបន្ទាត់ ឧបករណ៍នេះនឹងលុបវាដោយស្វ័យប្រវត្តិក្នុងរយៈពេលតែប៉ុន្មានវិនាទី។
ឧបករណ៍នេះងាយស្រួលប្រើសម្រាប់អ្នកចាប់ផ្តើម ហើយមិនត្រូវការចំណេះដឹងបច្ចេកទេសឡើយ។ គ្រាន់តែបិទភ្ជាប់មាតិកា HTML របស់អ្នក បញ្ជូនវា ហើយអ្នកនឹងទទួលបានកំណែស្អាតដោយគ្មាន Markup។ វាមានប្រយោជន៍ជាពិសេសសម្រាប់អ្នកអភិវឌ្ឍន៍ អ្នកកែសម្រួលមាតិកា អ្នកទីផ្សារ និងអ្នកវិភាគទិន្នន័យដែលតែងតែធ្វើការជាមួយមាតិកាផ្អែកលើវេបសាយ។
2. របៀបដែលវាដំណើរការ
កម្មវិធីលុបស្លាក HTML ដំណើរការមាតិកាដែលអ្នកប្រើប្រាស់បានបញ្ជូន ហើយលុប Markup HTML ទាំងអស់ ខណៈពេលដែលរក្សាទុកអត្ថបទដែលអាចអានបាននៅខាងក្នុងស្លាកទាំងនោះ។ ដំណើរការគឺសាមញ្ញ៖ វាស្កេនខ្សែអក្សរបញ្ចូល ហើយដកធាតុ HTML ទាំងអស់ចេញ ដោយទុកតែអត្ថបទធម្មតាប៉ុណ្ណោះ។
ប៉ារ៉ាម៉ែត្របញ្ចូល
- មាតិកា (តម្រូវឱ្យមាន): ប្លុកអត្ថបទដែលអាចមានស្លាក HTML។ វាលនេះមិនអាចទុកទទេបានទេ។
ច្បាប់ផ្ទៀងផ្ទាត់
- វាល មាតិកា មិនត្រូវទុកទទេទេ។
- ការបញ្ចូលដែលមានតែដកឃ្លាត្រូវបានចាត់ទុកថាមិនត្រឹមត្រូវ។
- ត្រូវការនិមិត្តសញ្ញាសុវត្ថិភាព (Security Token) ដែលមានសុពលភាព ដើម្បីការពារការបញ្ជូនដោយគ្មានការអនុញ្ញាត។
ប្រសិនបើវាលមាតិកាទទេ ឬមិនត្រឹមត្រូវ ឧបករណ៍នឹងបង្ហាញសារកំហុស ហើយនឹងមិនដំណើរការសំណើនោះទេ។ វាជួយធានាភាពត្រឹមត្រូវនៃទិន្នន័យ និងការពារការដំណើរការដែលមិនចាំបាច់។
តក្កវិជ្ជាដំណើរការ
នៅពេលការផ្ទៀងផ្ទាត់បានជោគជ័យ ឧបករណ៍នឹងប្រើមុខងារនៅផ្នែក Server ដើម្បីលុបស្លាក HTML ទាំងអស់ចេញពីអត្ថបទដែលបានបញ្ជូន។ នេះរួមបញ្ចូលទាំងធាតុ HTML ស្តង់ដារដូចជា ចំណងជើង កថាខណ្ឌ តំណភ្ជាប់ ស្លាកទម្រង់ Script និងធាតុ Inline។ អត្ថបទនៅខាងក្នុងធាតុទាំងនោះនឹងនៅដដែល។
ឧទាហរណ៍ ប្រសិនបើការបញ្ចូលមាន៖
<p>Hello <strong>World</strong></p>
លទ្ធផលនឹងក្លាយជា៖
Hello World
រចនាសម្ព័ន្ធលទ្ធផល
- លទ្ធផល: អត្ថបទធម្មតាដែលបានសម្អាត ដោយលុបស្លាក HTML ទាំងអស់ចេញ។
ដែនកំណត់
- ស្លាក HTML ទាំងអស់នឹងត្រូវបានលុបដោយគ្មានករណីលើកលែង។
- ការរៀបចំទម្រង់ ដូចជាការបំបែកបន្ទាត់ អាចបាត់បង់ ប្រសិនបើវាត្រូវបានកំណត់ដោយធាតុ HTML។
- ឧបករណ៍នេះមិនរក្សាទុកស្លាក HTML ជាក់លាក់ណាមួយឡើយ។
3. របៀបប្រើឧបករណ៍នេះ
- បិទភ្ជាប់មាតិកា HTML របស់អ្នកទៅក្នុងវាលបញ្ចូល។
- ត្រូវប្រាកដថាវាលមាតិកាមិនទទេទេ។
- បញ្ជូនទម្រង់ដើម្បីដំណើរការមាតិកា។
- ចម្លងអត្ថបទធម្មតាដែលបានសម្អាតពីតំបន់លទ្ធផល។
ឧបករណ៍នឹងដំណើរការមាតិការបស់អ្នកភ្លាមៗ ហើយផ្តល់ជូនកំណែដែលគ្មានស្លាក HTML។
4. ឧទាហរណ៍ជាក់ស្តែង
ឧទាហរណ៍ទី 1៖ សម្អាតមាតិកាគេហទំព័រ
ការបញ្ចូល៖
<h1>Welcome</h1><p>This is a <em>sample</em> page.</p>
លទ្ធផល៖
WelcomeThis is a sample page.
ករណីប្រើប្រាស់៖ ទាញយកអត្ថបទដែលអាចអានបានពីការនាំចេញ CMS មុនពេលបញ្ចូលវាទៅក្នុងអ៊ីមែលអត្ថបទធម្មតា។
ឧទាហរណ៍ទី 2៖ រៀបចំទិន្នន័យសម្រាប់មូលដ្ឋានទិន្នន័យ
ការបញ្ចូល៖
<div class="description">Product <strong>A1</strong> - <span>$29.99</span></div>
លទ្ធផល៖
Product A1 - $29.99
ករណីប្រើប្រាស់៖ រក្សាទុកការពិពណ៌នាផលិតផលជាអត្ថបទធម្មតានៅក្នុងជួរឈរមូលដ្ឋានទិន្នន័យ។
5. ករណីប្រើប្រាស់សម្រាប់អ្នកអភិវឌ្ឍន៍
- សម្អាតទិន្នន័យបញ្ចូលរបស់អ្នកប្រើប្រាស់
លុប Markup HTML ចេញពីមាតិកាដែលបង្កើតដោយអ្នកប្រើប្រាស់ មុនពេលរក្សាទុកក្នុងមូលដ្ឋានទិន្នន័យ ដើម្បីការពារការរៀបចំទម្រង់ដែលមិនចង់បាន ឬ Script ដែលបានបង្កប់។
- សម្អាតទិន្នន័យសម្រាប់ API
នៅពេលប្រើ API ភាគីទីបីដែលផ្តល់មាតិកាជាទម្រង់ HTML សូមលុបស្លាកចេញមុនពេលដំណើរការ ឬបង្ហាញវានៅក្នុងបរិយាកាសដែលប្រើអត្ថបទធម្មតា។
- លំហូរការងារ Web Scraping
បញ្ចូលតក្កវិជ្ជានេះទៅក្នុងលំហូរការងារ Scraping ដើម្បីទាញយកអត្ថបទដែលអាចអានបានពីទំព័រ HTML មុនពេលធ្វើការវិភាគអត្ថបទ ឬធ្វើ Indexing។
- ប្រព័ន្ធកំណត់ហេតុ និងសវនកម្ម
រក្សាទុកកំណត់ហេតុដោយគ្មានការរៀបចំទម្រង់ HTML ដើម្បីធានាថាកំណត់ត្រាមានភាពស្របគ្នា និងអាចស្វែងរកបាន។
ឧទាហរណ៍ក្នុង PHP
$input = "<p>Example <strong>text</strong></p>";
$output = strip_tags($input);
echo $output; // Example text
ឧទាហរណ៍ក្នុង JavaScript
function removeHtmlTags(str) {
return str.replace(/<[^>]*>/g, '');
}
const input = "<p>Hello <b>World</b></p>";
console.log(removeHtmlTags(input)); // Hello World
ត្រូវផ្ទៀងផ្ទាត់ទិន្នន័យបញ្ចូលជានិច្ច និងអនុវត្តការការពារ CSRF ឬវិធានការសុវត្ថិភាពសមមូល នៅពេលបញ្ចូលទៅក្នុងប្រព័ន្ធ Production។
6. សំណួរដែលសួរញឹកញាប់
តើកម្មវិធីលុបស្លាក HTML ធ្វើអ្វី?
វាលុប Markup HTML ទាំងអស់ចេញពីអត្ថបទ ហើយផ្តល់អត្ថបទធម្មតាដែលស្អាត។
តើឧបករណ៍នេះលុប JavaScript និងស្លាក Script ដែរឬទេ?
បាទ/ចាស។ ធាតុ HTML ទាំងអស់ រួមទាំងស្លាក Script នឹងត្រូវបានលុប។
តើអត្ថបទនៅក្នុងស្លាកនឹងនៅសល់ដែរឬទេ?
បាទ/ចាស។ មានតែស្លាកប៉ុណ្ណោះដែលត្រូវបានលុប ខណៈដែលអត្ថបទដែលអាចអានបាននឹងត្រូវរក្សាទុក។
តើឧបករណ៍នេះមានសុវត្ថិភាពសម្រាប់ទិន្នន័យរសើបដែរឬទេ?
វាដំណើរការអត្ថបទដែលបានបញ្ជូនដោយសុវត្ថិភាព ប៉ុន្តែអ្នកគួរតែអនុវត្តតាមការអនុវត្តសុវត្ថិភាពល្អបំផុតជានិច្ច នៅពេលគ្រប់គ្រងព័ត៌មានរសើប។
តើខ្ញុំអាចរក្សាទុកស្លាក HTML មួយចំនួនបានទេ?
ទេ។ ឧបករណ៍នេះលុបស្លាក HTML ទាំងអស់ដោយគ្មានករណីលើកលែង។
ហេតុអ្វីបានជាការបំបែកបន្ទាត់បាត់បន្ទាប់ពីសម្អាត?
ប្រសិនបើការបំបែកបន្ទាត់ត្រូវបានកំណត់ដោយធាតុ HTML ដូចជា <br> ឬ <p> ការលុបស្លាកទាំងនោះអាចធ្វើឱ្យចន្លោះដែលអាចមើលឃើញបាត់ផងដែរ។
ឧបករណ៍ពេញនិយម
បត់បែនលំដាប់អក្សរនៅក្នុងប្រយោគ ឬកថាខណ្ឌ។
ទទួលទំហំអត្ថបទជា Bytes (B), Kilobytes (KB), ឬ Megabytes (MB)។
រាប់ចំនួនតួអក្សរ និងពាក្យក្នុងអត្ថបទដែលបានផ្ដល់ឲ្យ។
បញ្ច្រាសអត្ថបទដោយងាយស្រួល។
បម្លែងលេខទៅជាទម្រង់សរសេរពេញលេញ។
បម្លែងអត្ថបទធម្មតាទៅរចនាប័ទ្មអក្សរ cursive។