บอกลาเว็บแปลง PDF ออนไลน์: คู่มือติดตั้ง Stirling-PDF จัดการเอกสารปลอดภัย 100% บน Home Server ด้วย Docker
หยุดอัปโหลดเอกสารสำคัญ ใบเสร็จรับเงิน หรือเอกสารภาษีขึ้นเว็บแปลง PDF ออนไลน์ที่เสี่ยงต่อข้อมูลรั่วไหล แล้วเปลี่ยนมาติดตั้ง Stirling-PDF เครื่องมือจัดการ PDF ครบวงจรไว้ใช้ในบ้านแบบออฟไลน์และปลอดภัย 100%
คุณเคยเจอปัญหานี้ไหมครับ? เมื่อต้องรวมไฟล์ PDF, แปลงรูปภาพเป็น PDF, เซ็นเอกสารสัญญา หรือสแกนข้อความในรูปภาพ (OCR) แต่คอมพิวเตอร์ของคุณไม่มีโปรแกรมจัดการ PDF ดีๆ ติดตั้งไว้... สิ่งที่คนส่วนใหญ่ทำคือการพิมพ์ค้นหาบน Google ว่า "รวมไฟล์ PDF ฟรี" หรือ "แปลงไฟล์ PDF ออนไลน์" จากนั้นก็ทำการอัปโหลดเอกสารสำคัญเหล่านั้นขึ้นไปบนเว็บไซต์เหล่านั้นทันที
หารู้ไม่ว่า การกระทำนี้คือการนำ ข้อมูลส่วนบุคคลที่สำคัญอย่างยิ่ง เช่น สัญญาจ้างงาน เอกสารภาษี สำเนาบัตรประชาชน หรือสเตทเมนต์ธนาคาร ไปฝากไว้บนเซิร์ฟเวอร์ของใครก็ไม่รู้ ซึ่งเราไม่สามารถตรวจสอบได้เลยว่าผู้ให้บริการเหล่านั้นจะแอบเก็บไฟล์ของเราไว้ หรือนำข้อมูลไปทำอะไรต่อหลังจากที่เรากดดาวน์โหลดไฟล์เสร็จแล้ว
เพื่อรักษาความเป็นส่วนตัวและความปลอดภัยของข้อมูลตามแนวคิด Private Brain OS การย้ายกิจกรรมเหล่านี้มาจัดการในเครื่องของเราเองแบบ 100% คือคำตอบที่ดีที่สุด และเครื่องมือระดับมีดพกสวิสที่จะช่วยเราจัดการเรื่องนี้ได้ดีที่สุดก็คือ Stirling-PDF ครับ
Stirling-PDF คืออะไร?
Stirling-PDF คือแอปพลิเคชันจัดการไฟล์ PDF แบบโอเพนซอร์ส (Open-source) ที่ทำงานผ่านหน้าเว็บบราวเซอร์ โดยคุณสามารถติดตั้งและรันมันบน Home Server ของตัวเองได้ง่ายๆ ผ่าน Docker
จุดเด่นของ Stirling-PDF คือมันรวบรวมฟังก์ชันทุกอย่างที่คุณเคยเห็นบนเว็บแปลงไฟล์ PDF ออนไลน์ชื่อดังทั้งหมดมาไว้ในที่เดียว โดยไม่มีการส่งข้อมูลใดๆ ออกนอกเซิร์ฟเวอร์ของคุณเลย ทุกอย่างประมวลผลภายในบ้านของคุณแบบออฟไลน์ 100%
นี่คือฟีเจอร์เด่นบางส่วนที่ Stirling-PDF ทำได้: * การจัดการหน้าเอกสาร: รวมไฟล์ (Merge), แยกไฟล์ (Split), ลบหน้า, แทรกหน้า, หมุนหน้าเอกสาร หรือจัดเรียงลำดับหน้าใหม่ด้วยการลากวาง (Drag-and-Drop) * การแปลงไฟล์ (Convert): แปลงไฟล์รูปภาพ, Word, Excel, PowerPoint, HTML หรือแม้แต่ Markdown ให้เป็น PDF และแปลงกลับได้อย่างแม่นยำ * ระบบ OCR (Optical Character Recognition): สกัดข้อความภาษาไทยและภาษาอื่นๆ ออกจากไฟล์ PDF ที่มาจากการสแกนหรือถ่ายรูป เพื่อให้เราสามารถค้นหาคำในเอกสารหรือคัดลอกข้อความไปใช้งานต่อได้ * ความปลอดภัยของเอกสาร: ใส่รหัสผ่านล็อกไฟล์, ถอดรหัสผ่าน (เมื่อมีสิทธิ์ปลดล็อก), ใส่ลายน้ำป้องกันการคัดลอก หรือแม้กระทั่งเซ็นลายเซ็นลงบนหน้าเอกสารโดยตรง * ลบข้อมูลส่วนตัว (Redaction): เครื่องมือไฮไลต์สีดำเพื่อลบข้อมูลสำคัญหรือข้อมูลส่วนบุคคลที่ไวต่อความรู้สึก (เช่น เลขบัตรประชาชน หรือที่อยู่) ออกจากเอกสารก่อนส่งต่อให้ผู้อื่น
สิ่งที่ต้องเตรียมก่อนเริ่มติดตั้ง
ในการติดตั้ง Stirling-PDF บน Home Server ของคุณ มีสิ่งสำคัญที่ต้องเตรียมดังนี้: 1. Home Server ที่ติดตั้ง Docker และ Docker Compose เรียบร้อยแล้ว (สามารถทำตามคู่มือเปลี่ยนคอมเก่าเป็น Home Server ด้วย Docker ได้เลย) 2. พื้นที่จัดเก็บข้อมูล สำหรับเก็บไฟล์ชั่วคราวและค่าคอนฟิกต่างๆ ของคอนเทนเนอร์
ขั้นตอนที่ 1: เตรียมโครงสร้างโฟลเดอร์และไฟล์ตั้งค่า
ให้คุณเชื่อมต่อ SSH เข้าไปยัง Home Server จากนั้นสร้างโฟลเดอร์สำหรับติดตั้ง Stirling-PDF:
# สร้างโฟลเดอร์สำหรับ Stirling-PDF
mkdir -p ~/stirling-pdf
# เข้าไปยังโฟลเดอร์ที่เพิ่งสร้าง
cd ~/stirling-pdf
จากนั้นสร้างไฟล์ตั้งค่าการรันคอนเทนเนอร์ด้วยการเขียนไฟล์ docker-compose.yml:
version: '3.8'
services:
stirling-pdf:
image: frooodle/s-pdf:latest
container_name: stirling-pdf
restart: always
ports:
- "8080:8080"
volumes:
- ./trainingData:/usr/share/tessdata # สำหรับติดตั้งชุดข้อมูลภาษาสำหรับ OCR (เช่น ภาษาไทย)
- ./extraConfigs:/configs
- ./logs:/logs
environment:
- DOCKER_ENABLE_SECURITY=false # สามารถตั้งค่าเป็น true หากต้องการสร้างระบบสมัครสมาชิกและล็อกอินใช้งาน
- SYSTEM_DEFAULT_LOCALE=th_TH # ตั้งค่าภาษาเริ่มต้นของระบบเป็นภาษาไทย
อธิบายตัวแปรสำคัญ: * frooodle/s-pdf:latest คืออิมเมจหลักของ Stirling-PDF * ports: "8080:8080" แมปพอร์ตบริการของแอปจากในคอนเทนเนอร์ออกมาที่พอร์ต 8080 บน Home Server (สามารถเปลี่ยนตัวเลขด้านหน้าเป็นพอร์ตอื่นที่คุณไม่ได้ใช้งานได้) * ./trainingData:/usr/share/tessdata ตัวแปรนี้สำคัญมากสำหรับสายคนไทย เพราะเป็นโฟลเดอร์ที่ใช้ติดตั้งไฟล์ชุดภาษาไทยสำหรับระบบ OCR (Optical Character Recognition)
ขั้นตอนที่ 2: ดาวน์โหลดภาษาไทยสำหรับระบบ OCR (เสริมพลังสแกนเอกสารไทย)
เพื่อให้ระบบ OCR ของ Stirling-PDF สามารถอ่านภาษาไทยในเอกสารที่สแกนมาได้ เราจำเป็นต้องดาวน์โหลดชุดข้อมูลฝึกฝนภาษาไทย (Trained Data) ของ Tesseract OCR เข้ามาเก็บไว้ในเครื่องก่อนสั่งรันระบบ
ในหน้า Terminal ของโฟลเดอร์ ~/stirling-pdf ให้รันคำสั่งดังนี้:
# สร้างโฟลเดอร์สำหรับเก็บข้อมูลภาษา OCR
mkdir -p trainingData
# ดาวน์โหลดไฟล์ข้อมูลภาษาไทย (.traineddata) มาเก็บไว้
curl -L -o trainingData/tha.traineddata https://github.com/tesseract-ocr/tessdata_fast/raw/main/tha.traineddata
(หมายเหตุ: คุณสามารถดาวน์โหลดภาษาอื่นๆ เพิ่มเติม เช่น ภาษาอังกฤษ eng.traineddata มาเก็บไว้ในโฟลเดอร์นี้เพื่อทำให้ระบบรองรับการสแกนเอกสารแบบสองภาษาพร้อมกันได้)
ขั้นตอนที่ 3: สั่งรันระบบและเริ่มต้นใช้งาน
เมื่อเตรียมไฟล์คอนฟิกและไฟล์ภาษาไทยเรียบร้อยแล้ว ให้สั่งรันระบบขึ้นมาทำงานเบื้องหลัง:
docker compose up -d
รอให้ระบบดาวน์โหลดและรันโปรแกรมขึ้นมาสักครู่ (เนื่องจาก Stirling-PDF เป็นแอปที่มีความสามารถหลากหลาย ขนาดไฟล์อิมเมจครั้งแรกอาจจะค่อนข้างใหญ่) เมื่อเสร็จสิ้นแล้ว คุณสามารถเปิดบราวเซอร์แล้วพิมพ์ URL:
http://ip-address-home-server:8080
คุณจะพบกับหน้าอินเตอร์เฟสของ Stirling-PDF ที่สวยงาม เรียบหรู และใช้งานง่ายมากๆ พร้อมกับเมนูคำสั่งและหน้าคู่มือที่แสดงผลเป็น ภาษาไทย โดยอัตโนมัติ!
ขั้นตอนที่ 4: เชื่อมต่อให้ปลอดภัยสำหรับการใช้งานจากนอกบ้าน
หากคุณจำเป็นต้องแปลงไฟล์เอกสารสำคัญตอนอยู่นอกบ้าน หรืออยากส่งลิงก์ให้คนในครอบครัวช่วยเซ็นสัญญาและรวมเอกสารอย่างปลอดภัย แนะนำให้ใช้งาน Stirling-PDF ร่วมกับ Tailscale (ตามคู่มือระบบรีโมตลิงก์ผ่าน VPN ส่วนตัว)
หรือหากคุณต้องการเพิ่มความปลอดภัยอีกระดับในการล็อกอินผ่านเว็บบราวเซอร์ คุณสามารถเปิดระบบความปลอดภัยโดยเปลี่ยนสภาพแวดล้อมในไฟล์ docker-compose.yml จาก DOCKER_ENABLE_SECURITY=false เป็น DOCKER_ENABLE_SECURITY=true เพื่อบังคับให้ผู้ใช้งานต้องล็อกอินก่อนเข้าหน้าแอปพลิเคชัน
บทสรุป
การมี Stirling-PDF ประจำการอยู่บน Home Server ของตัวเอง เปรียบเสมือนคุณมีออฟฟิศเอกสารส่วนตัวที่ปลอดภัย 100% ไร้กังวลเรื่องข้อมูลสำคัญ เอกสารภาษี หรือเอกสารธุรกิจของคุณจะรั่วไหลออกไปสู่บุคคลภายนอกผ่านเว็บไซต์แปลงไฟล์ฟรีทั่วไป
นอกจากจะเป็นการยกระดับอธิปไตยเหนือข้อมูลสำคัญของตัวเองตามแนวคิด Data Ownership แล้ว ยังเป็นระบบที่สะดวกรวดเร็ว รันในบ้านใช้งานได้ทุกคนในครอบครัวแบบไม่มีข้อจำกัดจำนวนหน้าหรือจำนวนไฟล์ใดๆ อีกต่อไปครับ