Language: hy
Paperless-ngx․ ինչպես ստեղծել սեփական որոնելի փաստաթղթերի արխիվը
Հիշո՞ւմ եք, որ պայմանագրում կարևոր գումար էր նշված, բայց ֆայլը կոչվում է scan_2024_03_17.pdf և պահվում է հարյուրավոր նմանատիպ ֆայլերի մեջ։ Սովորական ֆայլերի կառավարիչը որոնում է ֆայլի անունով, մինչդեռ ձեզ անհրաժեշտ բառերը հենց սկանի ներսում են։
Paperless-ngx-ը լուծում է այս խնդիրը։ Դուք վերբեռնում եք PDF, անդորրագրի լուսանկար կամ էլեկտրոնային նամակի կցորդ, իսկ ծառայությունը ճանաչում է տեքստը, ինդեքսավորում այն և ցրված ֆայլերը վերածում մեկ միասնական արխիվի։ Դրանից հետո փաստաթուղթը կարող եք գտնել ազգանունով, հասցեով, հաշվի համարով կամ էջում հանդիպող ցանկացած արտահայտությամբ։
Ի՞նչ է Paperless-ngx-ը
Paperless-ngx-ը փաստաթղթերի կառավարման անվճար, բաց կոդով համակարգ է։ Այն աշխատում է ձեր սեփական սերվերում, ֆայլեր է ընդունում տարբեր աղբյուրներից, կատարում է OCR և թույլ է տալիս որոնել դրանց բովանդակությունը։
Մեկ կոշտ թղթապանակային կառուցվածքի փոխարեն այն օգտագործում է թղթակիցներ, փաստաթղթերի տեսակներ, պիտակներ, ամսաթվեր, հատուկ դաշտեր և պահպանման կանոններ։ Այդ պատճառով մի քանի վայրկյանում կարող եք ցուցադրել 2026 թվականի էլեկտրաէներգիայի հաշիվները, որոշակի բնակարանին վերաբերող փաստաթղթերը կամ ժամկետի ավարտին մոտեցող երաշխիքները։
Ինչու է Paperless-ngx-ը ավելի լավ, քան սովորական թղթապանակները
Թղթապանակները հարմար են, քանի դեռ փաստաթղթերը քիչ են, և դուք հիշում եք անվանակոչման ձեր համակարգը։ Մի քանի տարի անց հայտնվում են Documents, Scans, New և To sort գրացուցակները, իսկ անհրաժեշտ ֆայլը գտնելը դժվարանում է։
| Սովորական թղթապանակ | Paperless-ngx |
|---|---|
| Որոնում ֆայլի անունով | Որոնում փաստաթղթի ներսի տեքստով |
| Մեկ ֆայլ, մեկ թղթապանակ | Բազմաթիվ պիտակներ և հատկանիշներ |
| Անվանակոչում և դասավորում ձեռքով | Մետատվյալների ավտոմատ նշանակում |
| Կցորդները պետք է պահել ձեռքով | Ներմուծում էլեկտրոնային նամակից |
| Սկանը մնում է որպես պատկեր | OCR-ը տեքստը դարձնում է որոնելի |
Գրացուցակը հիշելու փոխարեն բավական է հիշել փաստաթղթից մեկ բառ։
Ինչպես է Paperless-ngx-ը մշակում ֆայլը
Վերբեռնումից հետո ծառայությունը՝
- պահպանում է սկզբնական ֆայլը,
- հանում է առկա տեքստը կամ սկսում OCR-ը,
- անհրաժեշտության դեպքում ստեղծում է արխիվային PDF տարբերակ և մանրապատկերներ,
- բովանդակությունն ավելացնում է ամբողջական տեքստային ինդեքսում,
- կիրառում է կանոններ և առաջարկում թղթակցին, տեսակը, պիտակները և պահպանման ուղին։
Կարող եք սկսել վերբեռնումից ու որոնումից, իսկ ավտոմատացումը ավելացնել ավելի ուշ։
Paperless-ngx-ի ամենաօգտակար հնարավորությունները
Որոնում սկաների ներսում
OCR-ից հետո կարող եք պայմանագիրը գտնել հասցեով, հաշիվ-ապրանքագիրը՝ հաճախորդի համարով, իսկ անդորրագիրը՝ սարքի մոդելով։ Օրինակ՝ «վաղաժամկետ դադարեցում» որոնումը ցույց կտա այդ արտահայտությունը պարունակող փաստաթղթերը, նույնիսկ եթե սկզբնական PDF-ը բաղկացած էր միայն պատկերներից։
Արդյունքը կախված է սկանից․ ուղիղ և բարձր կոնտրաստով էջը ավելի լավ է ճանաչվում, քան անկյան տակ արված մուգ լուսանկարը։ Ռուսերեն-անգլերեն արխիվի համար կարևոր է տեղադրել OCR-ի երկու լեզուներն էլ։
Ավտոմատ դասավորում
Paperless-ngx-ը կարող է նոր փաստաթղթերը համեմատել արդեն դասավորվածների հետ։ Դուք ձեռքով պիտակավորում եք նույն մատակարարի մի քանի հաշիվ-ապրանքագիր, իսկ ծառայությունը սովորում է հաջորդ ֆայլերի համար առաջարկել նույն թղթակցին, տեսակը և պիտակները։
Խիստ տրամաբանության համար կարող եք ստեղծել կանոններ՝ հիմնված տեքստի, ֆայլի անվան, աղբյուրի կամ վերբեռնման թղթապանակի վրա։
Ներմուծում էլեկտրոնային նամակից
Ծառայությունը կարող է IMAP-ով ստուգել փոստարկղը և մշակել հաղորդագրությունները՝ ըստ կանոնների։ Օրինակ՝ այն կարող է մատակարարից ստանալ միայն PDF կցորդները, ուղարկել դրանք արխիվ, ապա նամակը նշել որպես կարդացված կամ տեղափոխել մեկ այլ թղթապանակ։
Հաշիվ-ապրանքագրերն այլևս չեն կուտակվի մուտքային փոստում և սկաների հետ միասին որոնելի կդառնան։
Աշխատանքային հոսքեր, դաշտեր և պահպանված դիտումներ
Աշխատանքային հոսքերը գործողություններ են կատարում փաստաթուղթը վերբեռնելիս, ավելացնելիս կամ փոփոխելիս, ինչպես նաև սահմանված ժամանակացույցով։ Դրանք կարող են նշանակել պատասխանատու, ավելացնել պիտակ, ընտրել տեսակ և սահմանել պահպանման ուղի։
Հատուկ դաշտերը արխիվը վերածում են փոքր տվյալների բազայի։ Պայմանագրի համար կարող եք պահել ավարտի ամսաթիվը, հաշիվ-ապրանքագրի համար՝ գումարը և վճարման վերջնաժամկետը, իսկ սարքավորման համար՝ սերիական համարը։ Պահպանված դիտումները հետո կարող են ցույց տալ, օրինակ, «պետք է վճարել» կամ «երաշխիքի ժամկետը լրանում է այս ամիս» փաստաթղթերը։
Խմբային սկանավորում շտրիխ կոդերով
Paperless-ngx-ը կարող է մեկ մեծ սկանը շտրիխ կոդերի օգնությամբ բաժանել մի քանի փաստաթղթի։ Թղթերի միջև կարող եք տեղադրել բաժանարար էջեր կամ առաջին թերթին ավելացնել ASN կոդ։
ASN-ը արխիվային սերիական համար է, որը թվային պատճենը կապում է թղթային բնօրինակի հետ։ Սա հարմար է մեծ կապոցներ թվայնացնելիս։
Տարբերակներ և ընտրովի AI
Paperless-ngx-ի 3.x շարքը ավելացրել է փաստաթղթերի տարբերակներ, համատեղ հասանելիության հղումների հավաքածուներ և ներկառուցված AI հնարավորություններ։ Մոդելին միանալիս ծառայությունը կարող է առաջարկել մետատվյալներ և պատասխանել փաստաթղթերի մասին հարցերին։
Հիմնական հնարավորությունների համար AI-ն պարտադիր չէ․ OCR-ը, որոնումը, կանոնները, պիտակները և էլեկտրոնային փոստից ներմուծումը աշխատում են նաև առանց դրա։ Արտաքին AI API օգտագործելիս տեքստի մի մասը կարող է դուրս գալ սերվերից, իսկ տեղական մոդելին ավելի շատ ռեսուրսներ են անհրաժեշտ։
Ում է հարմար Paperless-ngx-ը
Անձնական կամ ընտանեկան արխիվի համար․ պայմանագրեր, ապահովագրական պոլիսներ, քաղվածքներ, երաշխիքներ, անդորրագրեր, բնակարանային փաստաթղթեր և սարքավորումների ձեռնարկներ։
Ֆրիլանսերների և փոքր բիզնեսների համար․ հաշիվ-ապրանքագրեր, հանձնման-ընդունման ակտեր, պայմանագրեր, ծախսեր և գործընկերների հետ նամակագրություն։ Էլեկտրոնային նամակից ներմուծումը նվազեցնում է ձեռքի աշխատանքը, իսկ հասանելիության իրավունքները թույլ են տալիս համօգտագործել փաստաթղթերը։
Վարչական գործընթացների համար․ սկզբնական փաստաթղթերում արագ որոնում, ընտրություն ըստ մատակարարի և ժամանակահատվածի, ինչպես նաև չմշակված ֆայլերի հերթ։
Paperless-ngx-ը չի փոխարինում հաշվապահական ծրագրին, էլեկտրոնային ստորագրությանը կամ կորպորատիվ ECM համակարգին։
Ինչպիսի սերվեր է անհրաժեշտ Paperless-ngx-ի համար
Բեռնվածությունը կախված է էջերի քանակից, սկանի որակից, վերբեռնումների հաճախականությունից և լրացուցիչ բաղադրիչներից։ Որպես գործնական մեկնարկային արժեքներ կարող եք օգտագործել հետևյալը․
| Սցենար | CPU | RAM | Սկավառակ |
|---|---|---|---|
| Անձնական արխիվ | 2 vCPU | 2 GB | 30–50 GB NVMe կամ ավելի |
| Ընտանիք կամ փոքր թիմ | 2–4 vCPU | 4 GB | 60–100 GB NVMe կամ ավելի |
| Մեծ խմբաքանակներ, Office ֆայլեր, տեղական AI | 4 vCPU կամ ավելի | 8 GB կամ ավելի | Արխիվի չափը և ազատ պահուստը |
Թույլ սերվերի դեպքում միջերեսը կարող է նորմալ աշխատել, բայց մեծ փաստաթղթերի OCR-ը դանդաղ կկատարվի։ Word, Excel և այլ գրասենյակային ձևաչափերի համար Tika-ն ու Gotenberg-ը նույնպես ավելացնում են հիշողության օգտագործումը։
Սկավառակի տարողությունը նախատեսեք պահուստով․ սկզբնական ֆայլերից բացի համակարգը կարող է պահել արխիվային տարբերակներ, մանրապատկերներ, ինդեքս, տվյալների բազա և ժամանակավոր ֆայլեր։ Պահուստային պատճենների համար նույնպես առանձին տարածք է անհրաժեշտ։
Paperless-ngx-ի տեղադրում VPS-ում Docker-ով
Աջակցվող ամենապարզ մեթոդը Docker Compose-ն է։ Ձեզ անհրաժեշտ է Linux սերվեր, Docker Engine և Compose պլագին։
Պաշտոնական նախագիծը տրամադրում է ինտերակտիվ տեղադրիչ․
bash -c "$(curl -L https://raw.githubusercontent.com/paperless-ngx/paperless-ngx/main/install-paperless-ngx.sh)"Այն հարցնում է գրացուցակի, տվյալների բազայի, պորտի, OCR լեզվի, լրացուցիչ բաղադրիչների և ադմինիստրատորի հաշվի մասին, ապա ստեղծում Compose-ի կոնֆիգուրացիան և գործարկում կոնտեյներները։
Արտադրական սերվերի վրա ավելի անվտանգ է նախ ներբեռնել և ստուգել սկրիպտը․
curl -L https://raw.githubusercontent.com/paperless-ngx/paperless-ngx/main/install-paperless-ngx.sh \
-o install-paperless-ngx.sh
less install-paperless-ngx.sh
bash install-paperless-ngx.shՏեղադրման գրացուցակից գործարկումը կարող եք ստուգել հետևյալ հրամաններով․
docker compose ps
docker compose logs -f webserverՌուսերեն և անգլերեն OCR-ի համար սովորաբար սահմանում են rus+eng և Docker-ում տեղադրում լրացուցիչ rus eng լեզվական տվյալները։
Մի ցուցադրեք հավելվածի ներքին պորտը անմիջապես ինտերնետում։ Դոմենը միացրեք reverse proxy-ի միջոցով, միացրեք HTTPS-ը և փակեք ավելորդ պորտերը։ Անձնական արխիվի դեպքում միայն VPN-ով հասանելիությունը ավելի անվտանգ է։
Paperless-ngx-ը tropic.host-ի VPS-ում
Փոքր արխիվի համար հարմար է 2 vCPU-ով, 2–4 GB RAM-ով և NVMe պահոցով VPS-ը։ tropic.host-ում կարող եք տեղակայել Ubuntu, տեղադրել Docker և Paperless-ngx-ը հասանելի պահել համակարգչից ու հեռախոսից՝ առանց տնային NAS-ի։
VPS-ը աշխատում է շուրջօրյա, ուստի ծառայությունը կարող է պարբերաբար ստանալ էլեկտրոնային նամակների կցորդները։ Սակայն փաստաթղթերը հաճախ պարունակում են անձնական տվյալներ․ օգտագործեք HTTPS կամ VPN, SSH բանալիներ, սահմանափակող firewall և անկախ պահուստային պատճեններ։
Անվտանգություն և պահուստային պատճեններ
Paperless-ngx-ը փաստաթղթերի համար ներկառուցված end-to-end գաղտնագրում չի տրամադրում։ Սերվերին, Docker ծավալներին կամ պահուստային պատճենին լիարժեք հասանելիություն ունեցող օգտատերը հնարավոր է կարողանա կարդալ արխիվը։
Նվազագույն միջոցները՝
- ծառայությունը տեղակայել միայն վստահելի ենթակառուցվածքում,
- թարմացնել համակարգը և կոնտեյներները,
- SSH հասանելիությունը սահմանափակել միայն բանալիներով,
- գաղտնագրված պատճենները պահել հիմնական սերվերից դուրս,
- պարբերաբար փորձարկել վերականգնումը։
Տեղափոխման և պահուստավորման համար կա ներկառուցված document_exporter գործիքը․
docker compose exec webserver document_exporter ../exportԱրտահանման գրացուցակը պատճենեք մեկ այլ սարքի կամ անկախ պահոցի վրա։ Նույն VPS-ում պահված պատճենը չի պաշտպանի սկավառակի վնասումից, պատահական ջնջումից կամ հասանելիության կորստից։
Արժե՞ արդյոք տեղադրել Paperless-ngx-ը
Paperless-ngx-ը օգտակար է այն ժամանակ, երբ խնդիրը այլևս ֆայլերը պահելը չէ, այլ դրանք գտնելը։ Այն անորոշ անուններով սկաները, կցորդները և PDF-երը վերածում է արխիվի, որտեղ փաստաթղթերը որոնվում են բովանդակությամբ և մշակվում հետևողական կանոններով։
Սկսելու համար բավական է տեղադրել ծառայությունը, կարգավորել OCR լեզուները և վերբեռնել առաջին ֆայլերը։ Պիտակները, էլեկտրոնային նամակից ներմուծումը, աշխատանքային հոսքերը, շտրիխ կոդերը և AI հնարավորությունները ավելացրեք, երբ ունենաք հստակ և կրկնվող գործընթաց։
FAQ
Կարելի՞ է Paperless-ngx-ն օգտագործել անվճար
Այո։ Սա բաց կոդով նախագիծ է։ Ծախսերը վերաբերում են միայն սարքավորմանը, VPS-ին, դոմենին կամ արտաքին ծառայություններին։
Կարո՞ղ է Paperless-ngx-ը ճանաչել ռուսերեն տեքստը
Այո։ OCR-ն օգտագործում է Tesseract-ի rus լեզվական փաթեթը։ Խառը արխիվի համար սովորաբար կարգավորում են rus+eng։
OCR-ից հետո բնօրինակ ֆայլը ջնջվո՞ւմ է
Ոչ։ Բնօրինակ ֆայլը պահպանվում է։ Կարգավորումներից կախված՝ դրա կողքին կարող է ստեղծվել առանձին արխիվային PDF տարբերակ։
Կարո՞ղ են փաստաթղթերը վերբեռնվել հեռախոսից
Այո։ Կարող եք օգտագործել վեբ միջերեսը, API-ն, համատեղելի բջջային հավելվածը կամ փաստաթուղթը փոխանցել միացված էլեկտրոնային հասցեին։
Բավարա՞ր է VPS-ի պահուստային պատճենը
VPS-ի snapshot-ը օգտակար է, բայց ավելի լավ է այն համատեղել ներկառուցված արտահանման գործիքի հետ և պահել առանձին պատճեն։ Կարևոր է ոչ միայն արխիվ ստեղծել, այլև վերականգնումը փորձարկել մաքուր տեղադրման վրա։
