.\" Copyright (C) 2016 and later: Unicode, Inc. and others. .\" License & terms of use: http://www.unicode.org/copyright.html .\" Copyright (C) 2012 International Business Machines Corporation and others .\" .TH "GENDICT" "1" "مه ۲۰۲۵" "icu" "دستورهای کاربری" .SH "نام (NAME)" gendict \- کامپایل فهرست واژگان به فرهنگ لغت درخت پیشوندی (Trie) در ICU .SH "خلاصه دستور (SYNOPSIS)" \fBgendict\fP [ \fIگزینهها\fP... ] \fIفایل_ورودی\fP \fIفایل_خروجی\fP .SH "توضیحات (DESCRIPTION)" دستور \fBgendict\fR فهرستی از واژگان را از یک فایل متنی خوانده و یک فرهنگ لغت فشرده برای تفکیک کلمات در ICU ایجاد میکند. به‌طور معمول این فایل داده دارای پسوند .B .dict است. .PP کلمات از ابتدای سطر شروع شده و با نخستین نویسه فاصله پایان می‌یابند. خطوطی که با نویسه فاصله آغاز می‌شوند نادیده گرفته خواهند شد. .SH "گزینه‌ها (OPTIONS)" .TP .BR "\-h\fP, \fB\-?\fP, \fB\-\-help" چاپ راهنمای نحوه استفاده و خروج. .TP .BR "\-V\fP, \fB\-\-version" چاپ نسخه .B gendict و خروج. .TP .BR "\-c\fP, \fB\-\-copyright" گنجاندن حق نشر استاندارد ICU در .IR فایل_خروجی . .TP .BR "\-v\fP, \fB\-\-verbose" نمایش پیام‌های توصیفی و اطلاعاتی بیشتر در حین اجرا. .TP .BI "\-i\fP, \fB\-\-icudatadir" " پوشه" جستجو برای فایل‌های داده ضروری ICU در .IR پوشه . به‌عنوان مثال، فایل .B pnames.icu در صورتی که داده‌های ICU به‌صورت یک کتابخانه مشترک (shared library) ساخته نشده باشند، باید پیدا شود. پوشه پیش‌فرض داده‌های ICU توسط متغیر محیطی .B ICU_DATA تعیین می‌شود. بیشتر پیکربندی‌های ICU نیازی به این آرگومان ندارند. .TP .BR "\fB\-\-uchars" تنظیم نوع درخت پیشوندی خروجی روی UChar. ناسازگار با .BR \-\-bytes . .TP .BR "\fB\-\-bytes" تنظیم نوع درخت پیشوندی خروجی روی Bytes. ناسازگار با .BR \-\-uchars . .TP .BR "\fB\-\-transform" تنظیم نوع تبدیل (transform). فقط باید همراه با .B \-\-bytes مشخص شود. در حال حاضر تبدیلات پشتیبانی‌شده عبارتند از: .BR offset\- ، که یک مقدار آفست را برای کسر شدن از تمام نویسه‌های ورودی تعیین می‌کند. لازم به ذکر است که تبدیل آفست همچنین نویسه U+200D را به 0xFF و U+200C را به 0xFE نگاشت می‌کند تا سازگاری با زبان‌هایی که به این نویسه‌ها نیاز دارند (مانند اتصال مجازی و نیم‌فاصله) فراهم شود. مشخص کردن تبدیل برای درخت پیشوندی بایت الزامی است و زمانی که روی نویسه‌های بدون مقدار در .IR فایل_ورودی اعمال شود، باید خروجی بین 0x00 و 0xFF تولید کند. .TP .BI " فایل_ورودی" فایل مبدأ برای خواندن. .TP .BI " فایل_خروجی" فایلی که فرهنگ لغت خروجی در آن ذخیره می‌شود. .SH "نکات و هشدارها (CAVEATS)" فرض بر این است که .IR فایل_ورودی دارای کدگذاری UTF-8 است. اعداد صحیحی که در .IR فایل_ورودی به‌عنوان مقادیر استفاده می‌شوند باید از ارقام اسکی (ASCII) تشکیل شده باشند. این مقادیر می‌توانند در مبنای شانزده (هگزادسیمال با پیشوند 0x) یا در مبنای ده (ده‌دهی) مشخص شوند. .PP باید حتماً یکی از دو گزینه .B \-\-bytes یا .B \-\-uchars مشخص شود. .SH "متغیرهای محیطی (ENVIRONMENT)" .TP 10 .B ICU_DATA پوشه حاوی داده‌های ICU را مشخص می‌کند. مقدار پیش‌فرض آن .BR ${prefix}/share/icu/76.1/ است. برخی از ابزارهای ICU به وجود اسلش پایانی در مسیر وابسته هستند؛ بنابراین در صورت تنظیم .BR ICU_DATA ، اطمینان از وجود آن اهمیت دارد. .SH "نویسندگان (AUTHORS)" Maxime Serrano .SH "نسخه (VERSION)" 1.0 .SH "حق نشر (COPYRIGHT)" Copyright (C) 2012 International Business Machines Corporation and others .SH "همچنین ببینید (SEE ALSO)" .BR http://www.icu-project.org/userguide/boundaryAnalysis.html