…پنجاه سال، پنجاه شاخص | تحلیل زبانی بیانات ۱۳۵۲–۱۴۰۴

📖 پنجاه سال، پنجاه شاخص

تحلیل کمّی و سبک‌شناختی متنِ ۲,۴۶۳ بیانات رهبر انقلاب اسلامی (۱۳۵۲–۱۴۰۴)

۲,۴۶۳ سند~۵۵ میلیون کلمه ۵۱ سالمنبع: farsi.khamenei.irمجوز CC-BY 4.0

📊 نمای کلی پیکره

متن کامل همه‌ی بیانات موجود در آرشیو رسمی، تبدیل‌شده به متن ساده و شمارش‌شده به‌صورت ماشینی. هر عدد این سایت از همین شمارش آمده و به آرشیو منبع لینک دارد.

حجم بیانات به تفکیک سال (تعداد فایل)

۲۰ کلمه‌ی پرتکرار (بدون ایست‌واژه‌ها)

🔤 تکیه‌کلام‌ها و لغات (شاخص ۴۱–۵۰)

شمارش واقعی روی کل پیکره. لینک هر کارت به جست‌وجوی همان واژه در آرشیو رسمی می‌رود.

روند «باید» — فعل الزام (شاخص ۴۲)

نسبت «ما» به «من» (شاخص ۴۵)

🧠 تغییرات نسلی و سبک شناختی (شاخص ۳۱–۴۰)

شاخص‌های ساختاری متن: طول جمله، تنوع واژگانی (TTR)، درصد پرسشی، ضمایر موصولی.

میانگین طول جمله بر حسب سال (شاخص ۳۱)

تنوع واژگانی: تعداد واژه‌ی یکتا در هر سال (شاخص ۳۷)

🎯 جهت‌گیری و دشمن‌شناسی (شاخص ۲۱–۳۰)

فراوانی نام گروه‌ها و کشورها در کل ۵۱ سال — شمارش واژه‌محور با مرز واژه‌ای.

گروه‌های اجتماعی: کل خطاب‌ها (شاخص ۲۱)

کشورها: کل نام‌بردن‌ها (شاخص ۲۶)

روند «دشمن» در برابر «امید» (شاخص ۲۲ و ۵)

💗 عواطف و حالات کلامی (شاخص ۱۱–۲۰)

آنچه از متن مکتوب قابل شمارش است؛ لرزش صدا، خنده و مکث فقط در صوت/ویدیو وجود دارد و در متن نیست.

شاخص خوش‌بینی (امید/پیشرفت/آینده) در برابر شاخص تهدید (شاخص ۱۱–۱۲)

🎭 ادبیات، استعاره و شعار (شاخص ۱–۱۰)

استعاره‌ها و شعارهای ماندگار از پرتکرارترین ترکیبات متن استخراج شده‌اند.

«درد و رنج» در برابر «امید» — روند سالانه (شاخص ۵)

❓ پاسخ تحلیلی پرسش‌های شما

جواب مستقیم سؤال‌هایی که پرسیدید — همه با پشتوانه‌ی شمارش همین پیکره.

⚖️ مقایسه‌ی سبک کلام با حاکمان بزرگ تاریخ

مقایسه‌ی کیفی بر پایه‌ی ادبیات شناخته‌شده‌ی سخنوری سیاسی؛ فقط برای موقعیت‌یابی سبک، نه قضاوت تاریخی.

این بخش تحلیل تطبیقیِ کیفی است و عدد ندارد؛ ادعای علمی بودن ندارد و صرفاً برای قرائت سبک‌شناختی ارائه می‌شود.

🧭 نقاط عطف کلامی

سال‌هایی که فراوانی واژه‌ها جهش یا سقوط معنادار داشته — به‌دست‌آمده از سری‌های زمانی همین داده.

💪 صد نکته از داده: روایت استمرار و اقتدار

هر نکته از شمارش واقعی همین ۲,۴۶۳ سند آمده و در صورت امکان به جست‌وجوی آرشیو رسمی لینک دارد.

🔬 روش، محدودیت‌ها و منبع

داده: ۲,۴۶۳ سند از آرشیو رسمی farsi.khamenei.ir/speech (نسخه چاپی هر سند)، سال‌های ۱۳۵۲ تا ۱۴۰۴. محتوای سایت با مجوز CC-BY 4.0 منتشر می‌شود.
روش: توکن‌سازی حروف فارسی/عربی با نیم‌فاصله، شمارش واژه و عبارت با مرز واژه‌ای، تقسیم جمله روی علائم پایان، محاسبه‌ی TTR (نسبت واژه‌ی یکتا به کل) و شاخص‌های ساختاری دیگر.
محدودیت‌ها: متنِ نوشته‌شده است نه ویدیو؛ بنابراین تیف‌های صوتی (لرزش صدا، مکث، خنده، اشتباه تلفظ) قابل استخراج نیست و در کارت‌های مربوطه صادقانه علامت خورده. املای متن آرشیو گاه نیم‌فاصله ندارد؛ شمارش‌های تک‌واژه‌ای ممکن است کم‌تر از واقعی باشند.