📊 نمای کلی پیکره
متن کامل همهی بیانات موجود در آرشیو رسمی، تبدیلشده به متن ساده و شمارششده بهصورت ماشینی. هر عدد این سایت از همین شمارش آمده و به آرشیو منبع لینک دارد.
حجم بیانات به تفکیک سال (تعداد فایل)
۲۰ کلمهی پرتکرار (بدون ایستواژهها)
🔤 تکیهکلامها و لغات (شاخص ۴۱–۵۰)
شمارش واقعی روی کل پیکره. لینک هر کارت به جستوجوی همان واژه در آرشیو رسمی میرود.
روند «باید» — فعل الزام (شاخص ۴۲)
نسبت «ما» به «من» (شاخص ۴۵)
🧠 تغییرات نسلی و سبک شناختی (شاخص ۳۱–۴۰)
شاخصهای ساختاری متن: طول جمله، تنوع واژگانی (TTR)، درصد پرسشی، ضمایر موصولی.
میانگین طول جمله بر حسب سال (شاخص ۳۱)
تنوع واژگانی: تعداد واژهی یکتا در هر سال (شاخص ۳۷)
🎯 جهتگیری و دشمنشناسی (شاخص ۲۱–۳۰)
فراوانی نام گروهها و کشورها در کل ۵۱ سال — شمارش واژهمحور با مرز واژهای.
گروههای اجتماعی: کل خطابها (شاخص ۲۱)
کشورها: کل نامبردنها (شاخص ۲۶)
روند «دشمن» در برابر «امید» (شاخص ۲۲ و ۵)
💗 عواطف و حالات کلامی (شاخص ۱۱–۲۰)
آنچه از متن مکتوب قابل شمارش است؛ لرزش صدا، خنده و مکث فقط در صوت/ویدیو وجود دارد و در متن نیست.
شاخص خوشبینی (امید/پیشرفت/آینده) در برابر شاخص تهدید (شاخص ۱۱–۱۲)
🎭 ادبیات، استعاره و شعار (شاخص ۱–۱۰)
استعارهها و شعارهای ماندگار از پرتکرارترین ترکیبات متن استخراج شدهاند.
«درد و رنج» در برابر «امید» — روند سالانه (شاخص ۵)
❓ پاسخ تحلیلی پرسشهای شما
جواب مستقیم سؤالهایی که پرسیدید — همه با پشتوانهی شمارش همین پیکره.
⚖️ مقایسهی سبک کلام با حاکمان بزرگ تاریخ
مقایسهی کیفی بر پایهی ادبیات شناختهشدهی سخنوری سیاسی؛ فقط برای موقعیتیابی سبک، نه قضاوت تاریخی.
این بخش تحلیل تطبیقیِ کیفی است و عدد ندارد؛ ادعای علمی بودن ندارد و صرفاً برای قرائت سبکشناختی ارائه میشود.
🧭 نقاط عطف کلامی
سالهایی که فراوانی واژهها جهش یا سقوط معنادار داشته — بهدستآمده از سریهای زمانی همین داده.
💪 صد نکته از داده: روایت استمرار و اقتدار
هر نکته از شمارش واقعی همین ۲,۴۶۳ سند آمده و در صورت امکان به جستوجوی آرشیو رسمی لینک دارد.
🔬 روش، محدودیتها و منبع
داده: ۲,۴۶۳ سند از آرشیو رسمی
farsi.khamenei.ir/speech (نسخه چاپی هر سند)، سالهای ۱۳۵۲ تا ۱۴۰۴. محتوای سایت با مجوز CC-BY 4.0 منتشر میشود.
روش: توکنسازی حروف فارسی/عربی با نیمفاصله، شمارش واژه و عبارت با مرز واژهای، تقسیم جمله روی علائم پایان، محاسبهی TTR (نسبت واژهی یکتا به کل) و شاخصهای ساختاری دیگر.
محدودیتها: متنِ نوشتهشده است نه ویدیو؛ بنابراین تیفهای صوتی (لرزش صدا، مکث، خنده، اشتباه تلفظ) قابل استخراج نیست و در کارتهای مربوطه صادقانه علامت خورده. املای متن آرشیو گاه نیمفاصله ندارد؛ شمارشهای تکواژهای ممکن است کمتر از واقعی باشند.