OtanaOTANA
OtanaOTANA
آکادمیاستراتژی

بک‌تست دستی کافی نیست: هزینه پنهانی که حساب نمی‌کنید

بک‌تست دستی روی ۵۰ نمونه رشته ضرری که حسابتان را می‌بندد نشان نمی‌دهد. چهار مشکل بک‌تست دستی، جای درست استفاده از آن و مرز تصمیم‌گیری با عدد.

ت
تحریریه اوتانا
۲ شهریور ۱۴۰۵·۱۱ دقیقه مطالعه·۰

نود دقیقه وقت می‌گذارید، ۵۰ نمونه از چارت جمع می‌کنید، در یک صفحه گسترده حساب می‌کنید و به یک عدد می‌رسید: انتظار ریاضی 0.4R. راضی هستید. بعد یک فکر ساده به ذهنتان می‌رسد — «اگر به‌جای EMA50 از EMA20 استفاده کنم چه می‌شود؟»

همان لحظه، آن ۹۰ دقیقه بی‌ارزش شد. باید از اول شروع کنید.

این مقاله درباره همین هزینه است: نه هزینه‌ای که برای ابزار می‌پردازید، بلکه هزینه‌ای که وقتی ابزار ندارید می‌پردازید و در هیچ صورت‌حسابی نمی‌بینیدش.

تعداد نمونه کافی برای بک تست چقدر است؟

این جدی‌ترین مشکل بک‌تست دستی است و کمتر از همه درباره‌اش حرف زده می‌شود.

فرض کنید استراتژی‌تان نرخ برد ۴۰٪ دارد — یک عدد کاملاً معمولی برای یک سیستم سوئینگ با R:R بالا. حالا این سؤال را بپرسید: احتمال اینکه ۸ ضرر پشت سر هم بخورید چقدر است؟

  • در ۵۰ نمونه، احتمال دیدن چنین رشته‌ای حدود ۳۰٪ است
  • در ۵۰۰ نمونه، این احتمال به بالای ۹۵٪ می‌رسد

معنی عملی این دو عدد را دقیق بخوانید: رشته ۸ ضرری در استراتژی شما وجود دارد. بازار قرار است دیر یا زود آن را به شما نشان بدهد. اما بک‌تست ۵۰ نمونه‌ای شما، در ۷ بار از ۱۰ بار، آن را نشان نمی‌دهد.

و اینجاست که ضرر واقعی شکل می‌گیرد: شما حجم معامله‌تان را بر اساس بدترین رشته ضرری که دیده‌اید تنظیم می‌کنید، نه بدترین رشته‌ای که وجود دارد. همان‌طور که در ریسک ثابت درصدی دیدیم، طول رشته ضرر تنها عددی است که درصد ریسک درست را تعیین می‌کند. اگر آن عدد را اشتباه بدانید، هر محاسبه بعدی هم اشتباه است.

یک بک‌تست ۵۰ نمونه‌ای به شما نمی‌گوید استراتژی بد است. چیز خطرناک‌تری به شما می‌گوید: یک اطمینان کاذب که با عدد پشتیبانی می‌شود.

چرا هر تغییر پارامتر، بک‌تست دستی را از صفر شروع می‌کند

ساختن یک استراتژی، نوشتن یک قانون و تست کردنش نیست. جست‌وجو کردن است. شما یک ایده اولیه دارید و باید ده‌ها نسخه از آن را امتحان کنید تا بفهمید کدام نسخه واقعاً لبه دارد.

یک ستاپ ساده پول‌بک را در نظر بگیرید. متغیرهایی که باید تست شوند:

  • کدام میانگین متحرک — EMA20، EMA50 یا MA200؟
  • استاپ زیر کف پول‌بک یا با فاصله ثابت؟
  • تارگت ثابت یا تریل؟
  • فقط در جهت روند D1 یا مستقل از آن؟
  • در همه سشن‌ها یا فقط سشن لندن؟

فقط همین پنج متغیر، اگر هرکدام دو حالت داشته باشند، ۳۲ ترکیب می‌سازند. با بک‌تست دستی و ۹۰ دقیقه به ازای هر ترکیب، این می‌شود ۴۸ ساعت کار — یک هفته کاری کامل، برای تست یک ستاپ.

در عمل چه اتفاقی می‌افتد؟ هیچ‌کس ۴۸ ساعت وقت نمی‌گذارد. معامله‌گر دو یا سه ترکیب را تست می‌کند، اولی که عدد قابل قبولی داد را برمی‌دارد، و بقیه فضای جست‌وجو را هیچ‌وقت نمی‌بیند. شاید ترکیب هفدهم دو برابر بهتر بود؛ هیچ‌وقت نمی‌فهمد.

سوگیری انتخاب نمونه در بک‌تست دستی

وقتی خودتان روی چارت اسکرول می‌کنید و نمونه‌ها را انتخاب می‌کنید، ناخودآگاه سراغ ستاپ‌های تمیز و واضح می‌روید و نمونه‌های مبهم را رد می‌کنید. نتیجه، مصنوعی مثبت می‌شود.

راه‌کارهایی برای کم کردن این سوگیری وجود دارد — مثلاً اول علامت ورود و استاپ را بگذارید و بعد به جلو اسکرول کنید. اما هیچ‌کدام کامل نیست، به یک دلیل ساده: شما آن بازه از بازار را قبلاً دیده‌اید. می‌دانید مارس آن سال ریزش بزرگی داشت. این دانش را نمی‌شود از ذهن پاک کرد.

یک موتور بک‌تست این مشکل را ندارد، نه به این دلیل که باهوش‌تر است، بلکه به این دلیل که نمی‌تواند تقلب کند. قانون را روی هر نمونه‌ای که شرط را برآورده می‌کند اجرا می‌کند، چه آن نمونه زیبا باشد چه زشت، چه نتیجه‌اش را دوست داشته باشید چه نه.

تکرارپذیری بک‌تست: چرا نتیجه دستی قابل بازتولید نیست

سه ماه بعد، به صفحه گسترده بک‌تستتان نگاه می‌کنید و عدد 0.4R را می‌بینید. حالا این سؤال‌ها را جواب بدهید:

  • این عدد با کدام نسخه از قانون به دست آمد؟ قبل یا بعد از اینکه فیلتر سشن را اضافه کردید؟
  • اسپرد در محاسبه لحاظ شده بود؟
  • کدام بازه زمانی؟ فقط بازار روندی، یا رنج هم داخلش بود؟

اگر یادداشت دقیق نگه نداشته باشید — و تقریباً هیچ‌کس نگه نمی‌دارد — جواب هیچ‌کدام را نمی‌دانید. یعنی آن عدد، دیگر یک داده نیست؛ یک خاطره است.

بک‌تست تکرارپذیر یعنی می‌توانید همان قانون را با یک کلیک دوباره اجرا کنید، نتیجه دقیقاً همان دربیاید، و ببینید تغییر دادن یک پارامتر چه اثری داشت. این تفاوت بین «فکر می‌کنم این ستاپ خوب بود» و «می‌دانم این ستاپ چه عددی داد و چرا» است.

پس بک‌تست دستی کاملاً بی‌فایده است؟

نه، و ادعای خلافش صادقانه نیست.

بک‌تست دستی یک فایده واقعی دارد که هیچ موتوری جایش را نمی‌گیرد: شما چارت را می‌بینید. وقتی ۳۰ نمونه از یک ستاپ را با چشم مرور می‌کنید، الگویی در ذهنتان شکل می‌گیرد که یک عدد خروجی هیچ‌وقت نمی‌سازد — می‌فهمید این ستاپ در چه فضایی نفس می‌کشد و کجا خفه می‌شود.

پس تقسیم کار درست این است:

  • برای یاد گرفتن یک ستاپ: ۲۰ تا ۳۰ نمونه دستی، با چشم. این مرحله را رد نکنید.
  • برای تصمیم گرفتن درباره حجم و ریسک: هرگز دستی. اینجا به صدها نمونه نیاز دارید، نه ۵۰ تا.

خلاصه تفاوت دو روش:

معیاربک‌تست دستیبک‌تست خودکار
تعداد نمونهدر عمل ۲۰ تا ۵۰ نمونهصدها نمونه؛ ۵۰۰ نمونه و بیشتر
زمان هر تستحدود ۹۰ دقیقه برای هر ترکیب پارامترحدود ۹۰ ثانیه برای هر ترکیب
سوگیریسراغ ستاپ‌های تمیز می‌روید و نمونه‌های مبهم را رد می‌کنید؛ آن بازه از بازار را قبلاً دیده‌ایدقانون روی هر نمونه‌ای که شرط را برآورده کند اجرا می‌شود، زیبا یا زشت
تکرارپذیریبدون یادداشت دقیق، نسخه قانون و اسپرد و بازه زمانی معلوم نیستهمان قانون با یک اجرای دوباره، دقیقاً همان نتیجه را می‌دهد
کاربرد درستیاد گرفتن یک ستاپ با ۲۰ تا ۳۰ نمونهتصمیم درباره حجم و ریسک، که به صدها نمونه نیاز دارد

اشتباه رایج این نیست که مردم دستی تست می‌کنند؛ این است که از یک ابزار یادگیری، برای یک تصمیم مالی استفاده می‌کنند.

سرعت، خودش یک مزیت است — نه یک راحتی

اینجا نکته اصلی است. وقتی می‌گوییم موتور بک‌تست «سریع‌تر» است، معمولاً به‌عنوان یک راحتی شنیده می‌شود: همان کار، با وقت کمتر.

اما این توصیف اشتباه است. سرعت، کیفیت تصمیم را عوض می‌کند، نه فقط زمانش را.

با ۹۰ دقیقه به ازای هر تست، شما ۳ ترکیب را امتحان می‌کنید. با ۹۰ ثانیه، همان روز ۶۰ ترکیب را امتحان می‌کنید. این دو، دو کیفیت متفاوت از یک استراتژی نیستند — دو جهان متفاوت از چیزی هستند که درباره استراتژی‌تان می‌دانید. در حالت اول دارید حدس می‌زنید کدام پارامتر بهتر است؛ در حالت دوم دارید می‌بینید.

و یک اثر جانبی مهم دارد: وقتی رد کردن یک ایده ارزان باشد، ایده‌های بد را زودتر دور می‌اندازید. وقتی هر تست ۹۰ دقیقه هزینه دارد، ناخودآگاه به ایده‌ای که رویش وقت گذاشته‌اید می‌چسبید — همان سوگیری که باعث می‌شود استراتژی ضعیف را ماه‌ها روی حساب واقعی نگه دارید.

چرا این یک سرمایه‌گذاری است، نه یک خرج

عدد را روی کاغذ بیاوریم.

فرض کنید حسابی با موجودی $10,000 دارید و استراتژی‌ای که در بک‌تست دستی ۵۰ نمونه‌ای، انتظار ریاضی +0.4R نشان داده. در واقعیت — چون نمونه کم بود و انتخاب نمونه‌ها هم کمی سوگیرانه — این استراتژی در بلندمدت سربه‌سر است، نه مثبت.

چقدر طول می‌کشد تا بفهمید؟ با ۲۰ معامله در ماه، حدود سه تا چهار ماه. و در این مدت، با ریسک ۱٪ در هر معامله و یک رشته ضرر معمولی، به‌راحتی ۱۰٪ تا ۱۵٪ افت سرمایه می‌بینید. روی $10,000، یعنی $1,000 تا $1,500 — فقط بابت یک استراتژی که از همان اول قرار نبود جواب بدهد.

حالا این عدد را کنار هزینه سالانه یک ابزار بک‌تست بگذارید. یک بار جلوگیری از همین یک اشتباه، هزینه چند سال ابزار را می‌دهد.

و این فقط طرف پول است. طرف دیگر، ۴۸ ساعتی است که برای تست یک ستاپ لازم بود. وقت یک معامله‌گر جدی، ارزان‌ترین بخش این معادله نیست — گران‌ترین بخشش است.

سرمایه‌گذاری بلندمدت دقیقاً همین است: چیزی که امروز یک هزینه ثابت به نظر می‌رسد، و در طول دو سال، هم چند اشتباه پرهزینه را جلویش را می‌گیرد و هم صدها ساعت را آزاد می‌کند.

بک‌تست فقط نصف سؤال را جواب می‌دهد

اما یک هشدار، که بدون آن این مقاله ناقص است.

بک‌تست — چه دستی چه خودکار — فقط به یک سؤال جواب می‌دهد: «آیا این قانون در گذشته لبه داشته؟» به سؤال دوم جواب نمی‌دهد: «آیا من می‌توانم این قانون را اجرا کنم؟»

و فاصله بین این دو، جایی است که بیشتر حساب‌ها می‌سوزند. همان‌طور که در روان‌شناسی معامله‌گری دیدیم، سیستمی با نرخ برد ۵۸٪ در دست کسی که زیر فشار حد ضرر را جابه‌جا می‌کند، می‌تواند زیان‌ده باشد. موتور بک‌تست این را هیچ‌وقت به شما نمی‌گوید، چون موتور بک‌تست هیچ‌وقت نمی‌ترسد.

به همین دلیل مسیر کامل، سه حلقه دارد و اوتانا برای هر سه ساخته می‌شود: قانون را با موتور بک‌تست روی صدها نمونه می‌سنجید، همان قانون را با اسم مشخص در دفترچه استراتژی ثبت می‌کنید، و بعد هر معامله واقعی را با همان تگ در ژورنال ثبت می‌کنید. در بازبینی هفتگی، میانگین R واقعی را کنار میانگین R بک‌تست می‌گذارید. اگر این دو عدد فاصله زیادی داشتند، جواب یکی از این دو است: یا اجرای شما با قانون فاصله دارد، یا بازار عوض شده. هر دو جواب ارزشمندند، و هیچ‌کدام بدون این حلقه کامل قابل دیدن نیست.

تفاوت بک تست و فوروارد تست

بک‌تست قانون را روی داده گذشته اجرا می‌کند؛ فوروارد تست همان قانون را از امروز به بعد روی داده‌ای می‌برد که هنوز اتفاق نیفتاده — روی حساب دمو یا با کوچک‌ترین حجم ممکن روی حساب واقعی. تفاوت اصلی در سوالی است که هرکدام جواب می‌دهند: بک‌تست می‌گوید قانون در گذشته لبه داشته، فوروارد تست می‌گوید شما در شرایط واقعی — با اسپرد لحظه‌ای، تاخیر اجرا و فشار روانی — همان قانون را اجرا می‌کنید یا نه. به همین دلیل فوروارد تست را نمی‌شود سریع کرد: صدها نمونه‌ای که موتور بک‌تست در چند دقیقه می‌سنجد، در فوروارد تست به همان تعداد معامله واقعی و زمان واقعی نیاز دارد. ترتیب درست این است که اول با بک‌تست ترکیب‌های ضعیف را کنار بگذارید و فقط قانونی را به فوروارد تست ببرید که روی صدها نمونه دوام آورده باشد. اگر میانگین R فوروارد تست از میانگین R بک‌تست فاصله زیادی داشت، همان دو جواب قبلی مطرح است: یا اجرای شما با قانون فاصله دارد، یا بازار عوض شده.

جمع‌بندی

بک‌تست دستی کار می‌کند، همان‌طور که حساب کردن با چرتکه کار می‌کند. سؤال این نیست که ممکن است یا نه؛ سؤال این است که با چه دقتی، در چه مقیاسی، و به قیمت چند ساعت.

پنجاه نمونه، رشته ضرری که حسابتان را می‌بندد نشانتان نمی‌دهد. سه ترکیب، فضای جست‌وجوی یک استراتژی را پوشش نمی‌دهد. و عددی که نمی‌توانید دوباره تولیدش کنید، داده نیست.

معامله‌گری همیشه ریسک واقعی از دست دادن سرمایه دارد و هیچ بک‌تستی — دستی یا خودکار — نتیجه آینده را تضمین نمی‌کند؛ اعداد این مقاله برای نشان دادن مکانیزم‌اند، نه وعده نتیجه.

اما یک چیز قطعی است: تصمیمی که با ۵۰ نمونه می‌گیرید و تصمیمی که با ۵۰۰ نمونه می‌گیرید، دو تصمیم متفاوت‌اند — حتی اگر هر دو به یک عدد ختم شوند.

سوالات متداول

چند نمونه برای بک تست کافی است؟

برای یاد گرفتن یک ستاپ، ۲۰ تا ۳۰ نمونه دستی کافی است. برای تصمیم درباره حجم و ریسک، به صدها نمونه نیاز دارید. با نرخ برد ۴۰٪، احتمال دیدن یک رشته ۸ ضرری در ۵۰ نمونه حدود ۳۰٪ است؛ در ۵۰۰ نمونه همین احتمال به بالای ۹۵٪ می‌رسد.

بک تست دستی بهتر است یا خودکار؟

هرکدام کار متفاوتی می‌کنند. دستی چارت را نشانتان می‌دهد و حس ستاپ را می‌سازد؛ خودکار نمی‌تواند تقلب کند و صدها نمونه را با یک قانون ثابت اجرا می‌کند. اشتباه رایج این نیست که مردم دستی تست می‌کنند؛ این است که از یک ابزار یادگیری برای یک تصمیم مالی استفاده می‌کنند.

چرا نتیجه بک تست من با معاملات واقعی فرق دارد؟

دو دلیل رایج دارد: انتخاب سوگیرانه نمونه‌ها، چون ناخودآگاه سراغ ستاپ‌های تمیز می‌روید و مبهم‌ها را رد می‌کنید، و تفاوت اجرا زیر فشار. بک‌تست فقط می‌گوید قانون در گذشته لبه داشته، نه اینکه شما می‌توانید اجرایش کنید. موتور بک‌تست هیچ‌وقت نمی‌ترسد.

بک تست یک استراتژی چقدر طول می‌کشد؟

با روش دستی حدود ۹۰ دقیقه برای هر ترکیب پارامتر. یک ستاپ پولبک ساده با پنج متغیر دوحالته، ۳۲ ترکیب می‌سازد — یعنی حدود ۴۸ ساعت کار. در عمل کسی این وقت را نمی‌گذارد؛ دو سه ترکیب اول را برمی‌دارد و بقیه فضای جست‌وجو را هیچ‌وقت نمی‌بیند.

بک تست چه چیزی را نشان نمی‌دهد؟

فقط به یک سوال جواب می‌دهد: آیا این قانون در گذشته لبه داشته؟ به سوال دوم جواب نمی‌دهد: آیا شما می‌توانید اجرایش کنید؟ سیستمی با نرخ برد ۵۸٪ در دست کسی که زیر فشار حد ضرر را جابه‌جا می‌کند، می‌تواند زیان‌ده باشد و هیچ موتوری این را پیش‌بینی نمی‌کند.


مطالب مرتبط

ت
تحریریه اوتانا
نوشته‌شده در ۲ شهریور ۱۴۰۵

بعد از این، این‌ها را بخوانید

استراتژی

پلن معاملاتی: از ایده مبهم تا قانون قابل اندازه‌گیری

نوشتن پلن معاملاتی یعنی تبدیل ایده مبهم به قانون قابل اندازه‌گیری. فرمت اگر-آنگاه، فیلدهای هر ستاپ، اندازه‌گیری رعایت قانون و اصلاح در بازبینی هفتگی.

تحریریه اوتانا·۸ دقیقه·۲
استراتژی

سشن‌های فارکس به وقت ایران: لندن، نیویورک و توکیو

سشن‌های فارکس به وقت ایران: ساعت دقیق توکیو، لندن و نیویورک، دامنه نوسان هر سشن با عدد پیپ، ساعات کم‌نقدینگی و راهنمای انتخاب سشن مناسب استراتژی شما.

تحریریه اوتانا·۸ دقیقه·۰
استراتژی

استیتمنت متاتریدر 5 و وارد کردن آن در ژورنال معاملاتی

راهنمای گام‌به‌گام گرفتن استیتمنت متاتریدر 5 و وارد کردن آن در ژورنال اوتانا: خروجی گزارش تفصیلی، ثبت دقیق کارمزد و سواپ و چک کردن کامل بودن ایمپورت.

تحریریه اوتانا·۸ دقیقه·۰
همین را روی معاملات خودتان تمرین کنید

ژورنال اوتانا همین یادداشت‌ها را کنار معامله نگه می‌دارد و الگویشان را بیرون می‌کشد.

شروع رایگان