نود دقیقه وقت میگذارید، ۵۰ نمونه از چارت جمع میکنید، در یک صفحه گسترده حساب میکنید و به یک عدد میرسید: انتظار ریاضی 0.4R. راضی هستید. بعد یک فکر ساده به ذهنتان میرسد — «اگر بهجای EMA50 از EMA20 استفاده کنم چه میشود؟»
همان لحظه، آن ۹۰ دقیقه بیارزش شد. باید از اول شروع کنید.
این مقاله درباره همین هزینه است: نه هزینهای که برای ابزار میپردازید، بلکه هزینهای که وقتی ابزار ندارید میپردازید و در هیچ صورتحسابی نمیبینیدش.
تعداد نمونه کافی برای بک تست چقدر است؟
این جدیترین مشکل بکتست دستی است و کمتر از همه دربارهاش حرف زده میشود.
فرض کنید استراتژیتان نرخ برد ۴۰٪ دارد — یک عدد کاملاً معمولی برای یک سیستم سوئینگ با R:R بالا. حالا این سؤال را بپرسید: احتمال اینکه ۸ ضرر پشت سر هم بخورید چقدر است؟
- در ۵۰ نمونه، احتمال دیدن چنین رشتهای حدود ۳۰٪ است
- در ۵۰۰ نمونه، این احتمال به بالای ۹۵٪ میرسد
معنی عملی این دو عدد را دقیق بخوانید: رشته ۸ ضرری در استراتژی شما وجود دارد. بازار قرار است دیر یا زود آن را به شما نشان بدهد. اما بکتست ۵۰ نمونهای شما، در ۷ بار از ۱۰ بار، آن را نشان نمیدهد.
و اینجاست که ضرر واقعی شکل میگیرد: شما حجم معاملهتان را بر اساس بدترین رشته ضرری که دیدهاید تنظیم میکنید، نه بدترین رشتهای که وجود دارد. همانطور که در ریسک ثابت درصدی دیدیم، طول رشته ضرر تنها عددی است که درصد ریسک درست را تعیین میکند. اگر آن عدد را اشتباه بدانید، هر محاسبه بعدی هم اشتباه است.
یک بکتست ۵۰ نمونهای به شما نمیگوید استراتژی بد است. چیز خطرناکتری به شما میگوید: یک اطمینان کاذب که با عدد پشتیبانی میشود.
چرا هر تغییر پارامتر، بکتست دستی را از صفر شروع میکند
ساختن یک استراتژی، نوشتن یک قانون و تست کردنش نیست. جستوجو کردن است. شما یک ایده اولیه دارید و باید دهها نسخه از آن را امتحان کنید تا بفهمید کدام نسخه واقعاً لبه دارد.
یک ستاپ ساده پولبک را در نظر بگیرید. متغیرهایی که باید تست شوند:
- کدام میانگین متحرک — EMA20، EMA50 یا MA200؟
- استاپ زیر کف پولبک یا با فاصله ثابت؟
- تارگت ثابت یا تریل؟
- فقط در جهت روند D1 یا مستقل از آن؟
- در همه سشنها یا فقط سشن لندن؟
فقط همین پنج متغیر، اگر هرکدام دو حالت داشته باشند، ۳۲ ترکیب میسازند. با بکتست دستی و ۹۰ دقیقه به ازای هر ترکیب، این میشود ۴۸ ساعت کار — یک هفته کاری کامل، برای تست یک ستاپ.
در عمل چه اتفاقی میافتد؟ هیچکس ۴۸ ساعت وقت نمیگذارد. معاملهگر دو یا سه ترکیب را تست میکند، اولی که عدد قابل قبولی داد را برمیدارد، و بقیه فضای جستوجو را هیچوقت نمیبیند. شاید ترکیب هفدهم دو برابر بهتر بود؛ هیچوقت نمیفهمد.
سوگیری انتخاب نمونه در بکتست دستی
وقتی خودتان روی چارت اسکرول میکنید و نمونهها را انتخاب میکنید، ناخودآگاه سراغ ستاپهای تمیز و واضح میروید و نمونههای مبهم را رد میکنید. نتیجه، مصنوعی مثبت میشود.
راهکارهایی برای کم کردن این سوگیری وجود دارد — مثلاً اول علامت ورود و استاپ را بگذارید و بعد به جلو اسکرول کنید. اما هیچکدام کامل نیست، به یک دلیل ساده: شما آن بازه از بازار را قبلاً دیدهاید. میدانید مارس آن سال ریزش بزرگی داشت. این دانش را نمیشود از ذهن پاک کرد.
یک موتور بکتست این مشکل را ندارد، نه به این دلیل که باهوشتر است، بلکه به این دلیل که نمیتواند تقلب کند. قانون را روی هر نمونهای که شرط را برآورده میکند اجرا میکند، چه آن نمونه زیبا باشد چه زشت، چه نتیجهاش را دوست داشته باشید چه نه.
تکرارپذیری بکتست: چرا نتیجه دستی قابل بازتولید نیست
سه ماه بعد، به صفحه گسترده بکتستتان نگاه میکنید و عدد 0.4R را میبینید. حالا این سؤالها را جواب بدهید:
- این عدد با کدام نسخه از قانون به دست آمد؟ قبل یا بعد از اینکه فیلتر سشن را اضافه کردید؟
- اسپرد در محاسبه لحاظ شده بود؟
- کدام بازه زمانی؟ فقط بازار روندی، یا رنج هم داخلش بود؟
اگر یادداشت دقیق نگه نداشته باشید — و تقریباً هیچکس نگه نمیدارد — جواب هیچکدام را نمیدانید. یعنی آن عدد، دیگر یک داده نیست؛ یک خاطره است.
بکتست تکرارپذیر یعنی میتوانید همان قانون را با یک کلیک دوباره اجرا کنید، نتیجه دقیقاً همان دربیاید، و ببینید تغییر دادن یک پارامتر چه اثری داشت. این تفاوت بین «فکر میکنم این ستاپ خوب بود» و «میدانم این ستاپ چه عددی داد و چرا» است.
پس بکتست دستی کاملاً بیفایده است؟
نه، و ادعای خلافش صادقانه نیست.
بکتست دستی یک فایده واقعی دارد که هیچ موتوری جایش را نمیگیرد: شما چارت را میبینید. وقتی ۳۰ نمونه از یک ستاپ را با چشم مرور میکنید، الگویی در ذهنتان شکل میگیرد که یک عدد خروجی هیچوقت نمیسازد — میفهمید این ستاپ در چه فضایی نفس میکشد و کجا خفه میشود.
پس تقسیم کار درست این است:
- برای یاد گرفتن یک ستاپ: ۲۰ تا ۳۰ نمونه دستی، با چشم. این مرحله را رد نکنید.
- برای تصمیم گرفتن درباره حجم و ریسک: هرگز دستی. اینجا به صدها نمونه نیاز دارید، نه ۵۰ تا.
خلاصه تفاوت دو روش:
| معیار | بکتست دستی | بکتست خودکار |
|---|---|---|
| تعداد نمونه | در عمل ۲۰ تا ۵۰ نمونه | صدها نمونه؛ ۵۰۰ نمونه و بیشتر |
| زمان هر تست | حدود ۹۰ دقیقه برای هر ترکیب پارامتر | حدود ۹۰ ثانیه برای هر ترکیب |
| سوگیری | سراغ ستاپهای تمیز میروید و نمونههای مبهم را رد میکنید؛ آن بازه از بازار را قبلاً دیدهاید | قانون روی هر نمونهای که شرط را برآورده کند اجرا میشود، زیبا یا زشت |
| تکرارپذیری | بدون یادداشت دقیق، نسخه قانون و اسپرد و بازه زمانی معلوم نیست | همان قانون با یک اجرای دوباره، دقیقاً همان نتیجه را میدهد |
| کاربرد درست | یاد گرفتن یک ستاپ با ۲۰ تا ۳۰ نمونه | تصمیم درباره حجم و ریسک، که به صدها نمونه نیاز دارد |
اشتباه رایج این نیست که مردم دستی تست میکنند؛ این است که از یک ابزار یادگیری، برای یک تصمیم مالی استفاده میکنند.
سرعت، خودش یک مزیت است — نه یک راحتی
اینجا نکته اصلی است. وقتی میگوییم موتور بکتست «سریعتر» است، معمولاً بهعنوان یک راحتی شنیده میشود: همان کار، با وقت کمتر.
اما این توصیف اشتباه است. سرعت، کیفیت تصمیم را عوض میکند، نه فقط زمانش را.
با ۹۰ دقیقه به ازای هر تست، شما ۳ ترکیب را امتحان میکنید. با ۹۰ ثانیه، همان روز ۶۰ ترکیب را امتحان میکنید. این دو، دو کیفیت متفاوت از یک استراتژی نیستند — دو جهان متفاوت از چیزی هستند که درباره استراتژیتان میدانید. در حالت اول دارید حدس میزنید کدام پارامتر بهتر است؛ در حالت دوم دارید میبینید.
و یک اثر جانبی مهم دارد: وقتی رد کردن یک ایده ارزان باشد، ایدههای بد را زودتر دور میاندازید. وقتی هر تست ۹۰ دقیقه هزینه دارد، ناخودآگاه به ایدهای که رویش وقت گذاشتهاید میچسبید — همان سوگیری که باعث میشود استراتژی ضعیف را ماهها روی حساب واقعی نگه دارید.
چرا این یک سرمایهگذاری است، نه یک خرج
عدد را روی کاغذ بیاوریم.
فرض کنید حسابی با موجودی $10,000 دارید و استراتژیای که در بکتست دستی ۵۰ نمونهای، انتظار ریاضی +0.4R نشان داده. در واقعیت — چون نمونه کم بود و انتخاب نمونهها هم کمی سوگیرانه — این استراتژی در بلندمدت سربهسر است، نه مثبت.
چقدر طول میکشد تا بفهمید؟ با ۲۰ معامله در ماه، حدود سه تا چهار ماه. و در این مدت، با ریسک ۱٪ در هر معامله و یک رشته ضرر معمولی، بهراحتی ۱۰٪ تا ۱۵٪ افت سرمایه میبینید. روی $10,000، یعنی $1,000 تا $1,500 — فقط بابت یک استراتژی که از همان اول قرار نبود جواب بدهد.
حالا این عدد را کنار هزینه سالانه یک ابزار بکتست بگذارید. یک بار جلوگیری از همین یک اشتباه، هزینه چند سال ابزار را میدهد.
و این فقط طرف پول است. طرف دیگر، ۴۸ ساعتی است که برای تست یک ستاپ لازم بود. وقت یک معاملهگر جدی، ارزانترین بخش این معادله نیست — گرانترین بخشش است.
سرمایهگذاری بلندمدت دقیقاً همین است: چیزی که امروز یک هزینه ثابت به نظر میرسد، و در طول دو سال، هم چند اشتباه پرهزینه را جلویش را میگیرد و هم صدها ساعت را آزاد میکند.
بکتست فقط نصف سؤال را جواب میدهد
اما یک هشدار، که بدون آن این مقاله ناقص است.
بکتست — چه دستی چه خودکار — فقط به یک سؤال جواب میدهد: «آیا این قانون در گذشته لبه داشته؟» به سؤال دوم جواب نمیدهد: «آیا من میتوانم این قانون را اجرا کنم؟»
و فاصله بین این دو، جایی است که بیشتر حسابها میسوزند. همانطور که در روانشناسی معاملهگری دیدیم، سیستمی با نرخ برد ۵۸٪ در دست کسی که زیر فشار حد ضرر را جابهجا میکند، میتواند زیانده باشد. موتور بکتست این را هیچوقت به شما نمیگوید، چون موتور بکتست هیچوقت نمیترسد.
به همین دلیل مسیر کامل، سه حلقه دارد و اوتانا برای هر سه ساخته میشود: قانون را با موتور بکتست روی صدها نمونه میسنجید، همان قانون را با اسم مشخص در دفترچه استراتژی ثبت میکنید، و بعد هر معامله واقعی را با همان تگ در ژورنال ثبت میکنید. در بازبینی هفتگی، میانگین R واقعی را کنار میانگین R بکتست میگذارید. اگر این دو عدد فاصله زیادی داشتند، جواب یکی از این دو است: یا اجرای شما با قانون فاصله دارد، یا بازار عوض شده. هر دو جواب ارزشمندند، و هیچکدام بدون این حلقه کامل قابل دیدن نیست.
تفاوت بک تست و فوروارد تست
بکتست قانون را روی داده گذشته اجرا میکند؛ فوروارد تست همان قانون را از امروز به بعد روی دادهای میبرد که هنوز اتفاق نیفتاده — روی حساب دمو یا با کوچکترین حجم ممکن روی حساب واقعی. تفاوت اصلی در سوالی است که هرکدام جواب میدهند: بکتست میگوید قانون در گذشته لبه داشته، فوروارد تست میگوید شما در شرایط واقعی — با اسپرد لحظهای، تاخیر اجرا و فشار روانی — همان قانون را اجرا میکنید یا نه. به همین دلیل فوروارد تست را نمیشود سریع کرد: صدها نمونهای که موتور بکتست در چند دقیقه میسنجد، در فوروارد تست به همان تعداد معامله واقعی و زمان واقعی نیاز دارد. ترتیب درست این است که اول با بکتست ترکیبهای ضعیف را کنار بگذارید و فقط قانونی را به فوروارد تست ببرید که روی صدها نمونه دوام آورده باشد. اگر میانگین R فوروارد تست از میانگین R بکتست فاصله زیادی داشت، همان دو جواب قبلی مطرح است: یا اجرای شما با قانون فاصله دارد، یا بازار عوض شده.
جمعبندی
بکتست دستی کار میکند، همانطور که حساب کردن با چرتکه کار میکند. سؤال این نیست که ممکن است یا نه؛ سؤال این است که با چه دقتی، در چه مقیاسی، و به قیمت چند ساعت.
پنجاه نمونه، رشته ضرری که حسابتان را میبندد نشانتان نمیدهد. سه ترکیب، فضای جستوجوی یک استراتژی را پوشش نمیدهد. و عددی که نمیتوانید دوباره تولیدش کنید، داده نیست.
معاملهگری همیشه ریسک واقعی از دست دادن سرمایه دارد و هیچ بکتستی — دستی یا خودکار — نتیجه آینده را تضمین نمیکند؛ اعداد این مقاله برای نشان دادن مکانیزماند، نه وعده نتیجه.
اما یک چیز قطعی است: تصمیمی که با ۵۰ نمونه میگیرید و تصمیمی که با ۵۰۰ نمونه میگیرید، دو تصمیم متفاوتاند — حتی اگر هر دو به یک عدد ختم شوند.
سوالات متداول
چند نمونه برای بک تست کافی است؟
برای یاد گرفتن یک ستاپ، ۲۰ تا ۳۰ نمونه دستی کافی است. برای تصمیم درباره حجم و ریسک، به صدها نمونه نیاز دارید. با نرخ برد ۴۰٪، احتمال دیدن یک رشته ۸ ضرری در ۵۰ نمونه حدود ۳۰٪ است؛ در ۵۰۰ نمونه همین احتمال به بالای ۹۵٪ میرسد.
بک تست دستی بهتر است یا خودکار؟
هرکدام کار متفاوتی میکنند. دستی چارت را نشانتان میدهد و حس ستاپ را میسازد؛ خودکار نمیتواند تقلب کند و صدها نمونه را با یک قانون ثابت اجرا میکند. اشتباه رایج این نیست که مردم دستی تست میکنند؛ این است که از یک ابزار یادگیری برای یک تصمیم مالی استفاده میکنند.
چرا نتیجه بک تست من با معاملات واقعی فرق دارد؟
دو دلیل رایج دارد: انتخاب سوگیرانه نمونهها، چون ناخودآگاه سراغ ستاپهای تمیز میروید و مبهمها را رد میکنید، و تفاوت اجرا زیر فشار. بکتست فقط میگوید قانون در گذشته لبه داشته، نه اینکه شما میتوانید اجرایش کنید. موتور بکتست هیچوقت نمیترسد.
بک تست یک استراتژی چقدر طول میکشد؟
با روش دستی حدود ۹۰ دقیقه برای هر ترکیب پارامتر. یک ستاپ پولبک ساده با پنج متغیر دوحالته، ۳۲ ترکیب میسازد — یعنی حدود ۴۸ ساعت کار. در عمل کسی این وقت را نمیگذارد؛ دو سه ترکیب اول را برمیدارد و بقیه فضای جستوجو را هیچوقت نمیبیند.
بک تست چه چیزی را نشان نمیدهد؟
فقط به یک سوال جواب میدهد: آیا این قانون در گذشته لبه داشته؟ به سوال دوم جواب نمیدهد: آیا شما میتوانید اجرایش کنید؟ سیستمی با نرخ برد ۵۸٪ در دست کسی که زیر فشار حد ضرر را جابهجا میکند، میتواند زیانده باشد و هیچ موتوری این را پیشبینی نمیکند.
مطالب مرتبط