एजंट्स

प्रत्यक्षात चालणाऱ्या चाचण्या

याला तुमच्या कोडकडे निर्देशित करा. हे टेस्ट्स लिहिते, Node द्वारे आधीच मिळणाऱ्या टेस्ट रनरसह त्या चालवते, आणि काय बिघडले ते सांगते — अपयश यशस्वी करण्यासाठी तुमच्या कोडमध्ये संपादन न करता.

काही चाचण्या लिहावापरण्यासाठी मोफत. काहीही इंस्टॉल करण्याची गरज नाही.

हे कसे काम करते

तीन पायऱ्या, आणि त्यातील एकही “कॉन्फिगर करा” नाही.

  1. 01

    याला कोड द्या

    एक लहान चेकआउट मॉड्यूल आधीच उघडे आहे, किंवा तुमचे स्वतःचे आणा. एक ओळ लिहिण्यापूर्वी हे कोड कशासाठी आहे ते वाचते.

  2. 02

    हे लिहिते, चालवते आणि त्रुटी वाचते

    न चालवलेली चाचणी म्हणजे कोड काय करतो याबद्दलचा केवळ एक अंदाज. प्रत्येक बदल लागू करून चालवला जातो आणि मिळणारा आउटपुट पुढील विचारांचा आधार असतो.

  3. 03

    दोनपैकी कोणती गोष्ट चुकीची घडली ते हे सांगते

    किंवा चाचणीची चुकीची अपेक्षा आहे, किंवा कोडमध्ये बग आहे. या दोन्हीवर परस्परविरोधी उपाय असतात आणि न सांगता अंदाज लावणे ही सर्वात चुकीची गोष्ट ठरेल.

हे काय करू शकते

  • तुमचा कोड बदलून हे टेस्ट सूट पास करणार नाही

    या नियमावरच हा संपूर्ण एजंट कार्य करतो. अयशस्वी झालेली चाचणी ही केस, कोड सध्या काय करतो आणि त्याने काय केले पाहिजे हे सांगते. दुरुस्ती सुचवली जाते; तुम्ही सांगितल्यावरच ती लागू केली जाते.

  • प्रथम सीमा तपासा

    नक्की थ्रेशोल्डवर, दोन्ही बाजूंना एक, शून्य, रिकामे, एक घटक, सर्वात मोठे वास्तववादी मूल्य. तिथेच वर्तन बदलते आणि त्यामुळे चुका तिथेच असतात — श्रेणीच्या मध्यभागी कोणालाही आश्चर्य वाटत नाही.

  • इन्स्टॉल करण्यासाठी काहीही नाही

    Node 22 सोबत टेस्ट रनर आणि अ‍ॅसर्टन मॉड्यूल येते; Python सोबत unittest येते. सामान्य केससाठी नेटवर्क किंवा पॅकेजची गरज नसते, जे पुनरावृत्ती करणाऱ्या एजंटसाठी महत्त्वाचे असते.

हे कसे सेट केले आहे

कार्यपद्धती, जेणेकरून साइन इन करण्यापूर्वी तुम्हाला काय मिळत आहे हे तुम्हाला माहीत असेल.

वातावरण
Node 22 आणि Python 3 सह एक Linux कंटेनर. चाचण्या तिथे चालतात आणि फाइलच्या खाली टर्मिनल फलकात आउटपुट दिसतो.
साधने
फाईल्स वाचणे, लिहिणे आणि संपादन करणे, ग्लोब, ग्रेप आणि सूट चालवण्यासाठी शेल.
मॉडेल
कोणतेही चॅट मॉडेल. हे लूपमध्ये काम करते — लिहा, चालवा, वाचा, ठरवा — त्यामुळे जलद लिहिणाऱ्या मॉडेलपेक्षा आउटपुट काळजीपूर्वक वाचणाऱ्या मॉडेलला प्राधान्य मिळते.
सुरुवातीच्या फाइल्स
दोन खऱ्या बगसह एक लहान चेकआउट मॉड्यूल, दोन्ही सीमा-संबंधित, जेणेकरून पहिलीच धाव थेट यशस्वी न होता एजंट ज्यासाठी बनवला आहे त्या वळणावर पोहोचेल.
काय राहते
चाचण्या चाचण्यांच्या डिरेक्टरीमध्ये लिहिल्या जातात आणि तिथेच राहतात. फाइलवरील Run बटणाने त्यांपैकी कोणतीही चाचणी पुन्हा स्वतः चालवा.

लोक ज्या गोष्टी विचारतात

  • cart.js साठी चाचण्या लिहा, त्या चालवा आणि तुम्हाला काय आढळले ते मला सांगा.
  • फ्री-शिपिंग नियमाची नक्की थ्रेशोल्डवर आणि त्याच्या दोन्ही बाजूंना चाचणी करा.
  • या फाइलमध्ये कशाची चाचणी घेतलेली नाही?
  • या चाचण्या पास झाल्या आहेत पण मला त्यांच्यावर विश्वास नाही — त्या काय तपासत नाहीत?

हे काय करणार नाही

यातील प्रत्येक मर्यादा आम्ही प्रत्यक्षात अनुभवली आहे, हा रोडमॅपचा भाग नाही.

  • सलग दोनदा तीच त्रुटी आल्यास हे थांबते आणि काय अडकले आहे ते सांगते. बदल न झालेल्या त्रुटीवर तिसरा प्रयत्न हा लूप असतो, प्रगती नाही.
  • त्रुटी दूर करण्यासाठी हे अ‍ॅसर्टन कमकुवत करणार नाही. अचूक मूल्याऐवजी अंदाजे मूल्य स्वीकारल्यास सापडलेला बग लपून जातो.
  • तुम्ही जे द्याल त्याचीच हे चाचणी करते. हे तुमच्या CI, डेटाबेस किंवा इतरत्र चालणाऱ्या सेवेपर्यंत पोहोचू शकत नाही.

कोणते मॉडेल हे सर्वोत्तम करते

लवकरच येत आहे

आम्ही या एजंटसाठी प्रति-मॉडेल निकाल एकत्रित करत आहोत — तुम्हाला हस्तक्षेप न करता रन किती वेळा काम पूर्ण करते, त्याचा खर्च किती येतो आणि त्याला किती वेळ लागतो. त्यांचे काही महत्त्व उरणे शक्य होईल इतक्या रन्स झाल्यावर संख्या येथे दिसतील, आणि तिन्ही एकत्र प्रकाशित केल्या जातात: सोडून देऊन पटकन पूर्ण करणारे मॉडेल पूर्ण होण्यास संथ असते, आणि कठोर परिश्रम करून सर्व काही पूर्ण करणारे मॉडेल महाग असते.

पूर्णतेचा दर

तुम्हाला हस्तक्षेप न करता काम पूर्ण करणाऱ्या रन्स.

मध्यक खर्च

क्रेडिट्समध्ये, एका सामान्य रनचा खर्च किती येतो.

मध्यक वेळ

भिंतीवरील घड्याळ, पहिल्या संदेशापासून उत्तरापर्यंत.

प्रत्यक्षात चालणाऱ्या चाचण्या

हे आधीच सेट केले आहे. ते उघडा आणि काहीतरी विचारा.

काही चाचण्या लिहा

प्रत्येक एजंट ब्राउझ करा