हे सोमवारी चालते. तुम्ही एक परिच्छेद वाचता.
याला पृष्ठांची यादी आणि सकाळची वेळ द्या. आपण झोपलेले असताना ते ते तपासते, बिल्ड आयडी आणि फिरणारे बॅनर दुर्लक्षित करते, आणि बदललेल्या किमती सांगते — किंवा काहीही बदलले नाही ते सांगते.
हे कसे काम करते
तीन पायऱ्या, आणि त्यातील एकही “कॉन्फिगर करा” नाही.
- 01
याला एक यादी आणि सकाळची वेळ द्या
पृष्ठांचे आणि त्यावर आपल्याला काय हवे आहे त्याचे markdown टेबल. नंतर केव्हा ते सांगा — “प्रत्येक सोमवारी नऊ वाजता” — आणि ते स्वतःचे शेड्यूलिंग बुक करते आणि करण्यापूर्वी कोणाच्याही उपस्थितीशिवाय चालण्याचा काय अर्थ आहे ते सांगते.
- 02
ते कोणीही उपस्थित नसताना चालते
प्रत्येक रन सर्व पृष्ठे मिळवते, त्यांची तुलनायोग्य मजकुरात छाटणी करते आणि मागील वेळच्या स्नॅपशॉटशी त्यांची तुलना करते. पहिला रन हा मूळ आधार असतो आणि काहीही रिपोर्ट करत नाही, जी तुलना करण्यासाठी काहीही नसतानाचे प्रामाणिक उत्तर आहे.
- 03
काय बदलले तेच फक्त आपल्याला मिळते
reports/ मध्ये तारखेसह अहवाल, हे सेटअप केल्याचे विसरलेल्या व्यक्तीने फोनवर वाचण्यासाठी लिहिलेला. जुने अहवाल कधीही हटवले जात नाहीत, त्यामुळे इतिहास हाच मुख्य उद्देश आहे.
हे काय करू शकते
त्याला बदल आणि निरर्थक चर्नमधील फरक माहित आहे
डिप्लॉय हॅश, कॅश-बस्टिंग क्वेरी स्ट्रिंग, प्रत्येक लोडवर बदलणारे टेस्टिमोनियल — दहा सेकंदांच्या अंतराने केलेल्या दोन फेचमध्ये हे वेगळे असतात. एखादे पृष्ठ तसे आहे हे ते एकदा सांगते आणि नंतर रिपोर्ट करणे थांबवते, कारण दर आठवड्याला खोटा इशारा देणारी फीड कोणीही उघडत नाही.
शांत आठवड्यासाठी एक ओळ दिली जाते
काहीही बदलले नाही तर रिपोर्ट सांगतो की काहीही बदलले नाही. काम झाल्याचे दाखवण्यासाठी ते “कोणताही बदल नाही” अशा ओळींनी पान भरणार नाही — लहान रिपोर्ट हा शांत आठवड्याचा प्रामाणिक प्रकार आहे.
तुमची स्वतःची यादी चुकीची असल्यास ते तुम्हाला सांगते
पत्ता नसलेली ओळ, तेच पान दोनदा सूचीबद्ध असणे, तुम्ही पाहायला सांगितलेल्या किमती नसलेले होमपेज. रन अयशस्वी करणे किंवा तुमची फाईल शांतपणे संपादित करणे याऐवजी ते ओळीनुसार रिपोर्ट करते आणि पुढे जात राहते.
हे कसे सेट केले आहे
कार्यपद्धती, जेणेकरून साइन इन करण्यापूर्वी तुम्हाला काय मिळत आहे हे तुम्हाला माहीत असेल.
- वातावरण
- नेटवर्कसह एक सँडबॉक्स, जो Mume च्या इग्रेस प्रॉक्सीद्वारे पोहोचला जातो — प्रत्येक विनंती पूर्ण केली जाते आणि लॉग केली जाते. शेड्यूल केलेल्या रनला एका शेड्यूलपुरती मर्यादित अल्पमुदतीची क्रेडेंशियल मिळतात, आपल्या सत्राची प्रत नाही.
- साधने
- पृष्ठे मिळवण्यासाठी आणि लहान करण्यासाठी bash, वर्कस्पेससाठी readFile, writeFile, editFile, glob, grep, आठवड्याचा अहवाल कोणत्या आठवड्याचा आहे हे समजण्यासाठी getCurrentTime, आणि scheduleRun, listSchedules व cancelSchedule.
- मॉडेल
- कॅटलॉगमधील कोणताही चॅट मॉडेल. येथील निर्णय संपादकीय आहे — चाळीस बदलांपैकी कोणता बदल एका वाक्यात सांगण्यासारखा आहे ते ठरवणे.
- सुरुवातीच्या फाइल्स
- वॉचलिस्टसह आणि कोणत्याही स्नॅपशॉटशिवाय सुरू केले जाते, जेणेकरून पहिला रन हा मूळ आधारभूत रन असेल. यादीमध्ये पाच समस्या आहेत: एक डुप्लिकेट रांग, URL नसलेली रांग, प्रत्येक वेळी मिळवताना बदलणारे पृष्ठ, एक अस्पष्ट ब्रीफ आणि एक विनंती ज्यासाठी कोणतेही टूल नाही.
- काय राहते
- स्नॅपशॉट आणि प्रत्येक अहवाल सत्रासोबत राहतात, ज्यामुळे दुसऱ्या आठवड्याला अर्थ प्राप्त होतो. रन दरम्यान काहीही हटवले जात नाही.
लोक ज्या गोष्टी विचारतात
- “वॉचलिस्टवरील सर्व गोष्टी तपासा आणि सोमवारच्या सकाळी साप्ताहिक रन सेट करा.”
- “गेल्या आठवड्यापासून काय बदलले आहे?”
- “माझ्या वॉचलिस्टमध्ये काय चूक आहे?”
- “साप्ताहिक रन थांबवा.”
हे काय करणार नाही
यातील प्रत्येक मर्यादा आम्ही प्रत्यक्षात अनुभवली आहे, हा रोडमॅपचा भाग नाही.
- ते आपल्याला काहीही पाठवू शकत नाही. कोणतेही ईमेल किंवा सूचना टूल नाही, त्यामुळे अहवाल ही वर्कस्पेस मधील एक फाइल असते — न येणाऱ्या संदेशाची वाट पाहत ठेवण्याऐवजी ते पहिल्याच रनवर हे स्पष्ट सांगते.
- ते सर्व्हरने पाठवलेले वाचते. पूर्णपणे ब्राऊजरमध्ये रेंडर होणारे पृष्ठ जवळजवळ रिकामे येते, आणि रिकामे पृष्ठ कायमचे अपरिवर्तित म्हणून रिपोर्ट करण्याऐवजी ते आपल्याला तसे सांगेल.
- ते पृष्ठे पाहते, उत्पादने नाही. केवळ लॉग-इन केलेल्या डॅशबोर्डमध्ये किंवा फॉर्ममागील PDF मधील बदललेली किंमत ते पाहू शकत नाही.
- शेड्यूल केलेले रन आपल्याला काहीही विचारू शकत नाहीत. उत्तर देण्यासाठी कोणीही नसल्यामुळे, ते लिहिलेल्या सूचनेनुसार कार्य करतात — म्हणूनच ते शेड्यूलिंग बुक करण्यापूर्वी सूचनेला मंजुरी देण्यास सांगते.
कोणते मॉडेल हे सर्वोत्तम करते
Measured over real runs of this agent, per model. A run counts as finished when it produced the answer on its own — nothing failed, nobody was asked to approve anything, and it did not run out of steps. Read all three columns together: a model that finishes fast by giving up scores badly on the first, and one that completes everything by grinding scores badly on the second.
| Model | पूर्णतेचा दर | मध्यक खर्च | मध्यक वेळ | Runs |
|---|---|---|---|---|
| claude-sonnet-5anthropic | 93% | $0.066 | 43s | 15 |
- पूर्णतेचा दर
- तुम्हाला हस्तक्षेप न करता काम पूर्ण करणाऱ्या रन्स.
- मध्यक खर्च
- क्रेडिट्समध्ये, एका सामान्य रनचा खर्च किती येतो.
- मध्यक वेळ
- भिंतीवरील घड्याळ, पहिल्या संदेशापासून उत्तरापर्यंत.
Medians over the runs behind each row. A model appears once it has 3 runs on this agent, and the run count is shown so you can judge how much a figure rests on.
हे सोमवारी चालते. तुम्ही एक परिच्छेद वाचता.
हे आधीच सेट केले आहे. ते उघडा आणि काहीतरी विचारा.
वॉच सेट करा