| FazBrowse GitHub Viewer | Trending | | Home |
| Tools: [Download Repo ZIP] [View Raw Code] [Original HTTPS Page] |
English · 简体中文 · 繁體中文 · Français · Deutsch · Italiano · Español · 日本語 · 한국어 · Русский · Português (Brasil) · Türkçe · Polski · Čeština · Magyar
Fordulat SKILL.md ellenőrizhető futásidejű elvárásokba. Nézze meg, valójában mit megtörtént, ahol a viselkedés először eltért, és az ítélet mögött meghúzódó bizonyítékok.
Agent Skill Runtime Intelligence egy csak olvasható futásidejű bizonyíték- és diagnosztikai rendszer az Agent Skills számára. Kivonja a konzervatív, ellenőrizhető megszorításokat a jelenlegi Skill definícióból, hozzáigazítja azokat a futásidejű tevékenységhez, és az eredményt bizonyítékok szerinti osztályozásként rekonstruálja. Skill Run Panorama. Egyesíti a hivatalos ügynök-eseményeket, az importált nyomkövetéseket, a címkézett munkamenet-visszaesést és a megfigyelhető munkaterület-eredményeket anélkül, hogy proxy-modellkérelmeket venne át, vagy átvenné az ügynökhurkot.
Telepítse és indítsa el a legújabb kiadást macOS vagy Linux:
curl -LsSf https://raw.githubusercontent.com/hellogxp/skill-runtime-intelligence/main/scripts/install.sh | sh -s -- --startNincs klón, fiók, sudo, vagy GitHub CLI szükséges. A telepítő ellenőrzi a kiadás ellenőrző összegét, észleli a támogatott ügynököket és készségeket, elmagyaráz minden elérési utat, amelyet olvasni fog, egyszer megkérdezi a csak megfigyelési hook engedélyezése előtt, és megnyitja a helyi UI at http://127.0.0.1:4317. A futásidejű adatok alatt maradnak ~/.skill-runtime kivéve, ha kifejezetten konfigurál egy exportálást.
Megteheti ellenőrizze a telepítőt futtatása előtt.
skill-runtime doctor
skill-runtime statusAz integráció csak akkor Élő, ha a Collector valódi futásidejű eseményt kap. Egy beállított, de nem megfigyelt Hook Függőben – soha nem mutatták be élő bizonyítékként. Nyitott http://127.0.0.1:4317, vagy lásd a Útmutató az első lépésekhez ügynökspecifikus utasításokért és hibaelhárításért.
Közvetlenül a forráspénztárból történő futtatáshoz:
python3 -m venv .venv
.venv/bin/python -m pip install -e .
.venv/bin/skill-runtime install --enable-hooks
.venv/bin/skill-runtime start| A termék felülete | Mit válaszol |
|---|---|
| Runtime Overview | Melyik SkillRuns kell figyelni? |
| Képesség-viselkedés ellenőrzése | Mely ellenőrizhető utasítások teljesültek, felülvizsgálatra szorulnak, vagy nem értékelhetők? |
| Mi történt valójában | Milyen utasításokat, forrásokat, eszközöket, műtermékeket és eredményeket figyeltek meg? |
| First Observable Boundary | Hol hiányoznak vagy hibáznak először a futásspecifikus bizonyítékok? |
| Skill Run Panorama | Hogyan kapcsolódott össze a kérés, az aktiválás, az erőforrások, az eszközök, a műtermékek és az eredmény? |
| Evidence Inspector | Milyen forrás, minőség, alap és adapter képesség támasztja alá ezt az állítást? |
| Hasonlítsa össze | A különbség viselkedésbeli, vagy csak megfigyelhetőségi különbség? |
| Inferred Analysis | Milyen bizonyítékokhoz kötött magyarázat vagy következő vizsgálat hihető? |
| Beállítások / Orvos | Mi az olvasott, tárolt, exportált, függőben lévő és ellenőrzött? |
Skill Runtime megfigyeli a már használt munkafolyamatot. A változatos adapterek az ügynök-natív eseményeket stabil Skill életciklussá alakítják, míg a nyers forrású borítékok, a normalizált események, kapcsolatok és következtetések külön maradnak. A diagnosztikai motor ellenőrzi az explicit Skill-korlátokat a bizonyítékok alapján, azonosítja a legkorábbi megfigyelhető eltérést, és elkülöníti a szisztémás adapter holtfoltjait a futásspecifikus megállapításoktól. Nem találja ki a modell szándékát vagy az ok-okozati hatékonyságot.
| Adatforrás | Szerep | Frissesség | UI címke |
|---|---|---|---|
| Hivatalos ügynök hoook / bővítmények / SDK eseményeket | Elsődleges életciklus, szerszám, segédanyag és terminális bizonyíték | Élő | Official hook / Native telemetry |
| Ügyességi fájlok és megfigyelhető munkaterületi eredmények | Meghatározás, erőforrás, fájl, műtermék és teszt bizonyíték | Élő pillanatkép / indexelt | Observed |
| A munkamenet átiratai | Kompatibilitási tartalék, ha az ügynök nem tesz elegendő futási időt API | Élőközeli vagy történelmi | Transcript fallback |
| OTLP és támogatott nyomkövetési export | Interoperabilitás és történelmi import | Élő export / kötegelt import | Forrásprofil látható |
| Determinisztikus korreláció | Összekapcsolja az eseményeket a SkillRun a forrástények megváltoztatása nélkül | Lenyeléskor | Derived |
| Szemantikai segítségnyújtás | Csak magyarázatok és vizsgálati javaslatok | Igény szerint | Inferred |
A támogatott belső adapterek verziószáma egymástól függetlenül történik:
| Ügynök | Elsődleges integráció | Tartalék | Aktiválás láthatósága |
|---|---|---|---|
| Codex | Hivatalos parancs Hooks | Munkamenet importálása | Explicit aktiválás, amikor a Hook esemény |
| Claude Code | Hivatalos Hooks | Munkamenet importálása | Explicit Skill Tool és perjel-parancs bizonyítékok, ahol láthatók |
| Qoder | Hivatalos parancs Hooks | Helyi rekordok | Explicit aktiválás, amikor a Skill eszköz teszi közzé |
| OpenCode | Csak megfigyelésre használható globális bővítmény | Helyi rekordok | Ügyességi eszközök visszahívásai, ahol megjelennek |
A pontos képességhatárokat a adapter képesség mátrix. A nem támogatott és nem megfigyelt szakaszok láthatóak maradnak, ahelyett, hogy meghibásodásokká alakulnának.
A Skill telepítése nem bizonyítja, hogy egy ügynök fedezte fel azt. A felfedezés nem bizonyítja az aktiválást. Az aktiválás nem bizonyítja, hogy a teljes utasítások és erőforrások betöltésre kerültek. Az utasítások betöltése nem bizonyítja, hogy az Ügynök követte azokat. A végrehajtás nem bizonyítja, hogy a Skill javította az eredményt.
Ma ezek a kudarcok gyakran hallgatnak. A fejlesztők kérdezik:
Az elsődleges diagnosztikai objektum a SkillRun, nem egy teljes ügynöki munkamenet:
User request
↓
Skills discovered
↓
Skill selected / not selected
↓
SKILL.md activated
↓
References and scripts loaded
↓
Tools / MCP / subagents executed
↓
Files and artifacts produced
↓
Observable outcome
A UI az életciklust rendezetten, gépelve és bizonyítékok szerint osztályozva tartja. A hiányzó aktiválási telemetria azt jelenti, hogy „nem figyelték meg” vagy „nem támogatott”; ez nem jelenti azt, hogy az ügynök határozottan kihagyta a készséget.
A UI soha nem szabad következtetést futásidejű tényként bemutatni:
Egyetlen nyomkövetés támogathatja a végrehajtási hozzárendelést. Az ok-okozati hatást nem tudja bizonyítani. Az olyan állítások, mint például „ez a készség javította a sikerességi arányt”, ismételt készségértékelést igényelnek/készség nélkül.
A futásidejű támogatja Codex, Claude Code, Qoder, és OpenCode független, verziószámú adaptereken keresztül, és a következőket kínálja:
Az MVP nem tartalmazza a piacteret, az univerzális ügynök futtatókörnyezetét, a biztonsági végrehajtást, a vállalatirányítást vagy az ok-okozati összefüggéseket.
A legrövidebb támogatott útvonal eléréséhez használja az egysoros kiadás telepítőjét Gyors kezdés. A teljes első futási folyamat, az ügynökspecifikus újraindítási/megbízhatósági lépések, az adatvédelmi viselkedés és a hibaelhárítás a Útmutató az első lépésekhez.
A fejlesztéshez az alap megvalósításnak nincs futásidejű függősége azon túl Python 3,9+. A tároló gyökérből:
python3 -m venv .venv
.venv/bin/python -m pip install -e .
.venv/bin/skill-runtime install --enable-hooks
.venv/bin/skill-runtime startEzután nyissa meg http://127.0.0.1:4317.
Az egyszeri install parancs:
Az első index a meglévő kompatibilis ügynöki munkameneteket importálja. Egy hosszú élettartamú munkaállomáson ez tovább tarthat, mint egy friss telepítés; a későbbi indítások növekményesek és a UI elérhetővé válik, miközben a háttérben történő frissítés fut.
Interaktív futtatáskor egyszer megkérdezi, mielőtt felveszi a feladatmegnyitó ügynök hook-okat. --no-hooks megőrzi a transzkriptum importálását címkézett tartalékként, míg --enable-hooks rögzíti a kifejezett hozzájárulást, és csak a kezelt bejegyzéseket telepíti. Mert Codex, nyitott /hooks telepítés után tekintse át a pontosan kezelt parancsokat, és bízzon bennük. Codex szándékosan megköveteli ezt a kifejezett felülvizsgálatot a felügyelt vállalati konfiguráción kívül hozzáadott hookok esetében. Kezdj egy újat Codex feladat/munkamenet után bízva a Hooks, majd futtassa:
.venv/bin/skill-runtime doctorQoder terhelések Hook konfigurálása indításkor, ezért indítsa újra Qoder az első telepítés után. OpenCode felfedezi a felügyelt, csak megfigyelésre alkalmas beépülő modult a globális beépülő modulok könyvtárából; indítsa újra OpenCode ha az aktuális folyamat megelőzi a telepítést. Egyik integráció sem olvassa be vagy módosítja a modellkéréseket.
Az integráció csak akkor válik Élő-vé, ha az adatbázis valódi értéket kap official_hook esemény. Pusztán írás ~/.codex/hooks.json Függőbenként jelenik meg, soha nincs csatlakoztatva. start elindítja a Collectort, az átiratok tartalékfigyelőjét, a megőrzési dolgozót, SQLite tárolni, és élni UI menedzselt háttérfolyamatként. Nincs modellkérelem proxy.
Életciklus parancsok:
skill-runtime status
skill-runtime doctor
skill-runtime restart
skill-runtime stop
skill-runtime config --set retention_days=30
skill-runtime config --set network_export.endpoint=https://collector.example/v1/traces
skill-runtime config --set network_export.enabled=true
skill-runtime uninstall --keep-datauninstall csak kezelt eltávolítja Hook bejegyzések és Skill Runtime-tulajdonú fájlok. Nélkül --keep-data, interaktív megerősítést igényel (vagy --yes) eltávolítása előtt ~/.skill-runtime; Az ügynöki munkamenetek és a készségforrások soha nem kerülnek eltávolításra.
Indexelés és külön szolgáltatás:
PYTHONPATH=src python3 -m skill_runtime_intelligence index
PYTHONPATH=src python3 -m skill_runtime_intelligence serveMeglévő nyomkövetési export importálása egy általános megfigyelési rendszerből:
PYTHONPATH=src python3 -m skill_runtime_intelligence import \
./trace-export.json \
--format autoA verziójú importprofilok jelenleg felismerik az OTLP/Phoenix, Langfuse, LangSmith, W&B Weave, és Datadog JSON formák. Csak létrehoznak a SkillRun amikor a forrás explicit Skill szemantikát hordoz; az általános tartományneveket nem kezelik aktiválási bizonyítékként.
Normalizált, készségspecifikus futásidejű bizonyítékok exportálása bármelyikre OTLP/HTTP nyomkövetési végpont:
.venv/bin/skill-runtime start \
--otlp-endpoint https://collector.example/v1/traces \
--otlp-header Authorization='Bearer …'Az exportálás le van tiltva, hacsak nincs kifejezetten konfigurálva egy végpont. Az ellenőrzőpontok, az újrapróbálkozás állapota és a cél állapota a Beállításokban jelennek meg. A nyers promptok, az eszköztárak, a hitelesítő adatok és a szakértelem-erőforrás tartalma nem exportálódik. A hitelesített háttérexportáláshoz adjon meg szabványt OTEL_EXPORTER_OTLP_HEADERS előtti környezetben skill-runtime start; fejlécek soha nem íródnak Skill Runtime konfigurációs vagy folyamatargumentumok.
skill-runtime start tartalmaz egy helyi gyűjtőt. Natív telemetriai adapterek, hivatalos horgok, könnyű, hibamentes horgok és SDK Az integrációk egyetlen eseményt vagy korlátos köteget fűzhetnek hozzá POST /api/events:
curl -X POST http://127.0.0.1:4317/api/events \
-H 'Content-Type: application/json' \
-d '{
"event_id": "evt-example-activation",
"event_type": "skill.activated",
"occurred_at": "2026-07-29T05:00:00Z",
"session_id": "agent-session-example",
"turn_id": "turn-1",
"activation_mode": "explicit_tool",
"skill": {"name": "pdf"},
"source": {
"adapter": "example-agent",
"adapter_version": "1.0",
"collection_mode": "official_hook",
"source_event_id": "source-event-1"
},
"evidence": {
"grade": "observed",
"confidence": 1.0,
"basis": "Official runtime hook"
},
"payload": {"tool_name": "Skill"}
}'A végpont eltávolítja a gyakori hitelesítő adatokat a fennmaradás előtt, de duplikációt hajt végre event_id, megőrzi a külön szerkesztett nyers borítékot, és visszaküldi az eredményt skill_run_ids. GET /api/collector/schema megjeleníti a támogatott eseményszótárat és gyűjtési módokat. A UI hallgat /api/stream SSE használatával, a lekérdezéssel csak az újracsatlakozási tartalékként.
A forrásjelző megkülönbözteti az elsődleges futásidejű bizonyítékot a Transcript fallback és behozott nyomok. A Collector végpont önmagában nem igényel natív telemetriát: minden gyártónak nyilatkoznia kell, hogy eseménye natív telemetriából, hivatalos horogból, könnyű horogból vagy egy SDK.
Először ellenőrizze a pontos útvonalakat és eseményeket. Ez a parancs csak olvasható:
.venv/bin/skill-runtime setupHook a telepítéshez explicit jelző szükséges:
.venv/bin/skill-runtime setup --enable-codex-hooks
.venv/bin/skill-runtime setup --enable-claude-hooksA telepítő biztonsági másolatot készít az ügynök konfigurációjáról, megőrzi a meglévő horgokat, és csak az a-t tartalmazó bejegyzéseket ad hozzá Skill Runtime menedzsment jelző. A horogadapter minimális életciklus-mezőket tárol, nem pedig teljes promptokat vagy szerszámterhelést. A befejezett szerszámhívásoknál csak pontos kivonatokat készít SKILL.md, standard Skill erőforrás és megváltoztatott fájl elérési út a memóriában; A nyers parancsok, patch törzsek, promptok és eszközkimenetek a fennmaradás előtt el lesznek vetve. Amíg a futtatókörnyezet aktív, egy engedély korlátozott Unix socket a gyors út; az opcionális natív feladó elkerüli Python indítás. Ha a futtatókörnyezet nem aktív, az önálló megszakítási útvonal hozzáfűzi a szerkesztett bizonyítékot ~/.skill-runtime/queue/events.jsonl. skill-runtime start újrajátssza azt a sort az eseményazonosító deduplikációjával.
Codex események a hivatalos Hook API (SessionStart, SessionEnd, UserPromptSubmit, PreToolUse, PostToolUse, PreCompact, PostCompact, SubagentStart, SubagentStop, és Stop). Codex jelenleg szinkronban hajtja végre a parancshorogokat, tehát Skill Runtime helyit használ Unix socket/natív küldő korlátozott időkorláttal. Bármilyen kézbesítési hiba lenyelődik és sorba kerül; soha nem változtat az Ügynök döntésén. Lásd a hivatalos Codex Hook dokumentáció.
Csak a kezelt bejegyzéseket távolítsa el a következővel:
.venv/bin/skill-runtime setup --remove-codex-hooks
.venv/bin/skill-runtime setup --remove-claude-hooksA szerver kötődik 127.0.0.1 alapértelmezés szerint. A teljes átírási üzenetek és az eszköz hasznos terhei nem kerülnek az indexbe. A közös titkos mintákat a rendszer szerkeszti, mielőtt a normalizált összegzések megmaradnak.
Futtassa a függőségmentes tesztcsomagot a következővel:
PYTHONPATH=src python3 -m unittest discover -s tests -vGitHub Akciók futnak Python 3.9–3.13 tesztek, JavaScript-ellenőrzés, natív küldő-összeállítás és valódi telepítés/indítás/doctor/stop/uninstall füstteszt. A v* tag kerék/sdist csomagokat épít, plusz ellenőrzőösszeg-védett Linux és macOS natív feladók. A CLI telepítője letölti a megfelelő kiadási eszközt, így a végfelhasználóknak nincs szükségük fordítóprogramra.
Futtassa az első termékhez kapcsolódó diagnosztikai kísérletet:
python3 experiments/runtime_diagnostics/run_benchmark.pyHibákat szúr be az életciklusra vonatkozó bizonyítékok hiányosságaira, kifejezett hibákra, hiányos futtatásokra és ellenőrizetlen eredményekre, majd kiértékeli ugyanazt a determinisztikus diagnosztikai motort, amelyet a API és UI. Lásd a PAI-DSW kísérleti terv a kísérleti létrához, az interferencia-tesztekhez és a reprodukálhatósági szerződéshez.
A kerék felépítése után futtassa az elkülönített csomagolt életciklus-füstöt a következővel:
PYTHONPATH=src python3 experiments/product_lifecycle/run_benchmark.pyTelepít egy ideiglenes virtuális környezetbe és ideiglenes otthonba, a teljes helyi életciklust a hookok engedélyezése nélkül gyakorolja, és ellenőrzi a projekt és az ügynök konfigurációjának zavartalanságát.
A termék viselkedése négy kísérlet által vezérelt megszorítást követ: bizonyíték a következtetések előtt, az első megfigyelhető határ a súlyosság előtt, a típusos kapcsolatok a lapos rönkök előtt, és a determinisztikus rekonstrukció a valószínűségi segítségnyújtás előtt.
A reprodukálható bizonyítékokat és annak korlátait fenntartja a kísérleti jelentés. A korlátozott eredmények a következők:
Ezek az eredmények a mechanizmusokat és a reprezentációs választásokat igazolják, nem pedig a telepítés általánosítását vagy az emberi előnyöket. Valódi második ügynök tanulmányok, platformok közötti késleltetés, valós hibakalibrálás és résztvevő diagnosztikai vizsgálatok továbbra is nyitott bizonyítékok.
A kutatási irány a szomszédos elsődleges munkákra is épül: SkillsBench és SWE-Skills-Bench motiválja a diagnózist, mert a készségek hatásai változóak és visszafejlődnek; Harness-Bench motiválja a képesség-tudatos cross-Agent összehasonlítást; és a végrehajtás származási felmérés motiválja a gépelt bizonyítékviszonyokat, a származási nyomkövetést és a magánélet-tudatos audit infrastruktúrát.
| Kezdje itt | Cél |
|---|---|
| Getting Started | Telepítsen, csatlakoztasson ügynököt, ellenőrizze az élő bizonyítékokat, és végezzen hibaelhárítást |
| Építészet | Gyűjteményi folyamat, tárolási határok, bizonyítékmotor és megbízhatósági modell |
| Adapter képesség mátrix | Pontos jelek és korlátozások ügynök/verzió szerint |
| Megfigyelési platform beállítása | Csatlakoztasson OTLP-kompatibilis platformokat, és importáljon támogatott nyomkövetéseket |
| Futásidejű eseménymodell | Stabil eseményszókincs, származás, kapcsolatok és bizonyítékok fokozatai |
| UI információs architektúra | Áttekintés, első határ, Panoráma, Ellenőrző, Összehasonlítás és Inferred Analysis |
| Változásnapló | Verziózott, felhasználó által látható változtatások |
| v0.3.0 kiadási megjegyzések | Frissítési útmutató, kiemelések és ismert korlátok |
Termék- és kutatási referenciák: termék meghatározása, MVP specifikáció, megfigyelhetőség interoperabilitás, kísérleti eredmények, és a kutatási menetrend.
Az aktuális forrásfa cél v0.3.0; használja a fenti kiadási jelvényt a legújabb közzétett build azonosításához. A futási idő ellenőrizhető készség-viselkedési korlátokat, konkrét tevékenység-összefoglalókat, telepített definíciós leltárt, beleegyezés-vezérelt tisztviselőt tartalmaz Hook adapterek Codex, Claude Code, és Qoder, csak megfigyelés OpenCode beépülő modul, címkézett átirat tartalék, aktív hatókörű hozzárendelés, pontos fájl/műtermék elérési út, szerkesztés, külön forrás/kapcsolat/következtetési rétegek, SQLite tárolás, megőrzés, determinisztikus diagnózis, élő UI, és cross-run/cross-Agent összehasonlítás. OTLP/Phoenix, Langfuse, LangSmith, W&B Weave, és Datadog az export importálható; A normalizált bizonyítékok élőben exportálhatók a részvétellel OTLP/HTTP.
A modellen belüli jelölt felfedezések, a modell belső szelekciós okai, a szemantikai hatékonyság és az ok-okozati eredménnyel kapcsolatos állítások továbbra sem támogatottak, kivéve, ha egy forrás vagy ellenőrzött kísérlet erre bizonyítékot szolgáltat.
| Back | FazBrowse Home | New Git URL |