基準(zhǔn)評分法與張力圖(Tension Plot)實戰(zhàn)指南)
ECC benchmark-methodology競品九維加權(quán)基準(zhǔn)評分法與張力圖Tension Plot實戰(zhàn)指南【免費下載鏈接】ECCThe agent harness performance optimization system. Skills, instincts, memory, security, and research-first development for Claude Code, Codex, Opencode, Cursor and beyond.項目地址: https://gitcode.com/GitHub_Trending/ev/ECCECCAgent Harness 性能優(yōu)化系統(tǒng)內(nèi)置了一套用于品牌/創(chuàng)意服務(wù)市場競品分析的三技能流水線其中benchmark-methodology是中間環(huán)節(jié)它接收competitive-platform-analysis產(chǎn)出的分層競品集合按九個加權(quán)維度用顯式 1–5 評分標(biāo)準(zhǔn)逐項打分并繪制客戶的戰(zhàn)略張力二維圖最終輸出可交付的競品檔案卡profile card。讀完本文你可以掌握這套方法的激活條件、九維權(quán)重體系、評分錨點定義、證據(jù)采集順序、偏差控制機(jī)制與檔案卡輸出格式并能將其復(fù)用到任何需要可比、可辯護(hù)競品評分的場景。一、技能定位三技能競品流水線的第二步benchmark-methodology的文檔本體位于 .agents/skills/benchmark-methodology/SKILL.md倉庫同時提供 skills/benchmark-methodology/SKILL.md 這一發(fā)布版本后者在 frontmatter 中額外聲明了license: MIT。其 frontmatter 描述明確了它在流水線中的位置Use after competitive-platform-analysis has produced a tiered competitor set. Scores each competitor across nine weighted dimensions ... with explicit 1–5 rubrics and a tension-plot. Precedes competitive-report-structure.即前置competitive-platform-analysis 負(fù)責(zé)決定評測誰——識別、分層Direct / Adjacent / Aspirational、裁剪出 8–12 個可評測對象本技能負(fù)責(zé)如何打分——把已分層的集合轉(zhuǎn)化為可比、可辯護(hù)的分?jǐn)?shù)后繼competitive-report-structure 負(fù)責(zé)如何匯報——把打分后的檔案卡組裝成決策級報告。在倉庫的技能注冊體系中該技能被列在 package.json 的 skills 清單skills/benchmark-methodology/與 manifests/install-modules.json 的安裝模塊清單中屬于可按模塊安裝的技能之一。另外從源碼結(jié)構(gòu)看它具備 Codex/CLI 側(cè)的適配接口 agents/openai.yaml其中聲明了display_name: Benchmark Methodology、short_description: Score competitors across nine weighted dimensions以及allow_implicit_invocation: true表明 Agent 可以在無需顯式指令的情況下隱式調(diào)用該技能。該方法論的核心信條在文檔開頭即給出一致性才是重點——分?jǐn)?shù)只有在任何競品面對同樣證據(jù)都能拿到相同分?jǐn)?shù)時才有用Consistency is the point。因此整套方法圍繞證據(jù)錨定與跨集合校準(zhǔn)兩個支點展開。二、激活條件When to Activate文檔列出了四個激活前提缺一不可來自competitive-platform-analysis的、已完成范圍限定與分層的競品集合已就緒需要的是跨競品的可比、證據(jù)錨定的分?jǐn)?shù)而不是憑感覺的排名gut-feel rankings客戶的戰(zhàn)略張力strategic tension即定義其目標(biāo)空白的成對坐標(biāo)軸已經(jīng)確立準(zhǔn)備為competitive-report-structure產(chǎn)出待組裝的檔案卡。文檔還專門列了一條反模式對應(yīng)項在競品集合尚未完成 scope 之前就開跑——直接對未限定的列表打分會把精力浪費在不相關(guān)的競品上。三、前置輸入客戶定位簡報Positioning Brief打分之前必須先建立客戶的定位簡報它是后續(xù)所有維度判定的標(biāo)尺來源提供三樣?xùn)|西戰(zhàn)略張力Strategic tension——兩條坐標(biāo)軸例如 memorability × hireability可記憶性 × 可雇傭性兩軸交點即客戶的目標(biāo)空白區(qū)。第 9 維度永遠(yuǎn)是客戶命名出的這條張力兩個極點必須分別計分、分別報告永遠(yuǎn)不許取平均。差異化優(yōu)勢Differentiator——客戶護(hù)城河所在它決定了哪些維度在客戶的定位論證中權(quán)重感更強(qiáng)。品牌平衡Brand balance——客戶有意的戰(zhàn)略側(cè)重配比任何會打破這一配比的戰(zhàn)略建議都必須顯式標(biāo)記出來。四、九個維度與權(quán)重體系方法的第一原則是客戶是在兩條極點之間的特定張力上競爭而不是靠服務(wù)廣度取勝。因此維度權(quán)重向該護(hù)城河傾斜。文檔特別強(qiáng)調(diào)權(quán)重用于綜合階段的側(cè)重引導(dǎo)不是用來合成一個加權(quán)總分詳見偏差控制。九維及權(quán)重如下總和 100%#維度權(quán)重判定要點1定位清晰度與獨特性Positioning clarity distinctiveness18%工作室的定位是否鋒利、可獨占、一眼可辨還是泛泛而談2品牌聲音 / 語言獨特性Brand voice / verbal distinctiveness15%文案是否擁有可獨占的語域register還是可互換的機(jī)構(gòu)腔3視覺識別與站點工藝Visual identity site craft15%視覺系統(tǒng)的質(zhì)量與所有權(quán)把站點當(dāng)作工藝證明來看4服務(wù)供給與包裝Service offer packaging12%是否產(chǎn)品化、可讀有命名的 sprint/audit還是含糊不清包裝成熟度如何5證據(jù)與可信度Evidence credibility12%具名客戶、量化結(jié)果、案例深度。超越宣稱的證明6企業(yè)級就緒度 / 商業(yè)成熟度Enterprise-readiness / commercial maturity10%是否有接住并留住 SaaS/金融科技/B2B/企業(yè)級業(yè)務(wù)的信號流程、客戶 logo、規(guī)模、合同7思想領(lǐng)導(dǎo)力 / 內(nèi)容存在感Thought leadership / content presence8%自有 POV寫作、演講、newsletter、框架。重深度而非數(shù)量8定價透明度與合作模式Pricing transparency engagement model5%定價/合作方式是否可讀產(chǎn)品化、定制還是不透明9客戶的戰(zhàn)略張力Clients strategic tension5%作為標(biāo)記位兩極分別計分、分別報告張力名稱與坐標(biāo)軸描述從客戶定位簡報讀取兩軸都畫出來差距即洞見??蛻舻哪繕?biāo)象限是本次基準(zhǔn)評測中最重要的單項發(fā)現(xiàn)還有誰已經(jīng)待在那里從權(quán)重設(shè)計可以看出傾向定位18% 聲音15% 視覺15%合計近半反映品牌獨特性是這個市場的主要競爭貨幣而定價透明度僅 5%因為它更多是定位成熟度的結(jié)果而非定位本身。第 9 維度權(quán)重只有 5%但文檔反復(fù)強(qiáng)調(diào)它是最重要的發(fā)現(xiàn)——低權(quán)重是因為它不參與維度比較它承擔(dān)的是象限判斷這一獨立職能。五、1–5 評分標(biāo)尺適用于維度 1–8標(biāo)尺要求把每個分?jǐn)?shù)錨定到可觀察的證據(jù)上。文檔給出的通用錨點描述具體到各維度時應(yīng)改寫措辭但等級含義必須保持不變1 — 缺失 / 泛化Absent / generic無可辨識的定位或工藝與模板無從區(qū)分是主動負(fù)債。2 — 低于水準(zhǔn)Below par有些意圖但不一致、衍生或不可信放不進(jìn)并排對比。3 — 合格 / 入場券Competent / table-stakes扎實、專業(yè)、平淡達(dá)到預(yù)期但誰也無法據(jù)以獨占。4 — 強(qiáng) / 有辨識度Strong / distinctive明顯高于同行是買家會注意到并引用的真實強(qiáng)項。5 — 定義品類Category-defining同類最佳、可獨占、難以模仿是別人拿來對照的標(biāo)桿。張力軸第 9 維度——每軸各打 1–5軸的名稱及其 1/3/5 錨點從客戶定位簡報中讀取。文檔給了一個memorability × credibility可記憶性 × 可信度張力的示例錨點Memorability— 1瞬間被忘記 · 3在語境中可被認(rèn)出 · 5過目不忘、被人談?wù)?、被獨特地?fù)碛小redibility— 1感覺冒險/業(yè)余 · 3安全、能干、無趣 · 5企業(yè)級信賴、顯而易見的穩(wěn)妥之選。然后把競品畫到張力 2×2 圖上??蛻舻哪繕?biāo)象限在定位簡報中已命名目標(biāo)象限里還有誰就是本次基準(zhǔn)評測最重要的單項發(fā)現(xiàn)。六、數(shù)據(jù)采集按最便宜信號優(yōu)先的順序?qū)γ總€競品按以下順序走維度從成本最低的信號源開始競品自己的站點——定位、聲音、供給包裝、定價姿態(tài)、具名客戶、manifesto/POV。截圖首頁 一個案例頁。案例研究 / 作品——證據(jù)深度、量化結(jié)果、客戶名稱。區(qū)分asserted我們交付了 X與proven有指標(biāo)、有名稱、可核驗。點評目錄review directories——交叉印證客戶、項目體量、合作模式 → 服務(wù)于可信度與企業(yè)級就緒度兩個維度例如 Clutch.co 或該細(xì)分領(lǐng)域的等價物。LinkedIn——團(tuán)隊規(guī)模/模式、創(chuàng)始人敘事、內(nèi)容更新頻率 → 服務(wù)于思想領(lǐng)導(dǎo)力維度與合作模式判斷。作品集 / 工藝平臺——工藝語域使用該細(xì)分領(lǐng)域原生的展示平臺設(shè)計板、showreel、已發(fā)布樣稿等。內(nèi)容渠道——newsletter/演講/寫作 → 思想領(lǐng)導(dǎo)力的深度。每個維度需要記錄三樣?xùn)|西分?jǐn)?shù)、一行式理由、以及拿到該分?jǐn)?shù)的來源鏈接/截圖。沒有證據(jù)就沒有分?jǐn)?shù)No score without evidence。這一順序與前序技能 competitive-platform-analysis 的數(shù)據(jù)源清單組合平臺、獎項/策展展示、競品站點、LinkedIn、點評目錄、公開作品、會議/播客/newsletter一一對應(yīng)并額外加了一條貫穿兩個技能的紀(jì)律任何競品屬性在被當(dāng)作事實之前必須至少用兩個來源交叉驗證——自報的站點文案是營銷不是事實。七、偏差控制Bias controls這是本文檔最有方法論價值的小節(jié)共六條不設(shè)單一綜合分No single composite score。維度分?jǐn)?shù)與張力圖分開報告加權(quán)平均會掩蓋真正重要的不對稱性。asserted 與 proven 之別。對無法交叉印證的自報聲明下調(diào)可信度/證據(jù)維度分?jǐn)?shù)。站點文案是營銷不是事實。審美親和偏差A(yù)esthetic affinity bias。評審者容易給與自己審美相投的工作室打高分同時低估對手的商業(yè)實力。工藝craft與可信度credibility必須獨立計分一個無聊的站點可能正在拿下更大的客戶。時新 / 炫技偏差Recency / flashiness bias。獲獎的展示級作品令人驚艷但可能缺乏商業(yè)深度——在打分可信度之前先用點評目錄/客戶來驗證。幸存者偏差Survivorship??梢姷?、善于營銷的工作室不等于整個市場要把經(jīng)由目錄/點評發(fā)現(xiàn)的強(qiáng)但安靜的運營者也記錄在案。跨集合校準(zhǔn)而不是孤立校準(zhǔn)Calibrate across the set, not in isolation。定稿前把所有分?jǐn)?shù)并排重讀一遍——一個4必須對所有競品意味著同一件事離群值要調(diào)整。其中第 1 條與后繼技能形成了強(qiáng)約束competitive-report-structure 的報告矩陣同樣禁止添加加權(quán)合計列blended total column其反模式清單中也明確把給矩陣加混合總分列列為顯式排除項。兩處文檔互相咬合確保不做偽綜合分從打分階段一直延續(xù)到匯報階段。八、競品檔案卡輸出格式每個被評測的競品產(chǎn)出一張檔案卡——這是報告組裝的最小原子單元。完整模板如下原文結(jié)構(gòu)完整保留占位符需按實際評測對象填寫## Competitor name - **Profile / Tier:** positioning stance · specialization · size band / Direct | Adjacent | Aspirational - **One-liner:** how they position themselves, in their words - **Model / size / geography:** solo|micro|boutique · region · pricing/engagement model - **Notable clients / evidence:** named, with proven/asserted tag ### Dimension scores | Dimension | Score (1–5) | Justification (1 line) | Source | |---|---|---|---| | Positioning clarity distinctiveness | | | | | Brand voice / verbal distinctiveness | | | | | Visual identity site craft | | | | | Service offer packaging | | | | | Evidence credibility | | | | | Enterprise-readiness / commercial maturity | | | | | Thought leadership / content presence | | | | | Pricing transparency engagement model | | | | ### Tension plot - **[Axis 1 from positioning brief]:** 1–5 — why - **[Axis 2 from positioning brief]:** 1–5 — why - **Quadrant:** high/high | high-1/low-2 | low-1/high-2 | low/low ### Read for [client] - **Strength to learn from:** … - **Weakness to exploit / white-space it exposes:** … - **Threat to [client]:** …模板中有幾個設(shè)計細(xì)節(jié)值得注意Tier 字段直接承接前序技能的三層分類Direct / Adjacent / Aspirational保證檔案卡與競品集合的范圍決策可追溯Notable clients / evidence 要求帶 proven/asserted 標(biāo)簽把偏差控制第 2 條落到了卡片字段層面Tension plot 的兩軸名稱不寫死而是從定位簡報讀取Axis 1 / Axis 2 from positioning brief使同一套模板可復(fù)用于任何張力定義Quadrant 四態(tài)high/high、high-1/low-2、low-1/high-2、low/low把兩極是否同時占優(yōu)顯式化這正是文檔所說的客戶的戰(zhàn)略問題恰恰是對手是否同時做到兩件事卡片收尾的Read for [client]把純描述轉(zhuǎn)化為對客戶的三問可學(xué)之處、可利用的弱點/空白、以及威脅判斷。完成后的檔案卡連同張力圖一起交給competitive-report-structure組裝成客戶可交付報告。九、反模式清單Anti-Patterns文檔把最常見的執(zhí)行錯誤固化為五條禁令對張力軸取平均??蛻魬?zhàn)略張力的兩個極點必須分別計分、分別報告取平均會摧毀洞見——兩極之間的差距本身就是發(fā)現(xiàn)。無證據(jù)打分。每個分?jǐn)?shù)都要求一行式理由 來源鏈接。沒有證據(jù)的分?jǐn)?shù)是觀點不是基準(zhǔn)。制造單一綜合分。逐維度報告分?jǐn)?shù)加權(quán)平均會掩蓋定位決策真正關(guān)心的不對稱強(qiáng)項。不校準(zhǔn)就套用通用標(biāo)尺錨點。1–5 錨點必須針對具體維度和競品集合做校準(zhǔn)通用描述只是起點不是固定標(biāo)準(zhǔn)。在競品集合完成 scope 之前開跑。先用competitive-platform-analysis產(chǎn)出分層、裁剪后的集合對未限定列表打分會浪費在不相關(guān)競品上。十、小結(jié)與延伸閱讀benchmark-methodology的價值不在于九個維度的命名而在于三組紀(jì)律輸入紀(jì)律必須先有定位簡報與分層集合、評分紀(jì)律證據(jù)錨定、跨集合校準(zhǔn)、張力兩極永不平均與輸出紀(jì)律原子化檔案卡、字段級 proven/asserted 標(biāo)記。這些紀(jì)律使其產(chǎn)出的分?jǐn)?shù)可以在下一環(huán)節(jié)直接進(jìn)入 competitive-report-structure 的基準(zhǔn)矩陣與張力圖而不會在組裝階段被質(zhì)疑口徑。配套閱讀路徑前序技能 competitive-platform-analysis如何識別、分軸、分層并裁剪競品集合含 10–18 候選 → 8–12 評測對象的預(yù)篩選矩陣模板后繼技能 competitive-report-structure八段式報告結(jié)構(gòu)、熱力圖矩陣呈現(xiàn)與必須回答的三個決策問題定位簡報來源 brand-discovery產(chǎn)出戰(zhàn)略張力與品牌平衡等前置輸入的技能。適用前提說明該技能面向品牌/創(chuàng)意服務(wù)類市場工作室、代理機(jī)構(gòu)等的競品基準(zhǔn)場景維度與數(shù)據(jù)源假設(shè)站點工藝、點評目錄、作品集平臺以此為基準(zhǔn)移植到其他行業(yè)時需按文檔自身的校準(zhǔn)條款替換維度具體錨點與數(shù)據(jù)源但等級含義、證據(jù)要求與不做綜合分的約束應(yīng)當(dāng)保持不變。【免費下載鏈接】ECCThe agent harness performance optimization system. Skills, instincts, memory, security, and research-first development for Claude Code, Codex, Opencode, Cursor and beyond.項目地址: https://gitcode.com/GitHub_Trending/ev/ECC創(chuàng)作聲明:本文部分內(nèi)容由AI輔助生成(AIGC),僅供參考