📦 deps(thirdparty): update snapshots

This commit is contained in:
ci[bot]
2026-07-18 00:02:59 +00:00
parent 82f7c6e56a
commit 47ce7f78dc
1446 changed files with 141041 additions and 6442 deletions
@@ -0,0 +1,75 @@
{
"schemaVersion": 1,
"reviewId": "aas-v1-baseline-reviewer-beta",
"reviewedAt": "2026-07-17",
"reviewer": {
"identity": "codex-independent-beta",
"role": "independent-baseline-reviewer",
"implementedScorer": false,
"authoredReviewedArtifacts": false,
"reliedOnReviewerAlpha": false
},
"overall": {
"decision": "approved",
"reasonCodes": [
"AAS_REVIEW_HELD_OUT_APPROVED",
"AAS_REVIEW_TUNING_APPROVED",
"AAS_REVIEW_ABSTENTION_APPROVED"
],
"scope": "baseline-corpus-only"
},
"methodReasonCodes": [
"AAS_REVIEW_GRID_AND_PAIRING_VERIFIED",
"AAS_REVIEW_GOALS_AND_REQUIRES_SKILL_VERIFIED",
"AAS_REVIEW_GOLD_EQUIVALENTS_VERIFIED",
"AAS_REVIEW_CATALOG_AND_POLICY_VERIFIED",
"AAS_REVIEW_NO_ARTIFICIAL_LABEL_LEAK",
"AAS_REVIEW_NO_RAW_CODE_SECRET_OR_ABSOLUTE_PATH",
"AAS_REVIEW_TASK_FAMILIES_UNIQUE",
"AAS_REVIEW_TUNING_HELDOUT_SEPARATED",
"AAS_REVIEW_ABSTENTION_OOD_VERIFIED"
],
"warnings": [
{
"code": "AAS_REVIEW_METADATA_EVIDENCE_CONTRACT_PENDING",
"details": {
"uniqueHeldOutGoldSkillIds": 170,
"legacyCatalogHasV1JudgmentEvidenceRefs": false
},
"constraint": "Baseline approval does not make legacy metadata evidence-backed. Unknown remains unknown; candidates stay in discovery until v1 structured evidence exists."
}
],
"digestContract": {
"pairPayload": {
"heldOut": "recursively key-sorted JSON.stringify({case, gold}) with gold.reviews replaced by []",
"tuning": "recursively key-sorted JSON.stringify({case, gold}) with gold.reviews replaced by []",
"abstention": "recursively key-sorted JSON.stringify({case, label}) with label.reviews replaced by []"
},
"pairDigest": "sha256- prefix followed by lowercase SHA-256 hex of the UTF-8 pair payload",
"pairManifest": "JSON.stringify of all [caseId,pairDigest] tuples sorted by caseId ascending using JavaScript code-unit order",
"pairManifestRootDigest": "sha256- prefix followed by lowercase SHA-256 hex of the UTF-8 pair manifest",
"globalManifest": "the same tuple form and ordering across all three splits"
},
"pairCount": 270,
"pairManifestRootDigest": "sha256-91a89667c3d178b2a2dfe65236cdbea70a2152bf93efd74cfb05f06041620939",
"splits": {
"heldOut": {
"decision": "approved",
"reasonCode": "AAS_REVIEW_PAIR_APPROVED",
"pairCount": 180,
"pairManifestRootDigest": "sha256-b68254bf102ff041b6b32dac2aad244e726ca42118d17885c146965b299a3e16"
},
"tuning": {
"decision": "approved",
"reasonCode": "AAS_REVIEW_TUNING_PAIR_APPROVED",
"pairCount": 60,
"pairManifestRootDigest": "sha256-6a77ed03d82ba9dc22b4e7df01147f174161543c4cb863cefb77fbdd92544ff8"
},
"abstention": {
"decision": "approved",
"reasonCode": "AAS_REVIEW_ABSTENTION_PAIR_APPROVED",
"pairCount": 30,
"pairManifestRootDigest": "sha256-b38198df8e156459f3a43d55adb0057513cc9dbe71c078a2de6484810fc2c060"
}
}
}
@@ -0,0 +1,245 @@
{
"schemaVersion": 1,
"reviewVersion": "1.0.0",
"auditId": "aas-v1-tuning-gold-equivalence-1.0.1",
"reviewer": {
"identity": "gold-equivalence-independent-adjudicator",
"kind": "independent-agent-adjudication",
"scorerImplementer": false
},
"scope": {
"repositoryCommit": "09f2d8612d2e68a087377685e9c876bd737e1782",
"packageVersion": "14.6.0",
"diagnosticSha256": "ae33eb201792dbcd5b28e5a71de36594f6c0e38709b6c86848de4420328f7001",
"tuningOnly": true,
"assignedClaimCount": 19,
"heldOutContentsRead": false,
"abstentionLabelsRead": false,
"readOnlyReview": true
},
"skillEvidence": [
{
"skillId": "agent-tool-builder",
"path": "skills/agent-tool-builder/SKILL.md",
"sha256": "d32f031ee373cb91618e2cb489e486258b1efa098621f403771b42013f733b03",
"lineRanges": ["18-20", "340-432", "675-681"]
},
{
"skillId": "multi-agent-architect",
"path": "skills/multi-agent-architect/SKILL.md",
"sha256": "46c9287a5d9b81ab08ca39a5059f391e874e50d06cff7823ea6d70901c221ff8",
"lineRanges": ["21-35", "292-306", "319-330"]
},
{
"skillId": "api-and-interface-design",
"path": "skills/api-and-interface-design/SKILL.md",
"sha256": "e8f5bbbfb32c50e61499eda125c6af8ad38e084cf6b47adebd0a0a263e924ab1",
"lineRanges": ["13-46", "68-125", "269-301"]
},
{
"skillId": "api-documenter",
"path": "skills/api-documenter/SKILL.md",
"sha256": "6c08bd68f45cf03280b2a34f6d3bd94e92dba06c0ff4eb6b7b61a4813e0358b9",
"lineRanges": ["10-44", "96-114"]
},
{
"skillId": "kubernetes-architect",
"path": "skills/kubernetes-architect/SKILL.md",
"sha256": "122d2a64642bd0ce5a7fe56017d892496cd08b64f99871d4e2546d4ba8fd0bb9",
"lineRanges": ["10-33", "47-59", "83-88", "123-155"]
},
{
"skillId": "security-bluebook-builder",
"path": "skills/security-bluebook-builder/SKILL.md",
"sha256": "d4f053069cb503b3756fa6937003052d783c814fcccff25ae23dc1865b014085",
"lineRanges": ["10-16", "20-32", "40-50"]
},
{
"skillId": "python-testing-patterns",
"path": "skills/python-testing-patterns/SKILL.md",
"sha256": "467fdbc399027e09da7df551c2088dad0e2fa7cba590be3059b40bfcbc63794a",
"lineRanges": ["11-29"]
},
{
"skillId": "api-testing-observability-api-mock",
"path": "skills/api-testing-observability-api-mock/SKILL.md",
"sha256": "65f57d1dc925210f083cc78874d4c839da4c73b5e0474b45922d20d9463fa527",
"lineRanges": ["13-18", "26-45"]
},
{
"skillId": "unit-testing-test-generate",
"path": "skills/unit-testing-test-generate/SKILL.md",
"sha256": "3fdc338d79aa50a5e546c1ecfe983b583dd13827804dd8236b44d1de056748fe",
"lineRanges": ["9-27", "44-60", "154-249", "251-320"]
}
],
"decisions": [
{
"caseId": "tuning.agent-mcp-development.mcp-tooling.build-metadata-mcp",
"skillId": "agent-tool-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The skill lacks the required read-only-resource semantics and is incomplete as a coherent solution."
},
{
"caseId": "tuning.agent-mcp-development.mcp-tooling.local-catalog-mcp",
"skillId": "agent-tool-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "Generic tool access controls do not establish the explicit offline read-only-resource contract."
},
{
"caseId": "tuning.agent-mcp-development.security-operations.ci-agent-security",
"skillId": "multi-agent-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "Useful tool-boundary guidance does not supply an agent threat-review method and is not an equivalent solution without further adjudication."
},
{
"caseId": "tuning.agent-mcp-development.security-operations.local-mcp-security",
"skillId": "multi-agent-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The skill lacks MCP-specific threat review, returned-content trust labels and read-only boundary guidance."
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.partner-orders-api",
"skillId": "api-documenter",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "interface-design-documenter",
"allowedSkillIds": ["api-and-interface-design", "api-documenter"],
"requiredGroups": [["api-and-interface-design"], ["api-documenter"]]
},
"reason": "The exact pair covers stable interface design, OpenAPI, machine-readable documentation, validation, versioning and migration guidance."
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.research-catalog-api",
"skillId": "api-documenter",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "interface-design-documenter",
"allowedSkillIds": ["api-and-interface-design", "api-documenter"],
"requiredGroups": [["api-and-interface-design"], ["api-documenter"]]
},
"reason": "The exact pair covers the stable public contract, OpenAPI artifact review, versioning, backward compatibility and machine-readable docs."
},
{
"caseId": "tuning.deployment-devops.containers.worker-container",
"skillId": "kubernetes-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The Docker-only first-container case lacks Kubernetes context and the skill does not establish the required health-check design."
},
{
"caseId": "tuning.deployment-devops.release-rollback.canary-api-release",
"skillId": "kubernetes-architect",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "kubernetes-architecture-canary",
"allowedSkillIds": ["kubernetes-architect"],
"requiredGroups": [["kubernetes-architect"]]
},
"reason": "The exact solution covers Kubernetes canary delivery, staging validation, rollback planning, observability and operational documentation."
},
{
"caseId": "tuning.deployment-devops.release-rollback.schema-compatible-release",
"skillId": "kubernetes-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The skill has no PostgreSQL migration or schema-compatibility sequencing workflow."
},
{
"caseId": "tuning.security-review-hardening.incident-hardening.ci-token-exposure",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "A policy mini-runbook is not operational incident triage, evidence preservation and remediation verification."
},
{
"caseId": "tuning.security-review-hardening.incident-hardening.session-anomaly",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "Policy drafting does not perform session-anomaly triage or verify containment remediation."
},
{
"caseId": "tuning.security-review-hardening.secrets-auth.internal-auth-hardening",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The skill does not implement secret lifecycle, credential migration or rotation."
},
{
"caseId": "tuning.security-review-hardening.secrets-auth.service-credential-boundaries",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "Trust-boundary policy does not supply secret lifecycle and rotation workflows."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.gateway-contract-tests",
"skillId": "python-testing-patterns",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "pytest-api-mock-contract",
"allowedSkillIds": ["api-testing-observability-api-mock", "python-testing-patterns"],
"requiredGroups": [["api-testing-observability-api-mock"], ["python-testing-patterns"]]
},
"reason": "For the Python gateway, the exact pair supplies a repeatable pytest/CI runner plus deterministic contract-aware mocks and fixtures."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.gateway-contract-tests",
"skillId": "api-testing-observability-api-mock",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "pytest-api-mock-contract",
"allowedSkillIds": ["api-testing-observability-api-mock", "python-testing-patterns"],
"requiredGroups": [["api-testing-observability-api-mock"], ["python-testing-patterns"]]
},
"reason": "The exact pair supplies contract-aware deterministic mocks while the Python companion supplies runner and CI evidence."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.partner-contract-tests",
"skillId": "python-testing-patterns",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The TypeScript case does not justify a Python-only test harness."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.partner-contract-tests",
"skillId": "api-testing-observability-api-mock",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "It is a partial mock specialist but the product pair lacks a coherent TypeScript CI integration runner."
},
{
"caseId": "tuning.test-qa-automation.unit-component.admin-ui-tests",
"skillId": "unit-testing-test-generate",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "jest-generated-component-suite",
"allowedSkillIds": ["jest-skill", "unit-testing-test-generate"],
"requiredGroups": [["jest-skill"], ["unit-testing-test-generate"]]
},
"reason": "The conservative exact pair supplies an explicit Jest runner plus React patterns, mocks, coverage and CI integration."
},
{
"caseId": "tuning.test-qa-automation.unit-component.design-system-tests",
"skillId": "unit-testing-test-generate",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "jest-generated-component-suite",
"allowedSkillIds": ["jest-skill", "unit-testing-test-generate"],
"requiredGroups": [["jest-skill"], ["unit-testing-test-generate"]]
},
"reason": "The conservative exact pair supplies an explicit Jest runner plus React patterns, mocks, coverage and CI integration."
}
],
"decisionCounts": {
"ADD_TO_ALLOWED_EQUIVALENT": 7,
"REJECT_NOT_EQUIVALENT": 12,
"AMBIGUOUS_NEEDS_ADJUDICATION": 0
},
"reviewedAt": "2026-07-17"
}
@@ -0,0 +1,133 @@
{
"schemaVersion": 1,
"reviewVersion": "1.0.0",
"auditId": "aas-v1-tuning-gold-equivalence-1.0.1",
"reviewer": {
"identity": "gold-equivalence-independent-alpha",
"kind": "independent-agent-review",
"scorerImplementer": false
},
"scope": {
"repositoryCommit": "09f2d8612d2e68a087377685e9c876bd737e1782",
"packageVersion": "14.6.0",
"diagnosticSha256": "ae33eb201792dbcd5b28e5a71de36594f6c0e38709b6c86848de4420328f7001",
"tuningOnly": true,
"assignedClaimCount": 9,
"heldOutContentsRead": false,
"abstentionLabelsRead": false,
"readOnlyReview": true
},
"skillEvidence": [
{
"skillId": "agent-tool-builder",
"path": "skills/agent-tool-builder/SKILL.md",
"sha256": "d32f031ee373cb91618e2cb489e486258b1efa098621f403771b42013f733b03",
"lineRanges": ["18-20", "34-41", "340-432", "601-681"]
},
{
"skillId": "multi-agent-architect",
"path": "skills/multi-agent-architect/SKILL.md",
"sha256": "46c9287a5d9b81ab08ca39a5059f391e874e50d06cff7823ea6d70901c221ff8",
"lineRanges": ["21-37", "292-306", "310-331"]
},
{
"skillId": "api-documenter",
"path": "skills/api-documenter/SKILL.md",
"sha256": "6c08bd68f45cf03280b2a34f6d3bd94e92dba06c0ff4eb6b7b61a4813e0358b9",
"lineRanges": ["10-28", "34-44", "96-114", "162-180"]
},
{
"skillId": "kubernetes-architect",
"path": "skills/kubernetes-architect/SKILL.md",
"sha256": "122d2a64642bd0ce5a7fe56017d892496cd08b64f99871d4e2546d4ba8fd0bb9",
"lineRanges": ["10-28", "47-59", "117-131", "167-170"]
}
],
"decisions": [
{
"caseId": "tuning.agent-mcp-development.mcp-tooling.build-metadata-mcp",
"skillId": "agent-tool-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The skill covers MCP tools, schemas and stdio startup but not the required read-only resource boundary; it is incomplete alone and redundant beside the existing MCP builders."
},
{
"caseId": "tuning.agent-mcp-development.mcp-tooling.local-catalog-mcp",
"skillId": "agent-tool-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The skill does not establish the case-defining offline, no-write and read-only-resource contract."
},
{
"caseId": "tuning.agent-mcp-development.security-operations.ci-agent-security",
"skillId": "multi-agent-architect",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "multi-agent-threat-boundary-review",
"allowedSkillIds": ["multi-agent-architect", "threat-modeling-expert"],
"requiredGroups": [["multi-agent-architect"], ["threat-modeling-expert"]]
},
"reason": "It supplies least-privilege tool binding, input sanitization, permission layers, secret handling and tool-call logging; threat-modeling-expert supplies the separate threat-review group."
},
{
"caseId": "tuning.agent-mcp-development.security-operations.local-mcp-security",
"skillId": "multi-agent-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "LangGraph security guidance does not establish MCP stdio/read-only boundaries or trust labels for untrusted returned content."
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.partner-orders-api",
"skillId": "api-documenter",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "interface-design-documenter",
"allowedSkillIds": ["api-and-interface-design", "api-documenter"],
"requiredGroups": [["api-and-interface-design"], ["api-documenter"]]
},
"reason": "With the existing interface-design skill, api-documenter supplies OpenAPI authoring, contract validation, machine-readable documentation, versioning and backward-compatibility guidance."
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.research-catalog-api",
"skillId": "api-documenter",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "interface-design-documenter",
"allowedSkillIds": ["api-and-interface-design", "api-documenter"],
"requiredGroups": [["api-and-interface-design"], ["api-documenter"]]
},
"reason": "The framework-neutral skill covers offline OpenAPI review, contract validation, machine-readable documentation, versioning and backward compatibility alongside interface design."
},
{
"caseId": "tuning.deployment-devops.containers.worker-container",
"skillId": "kubernetes-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The case is Docker-only and the skill explicitly excludes work without Kubernetes or orchestration."
},
{
"caseId": "tuning.deployment-devops.release-rollback.canary-api-release",
"skillId": "kubernetes-architect",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "kubernetes-architecture-canary",
"allowedSkillIds": ["kubernetes-architect"],
"requiredGroups": [["kubernetes-architect"]]
},
"reason": "The Kubernetes case directly matches staging validation, rollback planning, Argo/Flagger canaries, progressive delivery, observability and safe deployment guidance."
},
{
"caseId": "tuning.deployment-devops.release-rollback.schema-compatible-release",
"skillId": "kubernetes-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The PostgreSQL compatibility case has no Kubernetes context and requires migration-specific sequencing and rollback evidence."
}
],
"decisionCounts": {
"ADD_TO_ALLOWED_EQUIVALENT": 4,
"REJECT_NOT_EQUIVALENT": 5,
"AMBIGUOUS_NEEDS_ADJUDICATION": 0
},
"reviewedAt": "2026-07-17"
}
@@ -0,0 +1,140 @@
{
"schemaVersion": 1,
"reviewVersion": "1.0.0",
"auditId": "aas-v1-tuning-gold-equivalence-1.0.1",
"reviewer": {
"identity": "gold-equivalence-independent-beta",
"kind": "independent-agent-review",
"scorerImplementer": false
},
"scope": {
"repositoryCommit": "09f2d8612d2e68a087377685e9c876bd737e1782",
"packageVersion": "14.6.0",
"diagnosticSha256": "ae33eb201792dbcd5b28e5a71de36594f6c0e38709b6c86848de4420328f7001",
"tuningOnly": true,
"assignedClaimCount": 10,
"heldOutContentsRead": false,
"abstentionLabelsRead": false,
"readOnlyReview": true
},
"skillEvidence": [
{
"skillId": "security-bluebook-builder",
"path": "skills/security-bluebook-builder/SKILL.md",
"sha256": "d4f053069cb503b3756fa6937003052d783c814fcccff25ae23dc1865b014085",
"lineRanges": ["2-5", "10-16", "31-50", "55-58"]
},
{
"skillId": "python-testing-patterns",
"path": "skills/python-testing-patterns/SKILL.md",
"sha256": "467fdbc399027e09da7df551c2088dad0e2fa7cba590be3059b40bfcbc63794a",
"lineRanges": ["2-5", "13-24", "31-40"]
},
{
"skillId": "api-testing-observability-api-mock",
"path": "skills/api-testing-observability-api-mock/SKILL.md",
"sha256": "65f57d1dc925210f083cc78874d4c839da4c73b5e0474b45922d20d9463fa527",
"lineRanges": ["2-5", "13-29", "39-49"]
},
{
"skillId": "unit-testing-test-generate",
"path": "skills/unit-testing-test-generate/SKILL.md",
"sha256": "3fdc338d79aa50a5e546c1ecfe983b583dd13827804dd8236b44d1de056748fe",
"lineRanges": ["2-5", "9-17", "154-210", "212-249", "251-320"]
}
],
"decisions": [
{
"caseId": "tuning.security-review-hardening.incident-hardening.ci-token-exposure",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "A policy document with a mini-runbook does not perform incident triage, preserve evidence or verify remediation."
},
{
"caseId": "tuning.security-review-hardening.incident-hardening.session-anomaly",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "Auth/session policy is topical but does not provide operational anomaly triage and containment-remediation verification."
},
{
"caseId": "tuning.security-review-hardening.secrets-auth.internal-auth-hardening",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "The skill lacks secret-lifecycle execution, managed-credential migration and authentication implementation patterns."
},
{
"caseId": "tuning.security-review-hardening.secrets-auth.service-credential-boundaries",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"coherentSolution": null,
"reason": "Trust-boundary policy does not replace a concrete secret lifecycle, rotation workflow and authentication implementation."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.gateway-contract-tests",
"skillId": "python-testing-patterns",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "pytest-api-mock-contract",
"allowedSkillIds": ["api-testing-observability-api-mock", "python-testing-patterns"],
"requiredGroups": [["api-testing-observability-api-mock"], ["python-testing-patterns"]]
},
"reason": "The Python-matched pair supplies pytest fixtures, API integration execution, CI, deterministic contract-aware mock fixtures and boundary scenarios."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.gateway-contract-tests",
"skillId": "api-testing-observability-api-mock",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "pytest-api-mock-contract",
"allowedSkillIds": ["api-testing-observability-api-mock", "python-testing-patterns"],
"requiredGroups": [["api-testing-observability-api-mock"], ["python-testing-patterns"]]
},
"reason": "The skill supplies contract-aware mock routes, deterministic fixtures, scenarios and boundary mocking while its Python companion supplies the runner and CI evidence."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.partner-contract-tests",
"skillId": "python-testing-patterns",
"decision": "AMBIGUOUS_NEEDS_ADJUDICATION",
"coherentSolution": null,
"reason": "A pytest harness is plausible but the project and shared suite are TypeScript/OpenAPI; the case does not authorize a cross-language harness."
},
{
"caseId": "tuning.test-qa-automation.integration-contract.partner-contract-tests",
"skillId": "api-testing-observability-api-mock",
"decision": "AMBIGUOUS_NEEDS_ADJUDICATION",
"coherentSolution": null,
"reason": "It covers partner mocks and fixtures but not a complete CI runner; whether a supplemental specialist belongs in an accepted solution requires adjudication."
},
{
"caseId": "tuning.test-qa-automation.unit-component.admin-ui-tests",
"skillId": "unit-testing-test-generate",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "jest-generated-component-suite",
"allowedSkillIds": ["jest-skill", "unit-testing-test-generate"],
"requiredGroups": [["jest-skill"], ["unit-testing-test-generate"]]
},
"reason": "It supplies TypeScript/Jest generation, React component patterns, mocks, coverage and CI output, while jest-skill supplies the runner."
},
{
"caseId": "tuning.test-qa-automation.unit-component.design-system-tests",
"skillId": "unit-testing-test-generate",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "jest-generated-component-suite",
"allowedSkillIds": ["jest-skill", "unit-testing-test-generate"],
"requiredGroups": [["jest-skill"], ["unit-testing-test-generate"]]
},
"reason": "It covers the TypeScript/Jest, React component, mocking, coverage and CI pattern group; jest-skill remains the required runner group."
}
],
"decisionCounts": {
"ADD_TO_ALLOWED_EQUIVALENT": 4,
"REJECT_NOT_EQUIVALENT": 4,
"AMBIGUOUS_NEEDS_ADJUDICATION": 2
},
"reviewedAt": "2026-07-17"
}
@@ -0,0 +1,53 @@
{
"schemaVersion": 1,
"reviewVersion": "1.0.0",
"auditId": "aas-v1-tuning-gold-equivalence-1.0.1",
"reviewer": {
"identity": "gold-equivalence-independent-ci-tiebreak",
"kind": "independent-agent-tiebreak-review",
"scorerImplementer": false
},
"scope": {
"repositoryCommit": "09f2d8612d2e68a087377685e9c876bd737e1782",
"packageVersion": "14.6.0",
"diagnosticSha256": "ae33eb201792dbcd5b28e5a71de36594f6c0e38709b6c86848de4420328f7001",
"tuningOnly": true,
"assignedClaimCount": 1,
"heldOutContentsRead": false,
"abstentionLabelsRead": false,
"readOnlyReview": true
},
"skillEvidence": [
{
"skillId": "multi-agent-architect",
"path": "skills/multi-agent-architect/SKILL.md",
"sha256": "46c9287a5d9b81ab08ca39a5059f391e874e50d06cff7823ea6d70901c221ff8",
"lineRanges": ["50-65", "292-306", "319-329"]
},
{
"skillId": "threat-modeling-expert",
"path": "skills/threat-modeling-expert/SKILL.md",
"sha256": "e091531614639439ab664277be72870ba7159cc6efc4a744f74b478dff0a09d1",
"lineRanges": ["13-21", "39-48"]
}
],
"decisions": [
{
"caseId": "tuning.agent-mcp-development.security-operations.ci-agent-security",
"skillId": "multi-agent-architect",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"coherentSolution": {
"solutionId": "multi-agent-threat-boundary-review",
"allowedSkillIds": ["multi-agent-architect", "threat-modeling-expert"],
"requiredGroups": [["multi-agent-architect"], ["threat-modeling-expert"]]
},
"reason": "The pair has a non-redundant division of labor: threat-modeling-expert supplies structured threat review, while multi-agent-architect supplies least-privilege tool binding, prompt-input sanitization, permission layers and tool-call auditability."
}
],
"decisionCounts": {
"ADD_TO_ALLOWED_EQUIVALENT": 1,
"REJECT_NOT_EQUIVALENT": 0,
"AMBIGUOUS_NEEDS_ADJUDICATION": 0
},
"reviewedAt": "2026-07-17"
}
File diff suppressed because one or more lines are too long
@@ -0,0 +1,307 @@
{
"schemaVersion": 1,
"auditId": "aas-v1-tuning-gold-equivalence-1.0.1",
"auditVersion": "1.0.0",
"baseline": {
"repositoryCommit": "09f2d8612d2e68a087377685e9c876bd737e1782",
"packageVersion": "14.6.0",
"previousFreezeRootDigest": "sha256-c7a4d4b3efa9f2bdf5a126fc3c384680d39534880a3900302785397e4ddd451c",
"publicSkillsIndexSha256": "073d00a736d2b8dd252c719da760b7bb1d9fd232fa70bc9fe01bb48b1428a3f3"
},
"diagnostic": {
"path": "baseline/v1/reviews/tuning-diagnostic-before-gold.json",
"sha256": "ae33eb201792dbcd5b28e5a71de36594f6c0e38709b6c86848de4420328f7001",
"catalogDigest": "sha256-2bcd615d3801594746ecae7e69395bdf88096a0bab78f8d5761f6e538f551edb",
"caseCount": 60,
"tuningOnly": true
},
"scope": {
"omissionCaseCount": 17,
"omittedInclusionCount": 19,
"changedPairCount": 7,
"heldOutCasesOrGoldReadByReviewers": false,
"abstentionLabelsReadByReviewers": false,
"metricFormulasChanged": false,
"productCodeChanged": false
},
"reviewReports": [
{
"reviewer": "gold-equivalence-independent-alpha",
"role": "primary-disjoint-a",
"path": "baseline/v1/reviews/reviewer-tuning-equivalence-alpha.json",
"sha256": "ec48b476a76a0332114e65db25badd92737ac6547c5a397d9456b2be4fb11689",
"claimCount": 9,
"scorerImplementer": false
},
{
"reviewer": "gold-equivalence-independent-beta",
"role": "primary-disjoint-b",
"path": "baseline/v1/reviews/reviewer-tuning-equivalence-beta.json",
"sha256": "01cbe88f9d55690b32e61cbd567c3560987654dbd4bee70daec926d740e060c3",
"claimCount": 10,
"scorerImplementer": false
},
{
"reviewer": "gold-equivalence-independent-adjudicator",
"role": "independent-adjudicator",
"path": "baseline/v1/reviews/reviewer-tuning-equivalence-adjudicator.json",
"sha256": "ad8c87f03287989b7dbbacaebc42aa11e9f4564a0f08af2b6361e02d389bd160",
"claimCount": 19,
"scorerImplementer": false
},
{
"reviewer": "gold-equivalence-independent-ci-tiebreak",
"role": "independent-tiebreak",
"path": "baseline/v1/reviews/reviewer-tuning-equivalence-ci-tiebreak.json",
"sha256": "dbc01ab488cd904370af0a27f9f14a92891edd0187549ace5c48d8cc88d9bebf",
"claimCount": 1,
"scorerImplementer": false
}
],
"claims": [
{
"caseId": "tuning.agent-mcp-development.mcp-tooling.build-metadata-mcp",
"skillId": "agent-tool-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.agent-mcp-development.mcp-tooling.local-catalog-mcp",
"skillId": "agent-tool-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.agent-mcp-development.security-operations.ci-agent-security",
"skillId": "multi-agent-architect",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "multi-agent-threat-boundary-review",
"resolution": "independent-tiebreak-with-dissent-retained",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator", "gold-equivalence-independent-ci-tiebreak"]
},
{
"caseId": "tuning.agent-mcp-development.security-operations.local-mcp-security",
"skillId": "multi-agent-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.partner-orders-api",
"skillId": "api-documenter",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "interface-design-documenter",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.research-catalog-api",
"skillId": "api-documenter",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "interface-design-documenter",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.deployment-devops.containers.worker-container",
"skillId": "kubernetes-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.deployment-devops.release-rollback.canary-api-release",
"skillId": "kubernetes-architect",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "kubernetes-architecture-canary",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.deployment-devops.release-rollback.schema-compatible-release",
"skillId": "kubernetes-architect",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.security-review-hardening.incident-hardening.ci-token-exposure",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.security-review-hardening.incident-hardening.session-anomaly",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.security-review-hardening.secrets-auth.internal-auth-hardening",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.security-review-hardening.secrets-auth.service-credential-boundaries",
"skillId": "security-bluebook-builder",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.integration-contract.gateway-contract-tests",
"skillId": "python-testing-patterns",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "pytest-api-mock-contract",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.integration-contract.gateway-contract-tests",
"skillId": "api-testing-observability-api-mock",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "pytest-api-mock-contract",
"resolution": "independent-agreement",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.integration-contract.partner-contract-tests",
"skillId": "python-testing-patterns",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "ambiguity-adjudicated-reject",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.integration-contract.partner-contract-tests",
"skillId": "api-testing-observability-api-mock",
"decision": "REJECT_NOT_EQUIVALENT",
"resolution": "ambiguity-adjudicated-reject",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.unit-component.admin-ui-tests",
"skillId": "unit-testing-test-generate",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "jest-generated-component-suite",
"resolution": "independent-agreement-on-conservative-exact-gold",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.unit-component.design-system-tests",
"skillId": "unit-testing-test-generate",
"decision": "ADD_TO_ALLOWED_EQUIVALENT",
"solutionId": "jest-generated-component-suite",
"resolution": "independent-agreement-on-conservative-exact-gold",
"reviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
}
],
"changedPairs": [
{
"caseId": "tuning.agent-mcp-development.security-operations.ci-agent-security",
"priorPairDigest": "sha256-584306f171df223d5a326a4027805bf57374826db9db266db2fc2622499b280a",
"newPairDigest": "sha256-8166b509f33719884800caa30a35b93c19a7532ba42b79caec8fb8ac9885cd74",
"solutionId": "multi-agent-threat-boundary-review",
"approvingReviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-ci-tiebreak"]
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.partner-orders-api",
"priorPairDigest": "sha256-8ad5add3c6889ed5372e4358a23ab6bf80ae83d57bbb42f49b1fba818a851813",
"newPairDigest": "sha256-1494fd21d58cad7d549a0ea132c423c7902e304fd71aa6b8123eb8be2787b0da",
"solutionId": "interface-design-documenter",
"approvingReviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.api-backend-delivery.api-design-contracts.research-catalog-api",
"priorPairDigest": "sha256-774dc3ea6d9d56cc5c62359a7da545aeaf4e9dc657bcdacfda9c8f390573523a",
"newPairDigest": "sha256-122f4173c22fea61413f168fdd29bd9cc418dfe710f6201fa2ba38d5d47d6ece",
"solutionId": "interface-design-documenter",
"approvingReviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.deployment-devops.release-rollback.canary-api-release",
"priorPairDigest": "sha256-6ada85bc3775d909036b1ccbe834039f991373311d173f5d3d2a34f663cbefd7",
"newPairDigest": "sha256-4b99c753b82666c9b20cd18a54d0b1c584e320b8c6529baafb33c5f66323c662",
"solutionId": "kubernetes-architecture-canary",
"approvingReviewers": ["gold-equivalence-independent-alpha", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.integration-contract.gateway-contract-tests",
"priorPairDigest": "sha256-c49d741a2913f06cc163e39ac541c8fc279467bd33aba82b0c31df608a7ed5ab",
"newPairDigest": "sha256-89ee39d9f9364e2a8871d0e56dded988f4562e79e9a7b5c2d7830356144da289",
"solutionId": "pytest-api-mock-contract",
"approvingReviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.unit-component.admin-ui-tests",
"priorPairDigest": "sha256-283525f1d35efec5aee27a4f4b256e18e11e862529f542a6179466b7b40f28ce",
"newPairDigest": "sha256-665dc06c2ce3abd17a0478a9da1a3fa4264ac65ad514d776a78f8a8b2fb4b44b",
"solutionId": "jest-generated-component-suite",
"approvingReviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
},
{
"caseId": "tuning.test-qa-automation.unit-component.design-system-tests",
"priorPairDigest": "sha256-76697f79d76acaaf26cafb43002af3a8e8c47437a3c3bb5663a6b3bee6ee7a56",
"newPairDigest": "sha256-b77cf14dcd25917d8dddeedd73d56472a3aa956ed2ecda9650987e06b48590d3",
"solutionId": "jest-generated-component-suite",
"approvingReviewers": ["gold-equivalence-independent-beta", "gold-equivalence-independent-adjudicator"]
}
],
"metricImplications": {
"formula": "unchanged-frozen-tuning-diagnostic-formula",
"before": {
"macro": {
"verifiedCoverage": 0.3666666666666667,
"inclusionPrecision": 0.5638888888888889,
"criticalGoalCoverage": 0.6166666666666667,
"nonCriticalGoalCoverage": 0.5333333333333333
},
"perIntentInclusionPrecision": {
"agent-mcp-development": 0.6,
"api-backend-delivery": 0.8,
"deployment-devops": 0.25,
"security-review-hardening": 0.3333333333333333,
"test-qa-automation": 0.4,
"web-application-delivery": 1
}
},
"after": {
"macro": {
"verifiedCoverage": 0.3666666666666667,
"inclusionPrecision": 0.7222222222222223,
"criticalGoalCoverage": 0.6166666666666667,
"nonCriticalGoalCoverage": 0.5333333333333333
},
"perIntentInclusionPrecision": {
"agent-mcp-development": 0.7,
"api-backend-delivery": 1,
"deployment-devops": 0.5,
"security-review-hardening": 0.3333333333333333,
"test-qa-automation": 0.8,
"web-application-delivery": 1
}
},
"delta": {
"macroInclusionPrecision": 0.15833333333333344,
"verifiedCoverage": 0,
"criticalGoalCoverage": 0,
"nonCriticalGoalCoverage": 0,
"acceptedInclusions": 8
},
"postAuditGates": {
"hardPolicyViolations": true,
"inclusionPrecision": false,
"verifiedCoverage": false
}
},
"provenance": {
"source": "independent-tuning-gold-equivalence-audit",
"version": "1.0.1",
"reviewedAt": "2026-07-17"
}
}