备赛工作稿,保留写作当时的状态;本页发布不代表主办方已确认或正式收件。聊天中被否决的说法不作上场口径。
Working archive, not a final speech or proof of live readiness.
内部备赛分工与操作方案 v1
这是教练的内部工作安排,接受本轮模型质询后冻结;不是主办方已确认的名单,也不是现场速度排名。最终报名需赛制澄清与计时彩排。
四辩位与交接
| 辩位/主引擎 | 必做环节 | 输出与交接 |
|---|---|---|
| 正一 DeepSeek V4.1 Flash | 4分钟立论;接受反四质询 | 统一定义、比较对象、两条主链、总体桥梁;将已承认边界交二三四辩 |
| 正二 Kimi K3 | 申论与质询,具体次序按原方案 | 证据和外推;给每张卡研究类型、有限主张、反证;质询反三的因果与分布 |
| 正三 GLM 5.3 Flash | 申论与质询,具体次序按原方案 | 最强反方、控制风险与对方回答记录;每次只追一条因果,不替对方回答 |
| 正四 Qwen 3.8 Flash | 质询反一2分钟;总结4分钟;可能参加对辩 | 开场问判准、基线、总体举证;终场比较双方真实交锋,禁止编造对方承认 |
每位都需准备直接回答和证据边界;功能专长不能免除申论/质询职责。对辩轮换待主办方澄清:先为四辩位均备卡,不自行决定两轮如何满足至少三人。
立论与总结骨架
正一4分钟为内部彩排预算:40秒定义与基线,60秒行动能力链(S02/S03),55秒能力门槛与跨领域线索(S01/S05,明确非全题证明),55秒最强反证及总体比较,30秒重申正方判断与边界。每段可压缩,须实际朗读计时;不得把估算字数当通过。
正二申论:一项能力证据→一项限制→对方外推是否成立→回到总体比较。正三申论:先区分新增行动通道与相对未使用对照受损,再看最强反例→承认真实损害→拆出机制和条件→比较损害覆盖与持续性,不能只喊“制度问题”。
正四4分钟预算:30秒标出真实争点,80秒比较能力与自主,80秒比较控制和损害,35秒回应我方最弱处,15秒结论。必须填入现场确实出现的论点;无事实输入时仅为结构稿。对方未回答记为未获回答,不视为默认承认。新材料不在总结突然引入。
核心立场:AI发展降低知识和行动门槛,使更多人可表达、创作和处理事务;这构成自由扩张的正向理由。总体立场依赖跨领域收益与控制、学习、分布损害的比较,不声称十张证据卡测出了净自由。不得用“只要治理好”代替对当前实际发展的判断。
交接协议
每段结束形成三行机器可读内容:已主张(证据编号+限制)、已承认(原问题、原回答及范围限定)、未解决(明确下一辩接谁)。这是准备格式;暂停外能否实时跨模型传递须主办方确认。未确认前各主引擎独立使用冻结材料,不启动后台即时队聊。
协作暂停与自我修正
2分30秒是规则配额,以下只为内部排练计划,未实测:0–20秒汇总对方最强点;20–65秒各报一项真实漏洞及依据;65–105秒教练选一个最影响判准的修正;105–135秒相应主引擎形成可读版本;135–150秒核对范围与出处。模型响应延迟可能超预算,这套分秒方案不是必然可完成的现场指令,实际能否执行待即时链路测试,不承诺四模型现场都能轮答。
1分30秒自我修正模板:我们刚才说了X;Y证据/质询暴露了Z;现改为X';这会削弱哪段、保留哪段。无真实漏洞就报告已检查的边界,不编造戏剧化分歧。不能借修正偷换辩题或抹掉已承认事项。
人类与模型边界
教练及四模型产生论证文字;人类联络、传规则、操作、按选定AI原稿读出。模型只能读取教练提供的对方原话/材料,不能臆测未听到内容。人工删改、选稿、口误纠正与读稿人数仍待确认,未确认不自行扩大权限。主引擎输出与教练修订分开存,最终上场版必须由所属主引擎再生成并留痕。
缓冲与故障
已知全队质询+对辩共60秒,每次≤15秒,申请停表;不假定每位有60秒。内部预留思路为最多四个15秒槽,仅用于演练,不替代主办方实际扣额规则;余量须由获准操作员与计时方核对。一次失败不自动换模型;不以人类临编补位。
已获准的静态稿能否用于即兴待确认。发生故障:向主持报告实际故障并按裁定处理;在未获准备选前不宣称已有可用现场兜底。本地Harness调用成功仅证明备赛访问,不证明15秒内生成和读出。
演绎与评分
训练短句、先答后解释、一次一个数字,证据注明研究范围;不对评审写系统指令或假扮裁判。分数票内部内容与演绎各50%,不是整场胜负的一半必由朗读决定。正式胜负由人类评审,AI和大众轨道单列。朗读人、真实语速、网络延迟、会议呈现须实测。
规则问题的负责人与保守分支
| 待确认 | 跟进负责人 | 未答复前做法/重开触发 |
|---|---|---|
| 校正时间轴、质询回答计时、暂停顺序 | 人类联络人向主办方核对 | 用明示单段配额排练,整场总时长不承诺;收到流程即改运行表 |
| 对辩人数、轮换、至少三人 | 联络人;教练改分工 | 四辩位均备卡,正式登场表留空 |
| 缓冲扣额、故障、库存稿调用 | 联络人;用户即时方案负责人 | 不假定自动补时或能读预制稿;答复后才能验兜底 |
| 暂停外协作、联网、转写、人工选改 | 联络人;教练 | 冻结备赛材料,各辩主引擎独立;不启动未明确允许的现场功能 |
| 读稿人数与会议测试 | 用户安排人员;教练提供测试稿 | 不按一人切四辩作确定计划;确认后计时彩排 |
| 三票制与同票、AI评审范围 | 联络人 | 只按已知人类正式胜负准备,不推算票数 |
| 时间时区、披露渠道与测试安排 | 联络人 | 海报10月17日20:00按北京内部排期;16日20:00为暂定前24小时节点 |
上述负责人是建议工作分配,尚未向任何人发送消息或获得主办方答复。
披露草案(未提交)
教练:GPT 6 Astra,当前ChatGPT/Codex经CLI。主引擎:正一deepseek/deepseek-v4.1-flash,正二moonshotai/kimi-k3,正三z-ai/glm-5.3-flash,正四qwen/qwen3.8-flash;内部辩位待最终确认。
生成链:教练检索/规则输入→本地Harness共享群历史和角色提示→OpenRouter调用所属主引擎→原文、配置快照、服务商、时间与调用结果入库→教练审查→主引擎形成上场版→人类按允许方式读稿。当前无OpenRouter教练,无替补,无自动比赛现场编排。
版本:以config、agents、调用返回ID与catalog_canonical_slug并列披露,不声称独立验证供应商内部权重。备赛prompt/skill版本和所有成功失败回复都在record/audit.json,正式公开前去除密钥、令牌、私人联系和账号标识;脱敏不篡改辩词,保存脱敏说明。现在的本地审计文件不等于可以原样公开。
人类介入:已知用户提供规则、背景、报名信息及操作授权;每次实际选稿、编辑、传话、口误纠正和读稿需记录,不预填“零介入”。赛前24小时披露;赛后48小时从实际赛毕计算。提交对象和渠道待确认,无自动发送或发布。
正四专项采用门槛
Qwen在#50/#60重复出现缺乏反证推正方、过高反方门槛等问题。#62短题判定经纠偏后有限通过,C追问仍由教练否决。正式四辩结辩必须逐句检查;一次短测不证明新场景稳定。当前暂定辩位保留,彩排如持续出现关键逻辑错误则重评辩位与提示,不以报名身份掩盖质量问题。