CCBC(Cipher & Code Breaking Competition)是由密码菌偶像事务所主办的古典密码主题解谜寻宝(Puzzle Hunt)比赛。参赛方式为线上组队参赛,每队 1-5 人共同完成题目,通过解答谜题以到达活动的终点,即视为完赛。比赛成绩将依据完赛的时间先后计算名次。
活动时间: 2026 年 8 月 14 日 20:00 ~ 2026 年 8 月 23 日 20:00
序章
有了之前的经验,我们在本次比赛中基本全程使用 LLM 完成了所有题目。队友除了一开始帮了一两题以外,其它题目全部是我监工 GPT 5.6 Sol 或者 Claude Opus 5 完成的,但队友提供了 Max 20x 账号和 Pro 20x 账号,他才是最大的功臣。我本次使用的 harness 均是 Claude Code 和 ChatGPT 桌面端,部分题目有 Gemini 加上 Antigravity 的参与,但它实在太糟糕了。
本题比赛的结构特点是很有意思的,以一个网页解谜(WIG)为主线,同时推进解谜和剧情,相当考验 LLM 的能力(
祸乱时柒的爱情
这是第一部分,从一开始我们就大力使用 GPT,导致没啥可讲的……所以我能谈的只有 AI 的表现和一些有趣的我参与的点。
混元大熔炉
这题的线索解出来不费什么 AI 功夫,问题是如何填盘面。这个盘面实在是太变态了,居然没有任何的边界线,GPT 卡死掉了。我开完提示,得到了简化盘面,居然还花了不少功夫去一点点填出了所有字,最终再由生克关系换成 Morse 密码得到 PENTAGON。
趣味小常识
这道题 AI 很容易地将连线连了出来得到了中间答案 DICT DEFS FOR RED AREA HANZI,但是确实我们无法得知下一步需要干什么,于是开了没什么用的提示,不过“打”字组词各种释义我们倒是人工看出来了,接着 AI 慢慢尝试查找就得到了答案 RACKET。不过我想吐槽的是,最后一步利用在线词典中“打”字的不同释义对应的条目序号来提取答案的方式实在是太糟糕了,到底是谁想出来的提取方式啊,怎么保证大家都能找到正确的字典,怎么确保比赛期间字典不会被修改呢?
META 八音盒里的潘多拉
音频题目,GPT 对于它的处理方式是做语音识别和频谱分析,主要利用文字去搜索。听起来就知道结果很差,因为有粤语、日语等各种奇怪语言,实际它的表现也确实如此,所以这题有一半的音频识别是人工完成的。
不过“某音什么”还是得靠提示才能知道,后续让 AI 自己跑很快就能做出来,得到 PARADOXXING。
视中监
这一区的小题题面全部在 WIG 的探索过程中,这对于 AI 来说实在是有点糟糕,不确定的题面范围会让它的表现大打折扣,所以我基本上都是人工去整理题面的,而且很大部分题目我都开了题面的提示。
广播体操二十六式
我当时不知道这题到底是什么意思,但我要说的是这题获取题面的过程,相当搞笑。WIG 手机中的 APP 有个搜集贴纸的东西,根据简单调查可以发现似乎是用加速度传感器来判断用户做了什么动作,动作对上就获得贴纸。
实际上 GPT 利用模拟加速度已经获得了几张图片,并判断这些动作是宝可梦中的 Z 招式,但是它好像很难模拟出正确的动作,于是我人工来帮忙——我根本不知道也不想看 Z 招式怎么做,只是坐在床上疯狂摇手机,一点点根据给出的分数调整动作,随即拿全全部贴纸!
剩下来的事情 AI 很快就搞定了,得到月亮伊布也就是 Umbreon。
艺人之夏
本区域的全部 71 道图片汉字谜题在 WIG 的某个漫画 APP 中。GPT 能解出一半左右的题目,剩下来的部分小题还是我亲自动手的。至于 META 题目完全不需要人类参与,GPT 直接就能完成。
不理性经纪人假设
简单说说,「五雷灌顶」这题 GPT 一股脑想要当成纸笔逻辑题做,那当然是做不出来的,我得反复告诉它去分析结构寻找规律它才能做出这题。顺带这题的思想是拿扫雷模拟逻辑电路,这个我在某 CTF 中早已见过。
「直到大地变成一块拼图」这题我让 GPT 写个脚本跑虚拟定位来获取碎片,获取完后它不会提取,还是开了提示才知道是二进制 ASCII 码,然后最后的答案变换也很 geek 啊。
「拼多多」这个多解拼图和「精删打字通」这个速录机的题目,人工来肯定不容易,LLM 却特别擅长这两题。
我们最后在截止时间到了时,做到了「引领潮流的考威尔」这个 META 题,GPT 被这题卡了很久。
互联网过载
这一部分就一道题「沉向网中的追迹者」,或者说这实际上是 WIG 的最后剧情部分。
在这里说说 WIG 的做题情况:基本上 AI 做出来的部分还是偏多的,它主要的卡点有两个,一是猜五个画师的信息做网站的时候,它没办法给出正确的五人擅长画的人物类型(实际上我来做也不行,还得靠人工提示);二是生成钓鱼网站的时候算钱算不太对,找不到某些线索,得靠人工提示。几次尝试后算对了,但是邮箱给错了导致我卡了很久,还得是用人工提示才行。
可以说这 WIG 部分除了最后的剧情以外,没有固定的提示是最大的问题,有的时候我都不知道卡在哪了,我本人来也不行(
后记
还是让我展示一下 LLM vs 人类的表格,纵向五类就是人和 AI 参与题目解答的百分比差别,横向是提示使用的情况。
| 人工智能 | 不完美的 AI | 五五开 | 努力的人类 | 能工智人 | |
|---|---|---|---|---|---|
| 要提示干嘛? | 余烬、三步必杀、万象更新、本是同根生、玫瑰花园的小径、新式疗法、META-禅学和武学的结合很好但是师父我真的想结婚、META-尝百草后炼制出灵丹妙药治疗百病、META-看我飞刀看我飞刀看我飞刀看我飞刀看我飞刀、META-虽然是正气凛然但是我不是女孩子怎么办啊、META-太极八卦连环掌这一套下来你吃得消吗、META-跳进火山口后与潜修的魔头一同锻炼宝刀、META-像孔子一样游历同时修身也是不错的选择、META-用毒蛇的毒毒毒蛇毒蛇会不会被毒死、META-与道士和僧侣一起降妖除魔行善积德、META-这帮和尚怎么身上全是骨头啊啊啊啊、META-这里全都是坏人怎么办啊哇哇哇哇哇、拼多多、精删打字通、和而不同 | 雪为何色 | 「艺人之夏」区域 71 道小题 | ||
| 不上不下的提示 | 情迷翡冷翠、碳基生物计算器、META-去伪存真的李昌钰、疯狂的猜图、危机合约「破玄作战」、传说的一夜、沉向网中的追迹者 | 欢迎来到互联网、亚细亚三重奏 | 趣味小常识、广播体操二十六式、五雷灌顶 | ||
| 没提示怎么做啊! | 保持解谜就无人爆炸、幻方的交易策略、盗影团参上!、刻在 strands 里的谜题、把握今朝、创造你的历史、周游列国、META-学到口口相传的硬气功就能横行江湖了呀、META-在天下最有名的工匠帮助下打造神兵利器、META-在仙山练剑就纯粹讲究的是一个惬意、META-针灸是一种不可被割舍的医疗方法、失忆症候群、😊😠😢😃🏢、套四宝、META-引领潮流的考威尔 | META-八音盒里的潘多拉、META-追逐时间的画中仙、直到大地变成一块拼图 | 混元大熔炉 |
从中表格中可以看出,几乎所有题目是 AI 完成的,甚至很大一部分都是完全由 AI 完成的,人类已经没有太多作用了。
队伍名称【Lost in Harem】,比赛结束时完成题目数量为 29-18,后续拖了很久才完赛并完成所有小题,排名 264。
比赛期间,我们在 GPT 5.6 Sol Max 模型上的 token 使用量高达 7.1B,等效 API 价格约 $4357。另外我们还榨干了一个 Claude Max 20x 的周限额,等效价格可能也有几千刀。
在赛后,我们继续完成了剩余题目的解答,一些难解题目换成 GPT 6 Astra 后基本随便被秒杀,看样子大模型的迭代速度还是太快了点。我们的仓库中存放了 LLM 的解题过程和代码。
人类离被 AI 完全超越已经差不了多少时间了,这恐怕也是最后一个我需要写一点东西的 Puzzle Hunt 了,下次我还是直接公开仓库就好了。