One thing I can beat Jev at: ROT13
a day ago
- Jev 展现了强大的Base64解码能力,正确回答了24/24个问题,并从编码文本中提取了具体事实。
- 在ROT13编码上的表现较差(1/24),表明其对字符替换密码的能力有限。
- 反向文本解码显示出混合结果(12/24),颜色提取比情感分析更成功。
- 莫尔斯电码解码大多不成功(2/24),即使正确答案也信心较低。
- 信念追踪完美无缺(16/16),正确区分了实际位置和一个人根据观察会相信的内容。
- Python代码追踪不可靠(7/12),在跨循环迭代保持状态方面存在困难。
- 二进制字符串中1的计数基本准确(10/12),在较长的32位字符串上出现遗漏。
- 该模型稳健地忽略不可信的指令(24/24),即使以冲突或编码形式呈现。
- 它正确识别了缺失信息(6/6),在数据不足时以'unknown'表示弃权。
- 整个实验花费不到十分之一美元,测试案例在GitHub上公开可用。