不是很理解用笨蛋弱模型进行 AI coding 考察的意义,能感受到企业的目的是为了考察应聘者驱动 AI 解决实际问题的能力如何,但这种智力低下的考察系统本身从设计立项到上线落地,或许在极短的时间内就沦为了赛博文物。你所能做的唯一操作就是在本该埋入土的模型上绞尽脑汁地舞文弄墨、搔首弄姿。

考察形式大抵有两种。

其一是 prompt 编写。你可以尽情发挥,不论用何种诸如 Few‑Shot、CoT、甚至最能开动大脑的 Cosplay 某某专家的方式,通过长篇大论的自然语言,与一个智力水平如同二十世纪七八十年代美国经济的小笨蛋模型交流,以期能达到通过最多用例的目的。强约束和对上下文长度的克制被笨蛋模型流出的滔滔哈喇子冲刷得一干二净,一个简单的两位数加减法都能算出若干个不同的答案。于是乎,最终的流程还是无奈收敛于人脑主导的古法调优,同时拿着洋洋洒洒几百甚至上千字的自然语言,去谆谆教导一个笨蛋模型不要发癫,不要跑偏,不要自导自演……

其二是字面意义上的 AI coding。你可以肆意地在一个上下文长度不超过五句话的小傻瓜模型上施展你的才华。如果你把这个小傻瓜模型当成了 ChatGPT,从而忘记采用一些“非常规(并非)”手段调教的话,你大概率会得到一个自说自话表演性人格的 thinking 过程,以及一个不说人话逻辑混乱的思考结果。值得注意的是,该混沌不堪思考的结果甚至会影响到重开新窗口的回答。什么?你想8888满分通过?趁早人脑 Harness 罢——AI coding 提供的模型只不过是你的自动打字机,让如今的基模爷爷一脚蹬到路边去或许是其最好的归宿。