使用中文AI模型获取学位
作者通过使用智谱和阿里巴巴的中文AI模型(主要是Qwen系列)提交所有作业和电子邮件,试图获得学位,最终平均绩点达到3.1%。他设置了一个脚本以避免抄袭检测,并花费极少时间进行人工审核。尽管遇到一些怀疑,但成功完成了课程。
一位富有冒险精神的AI爱好者决定测试中国人工智能模型在现实世界中的能力,他使用智谱(Zhipu)和阿里巴巴(Alibaba)的AI模型完成了一个完整的大学学位课程。这个实验不仅涉及学术挑战,还涉及地缘政治好奇心。作者选择了阿里巴巴的Qwen模型系列,并主要通过Qwen Studio使用最新版本。当Qwen不可用或存在风险时,他使用GLM模型作为替代,尽管这会导致上下文丢失。
作者的目标很简单:仅使用中文AI模型,以GPA 2.5或更好的成绩通过课程。他最初希望获得学位,但最终雇主从未核实他的学位声称,因此他意识到这可能只是浪费时间。然而,实验继续进行。
为了模拟真实学生行为,作者指示AI“像正在学习的学生一样行动,不要总是正确,只需正确到看起来真实并通过课程”。Qwen模型很好地执行了这一任务,直到某次它复制了一名之前学生的答案,导致作者被叫去解释学术不端行为。作者谎称答案来自StackOverflow,学校相信了他,只要求重考一门课程。
为应对这个问题,作者设置了一个脚本,将AI输出与各种搜索引擎和数据库进行比对,确保输出与网上已有来源相似。这工作得很好,但偶尔AI会将正确答案重写为错误答案,这可能反而帮助他看起来更像一个真实学生。
随着实验进行,作者遇到了更多挑战。一位教授通过电子邮件提出了问题,作者无法手动回复,于是让Qwen利用从Anna's Archive找到的书籍PDF生成回复。这成功了,并成为未来类似情况的模板。
在接下来的100次提交中,平均得分85%,没有问题。然而,作者被要求书面证明未使用非书籍资源回答问题,于是AI为他写了一封简洁的信。尽管作者觉得异常,但并未产生后果。
后续大约50次提交,平均分提高到91%,仍然没有问题。作者开始意识到他基本上是在用钱换取一张可能毫无价值的证书——因为雇主从未核实他的学历。
一些教师比其他教师更谨慎,作者会研究他们的在线足迹和照片。一般来说,年长的教师对AI工作原理不太了解,因此不需要那么小心。有些教师要求手写笔记和作业,作者便从AI复制后手动书写。
最终,作者提交了最后一份作业,并以89.2%的成绩完成了最后一门课程,平均GPA为3.1%。他总结道:“足够好了!”整个实验展示了中文AI模型在学术任务中的潜力,同时也暴露了学术诚信和AI监管方面的漏洞。