数
数学评测(GSM8K 类)
给 AI 出数学卷子——从小学应用题、奥赛到研究级难题,答案唯一、自动判分,是检验模型“真推理”能力的首选考场。…
1 次浏览指
指令遵循(Instruction Following)
听不听话的量化分——你说“用三句话、表格形式、别用感叹号”,模型能不能一条条做到,就是指令遵循能力。…
2 次浏览A
AI 错题本(智能错题管理)
学生党的“错题管家”——拍照收录错题、按知识点自动归类、按遗忘曲线推送变式重练,纸质错题本的赛博升级。…
3 次浏览继
继续预训练(Continual Pre-training)
给模型“复读深造”——拿自己领域的大量文本接着预训练,让通用模型变成行业行家。介于预训练和微调之间的中间路线。…
9 次浏览智
智能驾驶(Autonomous Driving)
会自己开的车——从高速领航到城区智驾,AI 把路况变成模型输入,方向盘从“人主导”慢慢变“人监督”。辅助驾驶的责任人仍是驾驶员。…
6 次浏览智
智谱 GLM
清华系的“技术直男”——智谱 AI 的 GLM 系列,从论文里走出来的国产开源主力之一,开发者与学术社区的熟面孔。…
12 次浏览图
图灵测试(Turing Test)
判断机器会不会“思考”的七十年老考题——隔着对话框聊天,分不清对面是人还是机器,机器就算过关。每次 AI 大新闻都绕不开它。…
10 次浏览