模
模型当裁判(LLM-as-a-Judge)
用 AI 给 AI 批卷子——强模型按准则给回答打分排序,评测成本砍一个数量级,但要先治好位置、长度、自恋三大偏见。…
1 次浏览指
指令遵循(Instruction Following)
听不听话的量化分——你说“用三句话、表格形式、别用感叹号”,模型能不能一条条做到,就是指令遵循能力。…
8 次浏览智
智谱 GLM
清华系的“技术直男”——智谱 AI 的 GLM 系列,从论文里走出来的国产开源主力之一,开发者与学术社区的熟面孔。…
18 次浏览图
图灵测试(Turing Test)
判断机器会不会“思考”的七十年老考题——隔着对话框聊天,分不清对面是人还是机器,机器就算过关。每次 AI 大新闻都绕不开它。…
19 次浏览M
Multimodal(多模态)
能看图、听声、看视频的 AI 就是多模态模型。发截图问报错、拍照片认植物、语音对话,都靠它。这条词条讲清它和纯文字模型的差别,以及“看图”这件事上它还会犯哪些错…
21 次浏览