S
System Prompt(系统提示词)
你没写过、但 AI 已经先读过的“幕后剧本”。产品方用它规定 AI 的性格、语气和行为边界,你看到的每一个“有性格”的 AI 背后都有它。想知道你的 AI 为什…
1 次浏览红
红队测试(Red Teaming)
雇一队“职业挑刺的”——发布前专门想方设法让 AI 说错话、泄密、越界,把漏洞自己先找完。大模型发布流程的标配安全环节。…
4 次浏览测
测试时计算(Test-time Compute)
“多想一分钟再答题”的算力化——遇到难题让模型多思考、多尝试、多验证,用推理时的算力换正确率,推理模型的技术内核。…
11 次浏览灰
灰度发布与回滚(AI 功能上线)
AI 功能的“安全带”——新模型或新提示词先放小比例流量,看质量与业务指标再放量,不对劲一键回旧版,AI 上线的必备章节。…
12 次浏览模
模型当裁判(LLM-as-a-Judge)
用 AI 给 AI 批卷子——强模型按准则给回答打分排序,评测成本砍一个数量级,但要先治好位置、长度、自恋三大偏见。…
7 次浏览结
结构化输出(Structured Output)
让 AI 按表格或 JSON 的固定格式交作业——程序能直接读,不用从一堆散文里抠数据。AI 接入业务系统的必备能力。…
13 次浏览A
AI 宠物应用(养宠助手)
铲屎官的“随身顾问”——拍照识别品种体态、疫苗驱虫日历提醒、行为答疑一站搞定,养护参考而不是替代兽医。…
15 次浏览数
数学评测(GSM8K 类)
给 AI 出数学卷子——从小学应用题、奥赛到研究级难题,答案唯一、自动判分,是检验模型“真推理”能力的首选考场。…
14 次浏览指
指令遵循(Instruction Following)
听不听话的量化分——你说“用三句话、表格形式、别用感叹号”,模型能不能一条条做到,就是指令遵循能力。…
24 次浏览A
AI 错题本(智能错题管理)
学生党的“错题管家”——拍照收录错题、按知识点自动归类、按遗忘曲线推送变式重练,纸质错题本的赛博升级。…
15 次浏览