盲测评估(Blind Evaluation)
撕掉标签再打分——评审不知道回答来自哪个模型,位置与品牌偏见少一半,竞技场与企业选型都在用的公平手段。…
1 次浏览多模态评测(图文音视频基准)
考完文字考“看图听话”——图表问答、文档理解、视频与语音任务,多模态评测的成套考卷正在成型,判分远比纯文本难。…
2 次浏览AIGC(AI 生成内容)
AI 生产的所有内容——文章、图片、视频、音乐、代码,只要不是人亲手做的而是 AI 产的,都叫 AIGC。平台要求“标注 AIGC”标的也是它。…
6 次浏览System Prompt(系统提示词)
你没写过、但 AI 已经先读过的“幕后剧本”。产品方用它规定 AI 的性格、语气和行为边界,你看到的每一个“有性格”的 AI 背后都有它。想知道你的 AI 为什…
4 次浏览红队测试(Red Teaming)
雇一队“职业挑刺的”——发布前专门想方设法让 AI 说错话、泄密、越界,把漏洞自己先找完。大模型发布流程的标配安全环节。…
8 次浏览Notion AI
笔记软件里的驻场写手——选中文字一键翻译、续写、总结,还能问它笔记里写过什么直接开卷作答,把 AI 缝进日常写作与知识库的典型。…
12 次浏览损失函数(Loss Function)
给模型打分的错题量化器——把“输出离正确答案有多远”算成一个数,训练的全部目标就是把这个数压下去。训练曲线上的 loss 线就是它。…
13 次浏览语音合成(TTS)
让机器“开口说话”——把文字变成自然人声,导航播报、有声书、AI 客服背后都是它。顶尖产品的合成音已难辨真伪。…
14 次浏览智能摘要(Summarization)
万字变三句的“压缩饼干”——文章、会议、邮件、视频,一键提炼要点,是普及率最高的 AI 办公功能之一。…
13 次浏览Mamba 与状态空间模型(SSM)
挑战 Transformer 的新秀架构——不逐字回翻全文,而是像记笔记一样把看过的内容压缩成一份状态往前带,超长上下文的另一种答案。…
14 次浏览测试时计算(Test-time Compute)
“多想一分钟再答题”的算力化——遇到难题让模型多思考、多尝试、多验证,用推理时的算力换正确率,推理模型的技术内核。…
13 次浏览课程学习(Curriculum Learning)
先易后难的教学法——训练时把数据从简单到难排序喂给模型,像小学到大学的课程表,让学习过程更稳、收敛更顺。…
13 次浏览AI 教育(自适应学习)
随叫随到的讲解员——同一道题换三种讲法直到你听懂,错题自动归类再出同类题练习。工具视角看教学提效,升学决策类用途不在其列。…
10 次浏览Llama(羊驼)
开源界的“领头羊”(名字就是羊驼)——Meta 发布的开放权重模型系列,全球开发者魔改的底料,开源生态的半壁江山。…
10 次浏览AI 驾考陪练(科目备考)
驾考路上的“AI 学伴”——科目一四题库讲解与错题重练、科目二三 3D 点位演示,理论备考高效,实车仍靠教练。…
13 次浏览