测试时计算(Test-time Compute)
“多想一分钟再答题”的算力化——遇到难题让模型多思考、多尝试、多验证,用推理时的算力换正确率,推理模型的技术内核。…
1 次浏览Llama(羊驼)
开源界的“领头羊”(名字就是羊驼)——Meta 发布的开放权重模型系列,全球开发者魔改的底料,开源生态的半壁江山。…
1 次浏览重试与退避(Retry with Backoff)
调 API 被拒后的“礼貌再试”——失败后等一等再重试,越失败等得越久,别把故障服务雪上加霜,调用方的必修课。…
6 次浏览AI 网关(AI Gateway)
大模型流量的“总闸门”——鉴权限流、路由切换、用量记账一处管齐,多模型混用的团队几乎都会长出这一层。…
5 次浏览结构化输出(Structured Output)
让 AI 按表格或 JSON 的固定格式交作业——程序能直接读,不用从一堆散文里抠数据。AI 接入业务系统的必备能力。…
5 次浏览检查点与断点续训(Checkpoint)
给训练存个档——权重与优化器状态全量落盘,断电崩溃都能从上次进度接着练,跑数月的训练没它等于赌命,容错也是成本的一部分。…
6 次浏览AI 意识(AI Consciousness)
AI 会不会“有感觉”——它说“我很开心”是真开心还是概率模仿?哲学界和 AI 圈吵了几十年的开放问题,没有答案但必须想。…
19 次浏览数学评测(GSM8K 类)
给 AI 出数学卷子——从小学应用题、奥赛到研究级难题,答案唯一、自动判分,是检验模型“真推理”能力的首选考场。…
10 次浏览指令遵循(Instruction Following)
听不听话的量化分——你说“用三句话、表格形式、别用感叹号”,模型能不能一条条做到,就是指令遵循能力。…
14 次浏览Copilot(AI 副驾驶)
AI 圈的“副驾驶”命名法——人坐主驾,AI 在旁边递地图、报路况。GitHub Copilot 把这个词带火,微软把它做成了产品家族名。…
14 次浏览继续预训练(Continual Pre-training)
给模型“复读深造”——拿自己领域的大量文本接着预训练,让通用模型变成行业行家。介于预训练和微调之间的中间路线。…
16 次浏览智能驾驶(Autonomous Driving)
会自己开的车——从高速领航到城区智驾,AI 把路况变成模型输入,方向盘从“人主导”慢慢变“人监督”。辅助驾驶的责任人仍是驾驶员。…
12 次浏览AI 工作流(Workflow)
把 AI 的活编成固定流程图——每一步做什么、走哪条岔路都事先画好,AI 按图施工。稳定、可控、可复用,企业落地的主流方式。…
17 次浏览图灵测试(Turing Test)
判断机器会不会“思考”的七十年老考题——隔着对话框聊天,分不清对面是人还是机器,机器就算过关。每次 AI 大新闻都绕不开它。…
21 次浏览