中
中文权威榜单(SuperCLUE 类)
国产模型的“月考榜”——SuperCLUE、C-Eval 类中文语境题库定期排名,选型的中文参考系,看榜要看维度拆分与防污染机制。…
2 次浏览盲
盲测评估(Blind Evaluation)
撕掉标签再打分——评审不知道回答来自哪个模型,位置与品牌偏见少一半,竞技场与企业选型都在用的公平手段。…
4 次浏览M
Mamba 与状态空间模型(SSM)
挑战 Transformer 的新秀架构——不逐字回翻全文,而是像记笔记一样把看过的内容压缩成一份状态往前带,超长上下文的另一种答案。…
15 次浏览测
测试时计算(Test-time Compute)
“多想一分钟再答题”的算力化——遇到难题让模型多思考、多尝试、多验证,用推理时的算力换正确率,推理模型的技术内核。…
14 次浏览C
Copilot(AI 副驾驶)
AI 圈的“副驾驶”命名法——人坐主驾,AI 在旁边递地图、报路况。GitHub Copilot 把这个词带火,微软把它做成了产品家族名。…
20 次浏览E
ElevenLabs
声音的整容师兼翻译官——克隆一个声音,让它说几十种语言还带情绪,配音、有声书与游戏批量配音的幕后大户,多语言语音赛道的代表。…
20 次浏览