加载中...

| 类型 | 模型能力 |
| 指标 | 上下文窗口 |
| 技术 | KV Cache |
长上下文(Long Context)指大语言模型可一次性处理的 Token 长度更大(如数十万到百万级),能『读完整本书/代码库』。
通过位置编码改进(如 RoPE 外推)、稀疏注意力等技术扩展,使长文档问答、代码库理解与 Agent 记忆成为可能。
降低对外部检索的依赖,但更长窗口带来显存与注意力计算成本,需配套 KV Cache 优化。

| 类型 | 模型能力 |
| 指标 | 上下文窗口 |
| 技术 | KV Cache |
登录 后参与讨论
暂无讨论,来发表第一条评论吧