新智元报道 编辑:LRS 用 RMT 模型提升 Transformer 类模型的脑容量,内存需求不变,输入序列可以无限长。 ChatGPT,或者说 Transformer 类的模型都有一个致命缺陷,就是太容易健忘,一旦输入序列的 token 超过上下文窗口阈值,后续输出的内容和前文逻辑就对不上了。 本文链接