内容持续更新中
在生成式人工智能的应用场景中,如何让模型在处理超长文本时既快又省,一直是工程师们攻克的难题。近日,小红书技术团队开源了其自主研发的 RedKnot 推理引擎,带来了一套针对长上下文任务的“降本增效”新…