今日推介(第2207期):突破大语言模型预训练规模的极限、消除百万级长文本语境下的全上下文 Draft-KV 性能开销、基于错误定位的测试时扩展、参数高效微调(PEFT)的容量与记忆能力量化评估、通过逐 Token 耗时分析窃取架构与推理优化信息 公·众·号:爱可可爱生活 http://t.cn/AX9OIYc7 #机器学习##人工智能##论文#
发布于 北京
