📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. nvidia/Qwen3.8-Flash-Next-NVFP4:英伟达官方出品的NVFP4量化版⭐⭐
英伟达Model Optimizer团队亲自转制的Flash-Next NVFP4版——Blackwell原生4bit浮点格式的官方背书,数据中心GPU推理降本的风向标,和社区GGUF量化走的是两条路线
⚡ 工程可参考
HuggingFace·📥 18,068 下载 · ❤️ 137
🔴 训练与对齐
2. XHToken/Spark-X2.5-4B-GGUF:4B小模型的本地量化发布⭐⭐
Spark-X2.5 4B级小模型走DPO后训练+GGUF量化全家桶路线,tag直接面向llama.cpp/ollama/LM Studio生态,3.6万下载——低端硬件、边缘设备本地部署的候选清单可以加一条
👀 持续关注
HuggingFace·📥 36,320 下载 · ❤️ 80
🔴 RAG与知识增强
3. 换模型后Agent的记忆还活着吗?记忆可移植性受控研究⭐⭐
9月4日新论文,提出一个做长期记忆系统绕不开的问题:模型升级是常态,但记忆迁移没人管——同一个记忆库换个模型解读就变了味。对星竹的启示:记忆系统的设计要把"模型无关性"当一等公民
论文识别出三种失效模式:新模型对旧笔记的解读漂移、混合embedding版本破坏检索一致性、缺少原始证据时记忆修复失败。本质是受控实验:同一份历史记忆分别喂给不同模型,对比行为差异。对做agent记忆层/RAG系统的人,这是升级前必读的坑位地图。
📖 精读全文
arXiv·📅 09-04