📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Qwopus3.8-27B-Flash-GGUF:多模态模型本地部署即插即用⭐⭐⭐
27B多模态(图+文)模型的GGUF量化版,llama.cpp生态直接跑——如果星竹想在本地/私有环境部署一个中等规模视觉理解模型,这类社区量化版本是最省事的起点
🔧 建议试一下
HuggingFace·📥 10,680 下载 · ❤️ 113
2. FastVideo FastH3 4-step Preview:4步采样生成有声视频⭐⭐⭐
FastVideo团队把视频生成蒸馏到4步采样,还带音频轨道(VSA),DataFree蒸馏意味着不需要原始训练数据——视频生成成本曲线又被往下压了一截,做视频类AI应用时值得关注这条降本路线
👀 持续关注
HuggingFace·📥 22,851 下载 · ❤️ 279
3. Qwen3.8-27B NVFP4量化版:Blackwell原生4-bit浮点格式实践⭐⭐⭐
QAT(量化感知训练)出品的NVFP4权重,面向NVIDIA Blackwell硬件的原生4-bit浮点格式——相比训后量化(PTQ)精度损失更小,是「大模型量化部署」这条技术线上值得跟踪的参考实现
⚡ 工程可参考
HuggingFace·📥 18,880 下载 · ❤️ 108
🔴 训练与对齐
4. PhoneLLM Alpha-1:pipecat开源的电话场景专用模型⭐⭐⭐
开源语音Agent框架pipecat推出的电话场景LLM首个alpha版——电话客服/语音助手方向出现了「框架厂亲自下场训模型」的动向,说明通用模型在低延迟电话对话上仍有差距,垂直场景专用模型是条可行路线
👀 持续关注
HuggingFace·📥 23,003 下载 · ❤️ 212