推理模型
DeepSeek-R1:关注推理过程、蒸馏版本与本地运行选择
理解完整版本与蒸馏版本的资源差异,以及在数学、代码和通用问答中的适用边界。
模型观察
跟进国内开源大模型的发布、能力更新与生态进展。信息以模型卡、代码仓库和公开技术报告为基础,重点说明对开发者的实际影响。


近期模型更新越来越重视推理效率、长上下文、工具调用和端侧适配。选择模型时,除了榜单分数,还应同时核对许可证、显存需求、中文任务表现以及推理框架支持。
查看选型方法 →以下内容为技术观察与学习索引,具体参数和许可条件请以项目官方说明为准。
理解完整版本与蒸馏版本的资源差异,以及在数学、代码和通用问答中的适用边界。
按硬件、上下文长度和应用类型梳理不同规模版本,避免只按参数量做决定。
围绕图像描述、文字识别、图表理解和界面分析建立一套小型验证集。
分析个人电脑和边缘设备适用的模型规模,以及量化对效果和速度的影响。
检查再分发、商业用途、衍生模型和品牌使用等常见条款,降低集成风险。