- 【模型体验】关于DeepSeek使用体验的一些思考 (2篇回复)
- 【技术分享】AI Agent开发的实践总结 (4篇回复)
- 【行业观察】模型微调与LoRA的最新趋势与思考 (2篇回复)
- 【踩坑分享】上下文窗口实际表现过程中遇到的问题与解决 (1篇回复)
- 【对比评测】Prompt工程实践横向对比与选型建议 (2篇回复)
- 【踩坑分享】模型蒸馏技术过程中遇到的问题与解决 (2篇回复)
- 【技术分享】代码生成模型对比的实践总结 (2篇回复)
- 【深度解析】LLM推理优化背后的技术原理 (3篇回复)
- 多模型协作不是堆砌,这几种方案真能提升推理效果 🧠 (2篇回复)
- 模型微调血泪史:踩坑3个月总结的5条实用经验 🚀 (4篇回复)
- 【深度解析】DeepSeek使用体验背后的技术原理 (1篇回复)
- 【入门指南】模型蒸馏技术从0到1的学习路径 (2篇回复)
- LLM API接入避坑指南:从选模型到稳定调用的实战分享 🚀 (2篇回复)
- 【深度解析】端侧部署小型模型背后的技术原理 (1篇回复)
- Llama 3.1 开源炸场,部署避坑指南来了 🔥 (6篇回复)
- 聊点干货:2024年值得上手的几款开源大模型 🚀 (5篇回复)
- 别被刷榜数据骗了!聊聊代码生成模型的真实评测 🧪 (2篇回复)
- 【行业观察】国产大模型实测的最新趋势与思考 (0篇回复)
- 多模型协作:别让单兵作战拖垮你的推理能力 🚀 (2篇回复)
- 多模态大模型2024:从“能看懂”到“会干活”的关键一跃 🚀 (3篇回复)