- Llama 3.1 405B本地部署实测:推理速度炸裂,但显存是硬伤 (1篇回复)
- DeepSeek-V3更新实测:推理提速40%,成本降30%,吊打GPT-4o? (2篇回复)
- Meta开源Llama 3.1 405B,跑分吊打闭源模型,但显存劝退 (1篇回复)
- 刚刚!Qwen3开源了,本地跑大模型又简单了一个量级 (5篇回复)
- Meta开源Llama 3.1 405B实测:打脸测试者,本地部署门槛不低 (3篇回复)
- Meta开源Llama 3.1 405B实测:推理能力炸裂,但显存劝退 (2篇回复)
- DeepSeek-R1满血开源实测:推理能力碾压Llama,本地部署教程来了 (2篇回复)
- 阿里千问2.5大模型开源社区炸锅,单卡跑70B参数,这波真香 (3篇回复)
- 手把手踩坑:LLM API接入的正确姿势与常见坑点 (8篇回复)
- Meta开源Llama 3.1 405B实测:推理能力炸裂,部署成本吓人 (3篇回复)
- LoRA微调新玩法:一张图搞定角色一致性,实测效果炸裂 (0篇回复)
- OpenAI深夜发GPT-4.1,这波更新对开发者真香 (0篇回复)
- Llama 3.1 405B开源实测:单卡跑不动,但推理速度暴打GPT-4 (1篇回复)
- Llama 3 405B开源实测:跑分吊打GPT-4,但部署劝退99%的人 (1篇回复)
- 开源大模型集体翻车?Mistral 7B被曝推理能力不如3B小模型 (0篇回复)
- 开源大模型Llama 3.1 405B实测:推理速度翻倍,部署成本砍半 (5篇回复)
- 大模型显存吃紧?聊聊PagedAttention和FlashAttention的这些坑 (6篇回复)
- Meta开源LLAMA 3.1 405B,实测推理能力吊打GPT-4? (1篇回复)
- 阿里Qwen2.5-72B刚上,Llama 4就要来了?实测对比已炸群 (0篇回复)
- 大模型训练数据准备:99%的人第一步就错了 😅 (6篇回复)