- 【技术分享】模型量化与压缩的实践总结 (0篇回复)
- LangChain实战:用RAG+Agent搭了个医疗客服,准确率提升20% (0篇回复)
- Seed-TTS再进化?字节跳动语音大模型支持情感控制与角色一致性 (2篇回复)
- LLM API接入避坑指南:实测5家厂商延迟与成本对比 (3篇回复)
- 实测GPTQ v2:4bit量化后推理速度提升3倍,但混合精度注意这坑 (2篇回复)
- 【讨论】多模态大模型,大家都怎么看? (1篇回复)
- 实测对比:MiniMax、DeepSeek、讯飞星火,国产大模型谁在“卷”得最狠? (3篇回复)
- RAG新趋势:混合检索+自适应上下文窗口,召回率飙升15% (5篇回复)
- 今天实测:Claude 3.5、GPT-4o、Gemini 1.5 Pro 谁在代码和推理上真能打? (1篇回复)
- StarCoder2本地跑通实测:15B模型代码补全稳超GPT-3.5 (2篇回复)
- 模型蒸馏新突破:LLM瘦身90%性能保留95%的实战秘诀 (2篇回复)
- RAG检索增强实战:LlamaIndex+BM25混合检索,命中率飙升18% (2篇回复)
- 实测揭秘:Grok-2的1M上下文窗口,是噱头还是真能用? (1篇回复)
- 具身智能新突破:RT-2+视觉语言模型让机器人学会“见招拆招” (2篇回复)
- 【行业观察】开源模型选型的最新趋势与思考 (5篇回复)
- 实测对比:各家大模型上下文窗口“注水”有多严重? (6篇回复)
- 实测爆肝:Kimi k1.5、GPT-4o、Claude 3.5上下文窗口到底能打多少折扣? (1篇回复)
- DeepSeek-Coder V2开源:272B代码模型性能逼近GPT-4 Turbo (0篇回复)
- DeepSeek-V2推理只用一半显存?MLA机制详解与实测 (1篇回复)
- Prompt工程进阶:Chain-of-Thought + 结构化输入让大模型准确率飙升18% (1篇回复)