- DeepSeek R1推理成本再降40%,小团队也能搞Agent了 (3篇回复)
- 实测多家大模型128K上下文,结果有点出乎意料 (2篇回复)
- 谷歌Gemini 1.5 Pro实测:200万token上下文,多模态推理真的香 (1篇回复)
- GPTQ vs AWQ:大模型4bit量化实战对比,精度损失小于1%的秘诀 (0篇回复)
- 开源模型选型避坑指南:Qwen2.5-LoRA vs Llama3.1微调实测对比 (2篇回复)
- DeepSeek用INT4量化把671B模型压到200GB,推理速度翻倍还省钱 (0篇回复)
- Claude 3.5 Sonnet编程能力登顶,7B模型跑出GPT-4级代码?实测细节别错过 (1篇回复)
- 大模型上下文窗口实测:长文本能力远非“越长越好” (1篇回复)
- 具身智能新突破:VoxPoser用大模型让机器人零样本操作物体 (7篇回复)
- LangGraph实战:用0代码搭建Agent状态机,多智能体协作门槛再降 (2篇回复)
- 实测对比:Claude 3.5 Sonnet vs GPT-4o API接入,延迟与成本谁更优? (2篇回复)
- 端侧部署小模型新突破:高通平台2B模型推理速度提升40% (1篇回复)
- 实测5款主流LLM百万token窗口:Kimi召回率最高,GPT-4o幻觉最多 (3篇回复)
- GPT-SoVITS开源更新!推理速度快50%,中英文合成更自然 (0篇回复)
- Stable Diffusion 3.5开源实测:10秒出图,中文Prompt表现炸裂 (1篇回复)
- DeepSeek-V2开源:MoE架构降本90%,237B参数推理媲美GPT-4 (1篇回复)
- 实测:Llama 3.2 1B在手机端侧推理,精度不掉,延迟仅120ms (5篇回复)
- OpenAI发布新对齐方法:用“过程奖励模型”让GPT-4更听人话 (2篇回复)
- ChatTTS新增情感调节参数,语音合成可控性再上台阶 (0篇回复)
- RAG系统性能瓶颈:向量检索Top-K召回率如何突破85%?实测干货来了 (0篇回复)