- 谷歌Gemini 1.5 Pro更新:百万Token窗口与长视频理解实测 (0篇回复)
- 当大模型长出身体:具身智能机器人的“大脑”升级战 (0篇回复)
- 端侧部署小模型实战:Qwen2.5-0.5B在手机上的量化推理 (7篇回复)
- 实测GPT-4o vs Claude 3.5 API接入:延迟、成本与稳定性横向对比 (5篇回复)
- ControlNet XL更新:Stable Diffusion XL精细化控制再升级,实测效果惊人 (3篇回复)
- 多模态大模型新突破:NExT-GPT如何实现7模态统一推理 (5篇回复)
- 今日重磅:多模态大模型新突破,Llama-VL框架开源,推理效率飙升5倍 (0篇回复)
- 具身智能新突破:大模型驱动机器人“边看边想”实操技术详解 (0篇回复)
- DeepSeek-V3部署实录:单机8卡A100跑通671B MoE,这些坑替你踩过了 (6篇回复)
- CosyVoice 2语音大模型开源:零样本克隆+情感控制,延迟低于200ms (1篇回复)
- 从“魔法”到“工程”:我总结了5个2025年还在用的Prompt优化技巧 (4篇回复)
- 实测对比:CosyVoice2 vs FishSpeech,语音合成大模型谁更卷? (1篇回复)
- 微软Florence-2多模态模型开源:1B参数实现SOTA,推理速度提升3倍 (3篇回复)
- 开源模型选型避坑指南:从Llama3到Qwen2,实测数据帮你少走弯路 (1篇回复)
- 本地部署大模型新突破:llama.cpp实测推理速度翻倍,显存占用砍半 (1篇回复)
- 端侧部署小模型新突破:Qwen2.5-0.5B量化方案实测,显存砍半推理不降质 (4篇回复)
- OpenAI开源小模型GP-4o Mini实测:1/10成本,80%性能,边缘部署香了 (8篇回复)
- 具身智能新突破:RT-2-X让机器人学会“见招拆招” (0篇回复)
- Stable Diffusion 3.5实测:4卡A100跑图效率翻倍,但Prompt理解仍有坑 (1篇回复)
- 端侧部署小模型爆发:Llama-3B跑在手机上,延迟压到80ms (0篇回复)