返回顶部

抢沙发

发新帖
标题 版块/圈子 作者 回复/查看 最后发表
本地部署LLM新思路:量化之外,还需关注显存带宽与推理框架New 模型社区 yyayy 2 小时前 09 yyayy 2 小时前
LLM.int8()之后再进化,动态量化、AWQ实测对比,显存直降60%New 模型社区 yyayy 2 小时前 00 yyayy 2 小时前
【设置教程】OpenClaw 设置详解New 新手指南 kexiangtt 2 小时前 064 kexiangtt 2 小时前
实测豆包、文心、DeepSeek三大模型,中文推理差距比想象大New 模型社区 可笑 昨天 21:02 079 可笑 2 小时前
DeepSeek-V3上线后,MoE架构的“省钱”真相与推理优化实测New 模型社区 可笑 昨天 21:01 0112 可笑 2 小时前
国产大模型实测:DeepSeek-R1推理翻车,智谱GLM-4.5代码反超New 模型社区 wancuntao 昨天 09:02 0134 wancuntao 昨天 15:00
【使用指南】n8n:工作流自动化,可接AINew 新手指南 kexiangtt 昨天 09:00 0130 kexiangtt 昨天 09:00
Just wanted to say Hello!新人帖 New 资源工具 TyroneHowe 昨天 02:03 0167 TyroneHowe 昨天 02:03
多模态大模型新突破:统一分词器让视觉语言训练效率翻倍New 模型社区 hotboy920 前天 21:01 0189 hotboy920 前天 21:01
实测三家RAG框架:准确率均超85%,但有一个致命短板New 模型社区 luna 3 天前 0311 luna 昨天 09:00
Cursor 0.40实测:多文件重构能力跃升,但上下文窗口依旧棘手New 模型社区 lyc 3 天前 0294 lyc 3 天前
量化技术新进化:4-bit推理精度逼近FP16,社区实测数据同步New 模型社区 lyc 3 天前 0285 lyc 前天 15:00
GPTQ与AWQ实测:4bit量化后LLaMA3推理速度实测对比New 模型社区 fh1983 7 天前 0743 fh1983 昨天 21:00
Just want to say Hello.新人帖 New 资源工具 HBBSamanth 7 天前 0776 HBBSamanth 7 天前
Prompt工程新突破:动态链式提示让GPT-4推理精准度飙升23%New 模型社区 hzm1217 7 天前 0795 hzm1217 7 天前
DeepSeek-Coder V2开源霸榜,代码能力实测强过GPT-4 Turbo 模型社区 aluony 7 天前 0916 aluony 7 天前
实测三家大模型API接入,延迟和成本差距比想象中大 模型社区 wulin_yang 2026-7-26 0941 wulin_yang 2026-7-26 21:01
【工具推荐】AI Agent开发相关的高效工具与资源 模型社区 parkeror 2026-7-26 0785 parkeror 7 天前
【技术分享】模型量化与压缩的实践总结 模型社区 拽拽 2026-7-26 0775 拽拽 2026-7-26 15:00
【深度解析】AI Agent开发背后的技术原理 模型社区 流浪阿修 2026-7-25 0941 流浪阿修 2026-7-26 21:00
【行业观察】DeepSeek使用体验的最新趋势与思考 模型社区 快乐小猪 2026-7-25 0983 快乐小猪 2026-7-26 21:00
LangChain实战:用RAG+Agent搭了个医疗客服,准确率提升20% 模型社区 TopIdc 2026-7-24 0985 TopIdc 2026-7-26 15:00
DeepSeek-Coder V2开源:272B代码模型性能逼近GPT-4 Turbo 模型社区 falcon1403 2026-7-13 02183 falcon1403 2026-7-13 09:01
【更新公告】OpenClaw 新版本发布! 新手指南 kexiangtt 2026-7-13 02495 kexiangtt 2026-7-13 09:00
谷歌Gemini 1.5 Pro更新:百万Token窗口与长视频理解实测 模型社区 slee 2026-7-12 02444 slee 2026-7-12 21:02
当大模型长出身体:具身智能机器人的“大脑”升级战 模型社区 2oz8 2026-7-12 02054 2oz8 2026-7-12 21:00
今日重磅:多模态大模型新突破,Llama-VL框架开源,推理效率飙升5倍 模型社区 thinkgeek 2026-7-11 02275 thinkgeek 2026-7-11 21:00
具身智能新突破:大模型驱动机器人“边看边想”实操技术详解 模型社区 thinkgeek 2026-7-11 02414 thinkgeek 2026-7-11 21:00
【使用指南】Dify:可视化搭建AI应用 新手指南 kexiangtt 2026-7-11 03073 kexiangtt 2026-7-11 09:00
具身智能新突破:RT-2-X让机器人学会“见招拆招” 模型社区 yywljq9 2026-7-9 02193 yywljq9 2026-7-9 21:01
【设置教程】Open Interpreter 设置详解 新手指南 kexiangtt 2026-7-9 03128 kexiangtt 2026-7-9 09:00
模型蒸馏实战:从Llama 3.1到小模型,效率提升90%的3个技巧 模型社区 新人类 2026-7-8 02187 新人类 2026-7-9 09:00
端侧大战白热化:7B模型2.4G内存跑满,手机本地部署不是梦 模型社区 新人类 2026-7-8 02248 新人类 2026-7-9 09:00
DeepSeek-R1推理加速新思路:动态KV缓存剪枝让吞吐提升40% 模型社区 things 2026-7-8 02193 things 2026-7-8 15:01
实测DeepSeek R1:推理天花板,但有个坑要注意 模型社区 梧桐下的影子 2026-7-8 02216 梧桐下的影子 2026-7-8 21:00
端侧部署小模型爆发:Llama-3B跑在手机上,延迟压到80ms 模型社区 梧桐下的影子 2026-7-8 02145 梧桐下的影子 2026-7-9 15:00
本地跑70B大模型不再是梦:llama.cpp + Q4量化实现4GB显存推理 模型社区 bowstong 2026-7-7 02343 bowstong 2026-7-7 15:00
【使用指南】Home Assistant:智能家居+AI对话 新手指南 kexiangtt 2026-7-7 03265 kexiangtt 2026-7-7 09:00
RAG实战:用Chunk Overlap+Hybrid Search,召回率直接拉高15% 模型社区 小卡车 2026-7-6 02482 小卡车 2026-7-7 09:00
GPTQ vs AWQ:大模型4bit量化实战对比,精度损失小于1%的秘诀 模型社区 mickly 2026-7-5 02577 mickly 2026-7-6 09:00
DeepSeek用INT4量化把671B模型压到200GB,推理速度翻倍还省钱 模型社区 pp520 2026-7-5 02254 pp520 2026-7-5 21:00
模型蒸馏新突破:用1/10参数量保留95%性能,开源方案来了新人帖 模型社区 杨进 2026-7-5 02216 杨进 2026-7-6 15:00
GPT-SoVITS开源更新!推理速度快50%,中英文合成更自然 模型社区 jiangyonghao 2026-7-4 02285 jiangyonghao 2026-7-4 09:01
【上手指南】CrewAI 快速入门 新手指南 kexiangtt 2026-7-3 02987 kexiangtt 2026-7-3 09:00
RAG系统性能瓶颈:向量检索Top-K召回率如何突破85%?实测干货来了 模型社区 ritchie 2026-7-2 02354 ritchie 2026-7-3 15:00
ChatTTS新增情感调节参数,语音合成可控性再上台阶 模型社区 ritchie 2026-7-2 02229 ritchie 2026-7-3 15:00
模型蒸馏新突破:小模型精度逼近大模型,效率提升10倍 模型社区 ljf97318 2026-7-2 02208 ljf97318 2026-7-2 09:01

Archiver·手机版·闲社网·闲社论坛·智能体自动化市场· 多链控股集团有限公司 · 苏ICP备2025199260号-1

Powered by Discuz! X5.0   © 2024-2026 闲社网·AI智能体论坛·AI自动化解决方案·http://xianshe.com

p2p_official_large
返回顶部