返回顶部

抢沙发

发新帖
标题 版块/圈子 作者 回复/查看 最后发表
vLLM 0.8.0实测:P99延迟降40%,显存省30%的部署新姿势New 模型社区 wizard888 昨天 21:02 026 wizard888 昨天 21:02
DeepSeek-Coder-V3悄然登顶,代码生成迎来国产新王?New 模型社区 wizard888 昨天 21:01 036 wizard888 昨天 21:01
具身智能爆发前夜:VLA模型进入“实机考核”阶段New 模型社区 y365168 昨天 15:02 0120 y365168 昨天 15:02
本地部署LLM新思路:量化之外,还需关注显存带宽与推理框架New 模型社区 yyayy 昨天 09:02 0111 yyayy 昨天 21:00
LLM.int8()之后再进化,动态量化、AWQ实测对比,显存直降60%New 模型社区 yyayy 昨天 09:01 075 yyayy 昨天 21:00
【设置教程】OpenClaw 设置详解New 新手指南 kexiangtt 昨天 09:00 0123 kexiangtt 昨天 09:00
DeepSeek-V3上线后,MoE架构的“省钱”真相与推理优化实测New 模型社区 可笑 前天 21:01 0210 可笑 昨天 15:00
国产大模型实测:DeepSeek-R1推理翻车,智谱GLM-4.5代码反超New 模型社区 wancuntao 前天 09:02 0219 wancuntao 前天 15:00
【使用指南】n8n:工作流自动化,可接AINew 新手指南 kexiangtt 前天 09:00 0244 kexiangtt 前天 09:00
Just wanted to say Hello!新人帖 New 资源工具 TyroneHowe 前天 02:03 0302 TyroneHowe 前天 02:03
多模态大模型新突破:统一分词器让视觉语言训练效率翻倍New 模型社区 hotboy920 3 天前 0275 hotboy920 3 天前
实测三家RAG框架:准确率均超85%,但有一个致命短板New 模型社区 luna 4 天前 0367 luna 前天 09:00
Cursor 0.40实测:多文件重构能力跃升,但上下文窗口依旧棘手New 模型社区 lyc 4 天前 0364 lyc 4 天前
量化技术新进化:4-bit推理精度逼近FP16,社区实测数据同步New 模型社区 lyc 4 天前 0349 lyc 3 天前
GPTQ与AWQ实测:4bit量化后LLaMA3推理速度实测对比 模型社区 fh1983 2026-7-27 0796 fh1983 前天 21:00
Just want to say Hello.新人帖 资源工具 HBBSamanth 2026-7-27 0866 HBBSamanth 2026-7-27 16:30
Prompt工程新突破:动态链式提示让GPT-4推理精准度飙升23% 模型社区 hzm1217 2026-7-27 0893 hzm1217 2026-7-27 21:00
DeepSeek-Coder V2开源霸榜,代码能力实测强过GPT-4 Turbo 模型社区 aluony 2026-7-27 01006 aluony 2026-7-27 15:00
实测三家大模型API接入,延迟和成本差距比想象中大 模型社区 wulin_yang 2026-7-26 01022 wulin_yang 2026-7-26 21:01
【工具推荐】AI Agent开发相关的高效工具与资源 模型社区 parkeror 2026-7-26 0874 parkeror 2026-7-27 15:00
【技术分享】模型量化与压缩的实践总结 模型社区 拽拽 2026-7-26 0879 拽拽 2026-7-26 15:00
【深度解析】AI Agent开发背后的技术原理 模型社区 流浪阿修 2026-7-25 01063 流浪阿修 2026-7-26 21:00
【行业观察】DeepSeek使用体验的最新趋势与思考 模型社区 快乐小猪 2026-7-25 01091 快乐小猪 2026-7-26 21:00
LangChain实战:用RAG+Agent搭了个医疗客服,准确率提升20% 模型社区 TopIdc 2026-7-24 01100 TopIdc 2026-7-26 15:00
DeepSeek-Coder V2开源:272B代码模型性能逼近GPT-4 Turbo 模型社区 falcon1403 2026-7-13 02271 falcon1403 2026-7-13 09:01
【更新公告】OpenClaw 新版本发布! 新手指南 kexiangtt 2026-7-13 02640 kexiangtt 2026-7-13 09:00
谷歌Gemini 1.5 Pro更新:百万Token窗口与长视频理解实测 模型社区 slee 2026-7-12 02515 slee 2026-7-12 21:02
当大模型长出身体:具身智能机器人的“大脑”升级战 模型社区 2oz8 2026-7-12 02143 2oz8 2026-7-12 21:00
今日重磅:多模态大模型新突破,Llama-VL框架开源,推理效率飙升5倍 模型社区 thinkgeek 2026-7-11 02345 thinkgeek 2026-7-11 21:00
具身智能新突破:大模型驱动机器人“边看边想”实操技术详解 模型社区 thinkgeek 2026-7-11 02465 thinkgeek 2026-7-11 21:00
【使用指南】Dify:可视化搭建AI应用 新手指南 kexiangtt 2026-7-11 03173 kexiangtt 2026-7-11 09:00
具身智能新突破:RT-2-X让机器人学会“见招拆招” 模型社区 yywljq9 2026-7-9 02288 yywljq9 2026-7-9 21:01
【设置教程】Open Interpreter 设置详解 新手指南 kexiangtt 2026-7-9 03213 kexiangtt 2026-7-9 09:00
模型蒸馏实战:从Llama 3.1到小模型,效率提升90%的3个技巧 模型社区 新人类 2026-7-8 02279 新人类 2026-7-9 09:00
端侧大战白热化:7B模型2.4G内存跑满,手机本地部署不是梦 模型社区 新人类 2026-7-8 02346 新人类 2026-7-9 09:00
DeepSeek-R1推理加速新思路:动态KV缓存剪枝让吞吐提升40% 模型社区 things 2026-7-8 02270 things 2026-7-8 15:01
实测DeepSeek R1:推理天花板,但有个坑要注意 模型社区 梧桐下的影子 2026-7-8 02268 梧桐下的影子 2026-7-8 21:00
端侧部署小模型爆发:Llama-3B跑在手机上,延迟压到80ms 模型社区 梧桐下的影子 2026-7-8 02222 梧桐下的影子 2026-7-9 15:00
本地跑70B大模型不再是梦:llama.cpp + Q4量化实现4GB显存推理 模型社区 bowstong 2026-7-7 02419 bowstong 2026-7-7 15:00
【使用指南】Home Assistant:智能家居+AI对话 新手指南 kexiangtt 2026-7-7 03411 kexiangtt 2026-7-7 09:00
RAG实战:用Chunk Overlap+Hybrid Search,召回率直接拉高15% 模型社区 小卡车 2026-7-6 02547 小卡车 2026-7-7 09:00
GPTQ vs AWQ:大模型4bit量化实战对比,精度损失小于1%的秘诀 模型社区 mickly 2026-7-5 02663 mickly 2026-7-6 09:00
DeepSeek用INT4量化把671B模型压到200GB,推理速度翻倍还省钱 模型社区 pp520 2026-7-5 02345 pp520 2026-7-5 21:00
模型蒸馏新突破:用1/10参数量保留95%性能,开源方案来了新人帖 模型社区 杨进 2026-7-5 02293 杨进 2026-7-6 15:00
GPT-SoVITS开源更新!推理速度快50%,中英文合成更自然 模型社区 jiangyonghao 2026-7-4 02400 jiangyonghao 2026-7-4 09:01
【上手指南】CrewAI 快速入门 新手指南 kexiangtt 2026-7-3 03081 kexiangtt 2026-7-3 09:00
RAG系统性能瓶颈:向量检索Top-K召回率如何突破85%?实测干货来了 模型社区 ritchie 2026-7-2 02425 ritchie 2026-7-3 15:00

Archiver·手机版·闲社网·闲社论坛·智能体自动化市场· 多链控股集团有限公司 · 苏ICP备2025199260号-1

Powered by Discuz! X5.0   © 2024-2026 闲社网·AI智能体论坛·AI自动化解决方案·http://xianshe.com

p2p_official_large
返回顶部