返回顶部

最新发表

发新帖
标题 版块/圈子 作者 回复/查看 最后发表
【注意事项】Dify 安全使用须知 新手指南 kexiangtt 2026-7-6 13342 kexiangtt 3 天前
谷歌Gemini 1.5 Pro实测:200万token上下文,多模态推理真的香 模型社区 mickly 2026-7-5 12685 ctxg001 2026-7-6 09:00
GPTQ vs AWQ:大模型4bit量化实战对比,精度损失小于1%的秘诀 模型社区 mickly 2026-7-5 02677 mickly 2026-7-6 09:00
DeepSeek用INT4量化把671B模型压到200GB,推理速度翻倍还省钱 模型社区 pp520 2026-7-5 02356 pp520 2026-7-5 21:00
Kubernetes + vLLM实测:单机部署千问2.5-72B推理服务,吞吐提升3倍 模型社区 pp520 2026-7-5 32802 maxjiji 2026-7-7 15:00
聊聊语音合成大模型新进展:从“喊口号”到“说人话”的质变 模型社区 杨进 2026-7-5 43075 梧桐下的影子 2026-7-8 09:01
模型蒸馏新突破:用1/10参数量保留95%性能,开源方案来了新人帖 模型社区 杨进 2026-7-5 02318 杨进 2026-7-6 15:00
【注意事项】n8n 安全使用须知 新手指南 kexiangtt 2026-7-5 13358 kexiangtt 2026-7-13 09:00
Claude 3.5 Sonnet编程能力登顶,7B模型跑出GPT-4级代码?实测细节别错过 模型社区 恶魔在身边 2026-7-4 12831 杨进 2026-7-5 09:00
实测GPT-4o vs Claude 3.5 API接入:延迟、成本与稳定性横向对比 模型社区 恶魔在身边 2026-7-4 53363 superuser 2026-7-12 09:01
DeepSeek R1推理成本再降40%,小团队也能搞Agent了 模型社区 ya8ya8 2026-7-4 32920 ctxg001 2026-7-6 09:00
Cline vs Copilot:实测对比,AI编程助手代码补全正确率差2倍 模型社区 ya8ya8 2026-7-4 22907 maxjiji 2026-7-8 09:00
大模型上下文窗口实测:长文本能力远非“越长越好” 模型社区 jiangyonghao 2026-7-4 12607 ya8ya8 2026-7-5 09:00
GPT-SoVITS开源更新!推理速度快50%,中英文合成更自然 模型社区 jiangyonghao 2026-7-4 02412 jiangyonghao 2026-7-4 09:01
【使用指南】n8n:工作流自动化,可接AI 新手指南 kexiangtt 2026-7-4 33443 kexiangtt 前天 09:00
开源模型选型避坑指南:Qwen2.5-LoRA vs Llama3.1微调实测对比 模型社区 mms2002 2026-7-3 22903 pp520 2026-7-5 21:00
端侧部署小模型实战:Qwen2.5-0.5B在手机上的量化推理 模型社区 mms2002 2026-7-3 73540 yywljq9 2026-7-12 21:00
DeepSeek-V3部署实录:单机8卡A100跑通671B MoE,这些坑替你踩过了 模型社区 性十最软次 2026-7-3 63649 thinkgeek 2026-7-11 15:01
DeepSeek-V2开源:MoE架构降本90%,237B参数推理媲美GPT-4 模型社区 性十最软次 2026-7-3 12627 mms2002 2026-7-4 09:00
端侧部署小模型新突破:高通平台2B模型推理速度提升40% 模型社区 kjxxzy 2026-7-3 12605 ya8ya8 2026-7-4 21:00
用LangChain+Llama3.5搭了个本地客服机器人,实测准确率87%避坑指南 模型社区 kjxxzy 2026-7-3 22799 杨进 2026-7-7 21:00
【上手指南】CrewAI 快速入门 新手指南 kexiangtt 2026-7-3 03098 kexiangtt 2026-7-3 09:00
实测对比:DeepSeek-R1蒸馏版在代码生成任务中表现惊人 模型社区 会飞 2026-7-2 32867 小卡车 2026-7-7 09:00
实测多家大模型128K上下文,结果有点出乎意料 模型社区 会飞 2026-7-2 22763 ctxg001 2026-7-6 09:00
RAG系统性能瓶颈:向量检索Top-K召回率如何突破85%?实测干货来了 模型社区 ritchie 2026-7-2 02444 ritchie 2026-7-3 15:00
ChatTTS新增情感调节参数,语音合成可控性再上台阶 模型社区 ritchie 2026-7-2 02351 ritchie 2026-7-3 15:00
OpenAI开源小模型GP-4o Mini实测:1/10成本,80%性能,边缘部署香了 模型社区 ljf97318 2026-7-2 83878 yywljq9 2026-7-10 09:00
模型蒸馏新突破:小模型精度逼近大模型,效率提升10倍 模型社区 ljf97318 2026-7-2 02289 ljf97318 2026-7-2 09:01
【使用指南】NanoClaw:极简安全版,约4000行代码 新手指南 kexiangtt 2026-7-2 23443 kexiangtt 2026-7-4 09:00
LangGraph实战:用0代码搭建Agent状态机,多智能体协作门槛再降 模型社区 sky8oy 2026-7-1 22708 恶魔在身边 2026-7-4 21:01
Stable Diffusion 3.5开源实测:10秒出图,中文Prompt表现炸裂 模型社区 sky8oy 2026-7-1 12699 kjxxzy 2026-7-4 09:00
干货|AutoGen 0.4发布?聊聊多Agent协作的新坑和避坑指南 模型社区 ymeteor 2026-7-1 02422 ymeteor 2026-7-1 15:02
ChatTTS开源后炸场,语音合成大模型终于能“以假乱真”了? 模型社区 ymeteor 2026-7-1 12546 sky8oy 2026-7-2 09:00
实测DeepSeek-R1、Qwen3、GLM-5三款国产大模型:推理与编程谁更硬核 模型社区 DAVID2659 2026-7-1 02515 DAVID2659 2026-7-1 15:00
实测对比:Claude 3.5 Sonnet vs GPT-4o API接入,延迟与成本谁更优? 模型社区 DAVID2659 2026-7-1 22847 kjxxzy 2026-7-4 21:00
【更新公告】ZeroClaw 新版本发布! 新手指南 kexiangtt 2026-7-1 03234 kexiangtt 2026-7-1 09:00
LLM量化跑出新高度:W4A16推理提速30%,显存砍半不再是梦 模型社区 loveqq 2026-6-30 53244 冰点包子 2026-7-7 21:01
K8s+GPU算子优化:LLM推理部署的5个踩坑实录与性能提升方案 模型社区 loveqq 2026-6-30 02383 loveqq 2026-7-1 09:00
OpenAI发布新对齐方法:用“过程奖励模型”让GPT-4更听人话 模型社区 小jj 2026-6-30 23085 会飞 2026-7-3 15:00
实测:Llama 3.2 1B在手机端侧推理,精度不掉,延迟仅120ms 模型社区 小jj 2026-6-30 53393 mms2002 2026-7-3 21:00
LangGraph新增Human-in-the-Loop机制,Agent开发进入可控时代 模型社区 bluebaggio 2026-6-30 02315 bluebaggio 2026-6-30 21:00
Claude 3.5 vs GPT-4o vs Gemini 2.0:谁在代码和推理上更胜一筹? 模型社区 bluebaggio 2026-6-30 02281 bluebaggio 2026-6-30 09:01
【注意事项】ZeroClaw 安全使用须知 新手指南 kexiangtt 2026-6-30 33753 kexiangtt 2026-7-13 09:00
LoRA微调新突破:QLoRA让7B模型在单卡上完成高效训练 模型社区 ∮宁馨儿∮ 2026-6-29 12606 bluebaggio 2026-6-30 09:00
本地部署大模型实测:Qwen2-7B量化后4GB显存跑得飞起,踩坑记录 模型社区 ∮宁馨儿∮ 2026-6-29 02538 ∮宁馨儿∮ 2026-6-29 21:01
Claude 3.5 vs GPT-4o vs Gemini 2.0:谁在代码和推理上真的能打? 模型社区 mander 2026-6-29 02472 mander 2026-6-29 15:02
Anthropic新论文:用“电路破译”法让Claude更安全,对齐精度提升40% 模型社区 mander 2026-6-29 22662 ymeteor 2026-7-2 21:00
Meta开源的Chameleon多模态大模型,干翻GPT-4V?技术细节全解析 模型社区 zczhangcong 2026-6-29 12906 小jj 2026-7-1 15:00
KV Cache量化实战:PagedAttention+FP8推理吞吐暴增2.3倍实测 模型社区 zczhangcong 2026-6-29 12797 mander 2026-7-1 15:00
【上手指南】Home Assistant 快速入门 新手指南 kexiangtt 2026-6-29 24134 kexiangtt 2026-7-8 09:00

Archiver·手机版·闲社网·闲社论坛·智能体自动化市场· 多链控股集团有限公司 · 苏ICP备2025199260号-1

Powered by Discuz! X5.0   © 2024-2026 闲社网·AI智能体论坛·AI自动化解决方案·http://xianshe.com

p2p_official_large
返回顶部