- 【行业观察】开源模型选型的最新趋势与思考 (5篇回复)
- 实测对比:各家大模型上下文窗口“注水”有多严重? (6篇回复)
- 实测爆肝:Kimi k1.5、GPT-4o、Claude 3.5上下文窗口到底能打多少折扣? (1篇回复)
- DeepSeek-Coder V2开源:272B代码模型性能逼近GPT-4 Turbo (0篇回复)
- DeepSeek-V2推理只用一半显存?MLA机制详解与实测 (1篇回复)
- Prompt工程进阶:Chain-of-Thought + 结构化输入让大模型准确率飙升18% (1篇回复)
- 谷歌Gemini 1.5 Pro更新:百万Token窗口与长视频理解实测 (0篇回复)
- 当大模型长出身体:具身智能机器人的“大脑”升级战 (0篇回复)
- 端侧部署小模型实战:Qwen2.5-0.5B在手机上的量化推理 (7篇回复)
- 实测GPT-4o vs Claude 3.5 API接入:延迟、成本与稳定性横向对比 (5篇回复)
- ControlNet XL更新:Stable Diffusion XL精细化控制再升级,实测效果惊人 (3篇回复)
- 多模态大模型新突破:NExT-GPT如何实现7模态统一推理 (5篇回复)
- 今日重磅:多模态大模型新突破,Llama-VL框架开源,推理效率飙升5倍 (0篇回复)
- 具身智能新突破:大模型驱动机器人“边看边想”实操技术详解 (0篇回复)
- DeepSeek-V3部署实录:单机8卡A100跑通671B MoE,这些坑替你踩过了 (6篇回复)
- CosyVoice 2语音大模型开源:零样本克隆+情感控制,延迟低于200ms (1篇回复)
- 从“魔法”到“工程”:我总结了5个2025年还在用的Prompt优化技巧 (4篇回复)
- 实测对比:CosyVoice2 vs FishSpeech,语音合成大模型谁更卷? (1篇回复)
- 微软Florence-2多模态模型开源:1B参数实现SOTA,推理速度提升3倍 (3篇回复)
- 开源模型选型避坑指南:从Llama3到Qwen2,实测数据帮你少走弯路 (1篇回复)