AI
.news
教程
研究
工具
模型
AI创业
讨论
新闻
WIKI
搜
搜
🚀 创业库
★ 投稿
登录
主页
教程
研究
工具
模型
AI创业
讨论
新闻
每日简报
WIKI
│
🚀 创业库
★ 投稿
AI+
医疗
机器人
教育
金融
能源
健康
娱乐
思考
← 返回首页
·
💬 讨论
·
原文链接 ↗
[Deepseek-V4-Flash-0731] Full 1M context on a single RTX5090 + DDR5 Desktop Setup with VLLM CPU/Ram Offloading, ~800 tps pp & 15+ tps decode [Agentic Coding]
reddit.com
分享
⚠️ 无法提取正文
该页面需要 JavaScript 渲染,或限制了爬虫访问(常见于微信公众号、知乎专栏等)。
打开原文 (reddit.com) →
[Deepseek-V4-Flash-0731] Full 1M context on a single RTX5090 + DDR5 Desktop Setup with VLLM CPU/Ram Offloading, ~800 tps pp & 15+ tps decode [Agentic Coding] | AI.News