• DeepSeek模型MMLU Pro测试:越大模型表现更优,在单个3090上运行Qwen 32B才是王道: [img]data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAAArwAAAGJCAMAAABfOxDyAAADAFBMVEX////+/v37+/v5+
  • Perplexity刚刚发布了经过培训的DeepSeek R1,用于提供事实和公正的信息- MIT许可。语文数学能力双解放,敢说智商不掉线! R1 1776 是一个 DeepSeek-R1 推理模型,经过 Perplexity AI 后期训练,可消除人为审查(因为审查者自己可能也存在[url=htt
  • DeepSeek AI 提供情感支持,成为中国年轻人心理慰藉新选择。 每天晚上睡觉前,Holly Wang 都会打开 DeepSeek 进行“治疗”。 自从今年 1 月这个超厉害 icon
  • Framework Desktop是不是被吹得太厉害了,说它能跑DeepSeek这样的大模型LLM?但实际上,它的内存不够大,没法搞MoE(专家混合模型),带宽也不够,跑不了那些需要大量计算的密集型模型。 理论上,128GB内存跑LLM会因为带宽不够而卡顿。内存太少,跑不了那种MoE模型,没人会花2 icon
  • 性能强劲。跑 deepseek 速度超快,功能齐全充性能,原装未拆封 4090涡轮显卡打折仅96GB,全新靠谱,性能无敌!不挑系统! 不挑驱动! icon
  • DeepSeek R1 671 B 刚刚以 198 tokens/秒的速度打破了推理速度记录,成为了目前最快的推理模型! 哇!DeepSeek-R1 671 B 真的超级厉害!它在 SambaNova Cloud 上跑出了 198 tokens/秒 的速度,直接刷新了记录!这是什么概念呢? [b]它 icon
  • 英伟达新博客文章:LLM生成的GPU内核显示了FlexAttention的加速。前有[url= 他们把r1放在一个循环中15分钟,它产生了:“在某些情况下比熟练的工程师开发的优化内核更好” 有网友表示:这 icon
  • deepseek/deepseek-r1-distill-llama-70b位列排名榜第三名,排在openai/o1和deepseek-r1之后: [img]data:image/jpeg;base64,/9j/4AAQSkZJRgABAQIAJQAlAAD/2wBDABwUFRkVEhwZFxkg icon
  • SGLang已经为DeepSeek R1实现了多令牌预测,速度提高了1.76倍,每秒77个Token 我们在 icon
  • DeepSeek 的smallpond项目使用 DuckDB 进行数据处理,点击标题见: 特征 由 DuckDB提供支持的高性能数据处理 可扩展以处理 icon
  • 传统观点:学术界提供理论基础,业界推动应用落地 是,但是实际上正好反过来,业界其实创新在前,学术界才确认理论。 最近,麻省理工学院、康奈尔大学、华盛顿大学和微软研究院的学术人员开发了一个叫“通过自我对弈进行强化学习”(简称RLSP)的系统。这个系统可以教那些大型的语言模型花更多时间去解决问题。这个方 icon
  • OpenAI的草榴机器人发推特说:硅谷的泡沫人生活在泡沫中。 他们醒来,喝着[url= icon
  • 这个frames_of_mind框架(点击标题)可以让DeepSeek[url= 可以通过以下方式可视化R1的“思维过程”: [list] [*]把思想的链条保存为文本 [*]使用OpenA icon
  • Deepseek 的语言模型即使定价远低于 OpenAI 也能带来巨额利润 中国的人工智能公司DeepSeek最近发布了一些数据,告诉我们人工智能语言模型其实可以赚很多钱,就算价格比OpenAI低很多也没问题。 DeepSeek很少公开自己的AI服务成本和能赚多少钱,但这次他们透露了一些信息。数据显 icon
  • 2025 年将是人工智能的疯狂时代:2025 年是人工智能发展的疯狂一年。就在去年,ChatGPT、Claude 和 Gemini 还是人工智能发展的主角。 现在?我们有一场人工智能大战,每个人都在 Deepseek、Kimi、Meta、 icon
  • icon
  • [img]data:image/jpeg;base64,/9j/4AAQSkZJRgABAQAAAQABAAD/4gHYSUNDX1BST0ZJTEUAAQEAAAHIAAAAAAQwAABtbnRyUkdCIFhZWiAH4AABAAEAAAAAAABhY3NwAAAAAAAAAAAAAAAAAA icon
  • Perplexity Deep Research 在 Humanity Last Exam Benchmark 上与 OpenAI o3 相当接近,第二名。但是速度快了一个数量级且成本更低。这是因为 DeepSeek 是开源的,而且成本低廉且速度快。 1. 性能对比 icon