• DeepSeek 的研究发现,模型在强化学习(RL)训练中,经过多次迭代后,会突然开始生成思维链,并显著提升在数学等复杂任务上的表现。 [b]什么是[url= 如果让大型语言模型(LLM)先“想一想”
  • DeepSeek 通过 r1 实现了令人难以置信的成就,这可能是自 GPT-4 以来最重要的 AI 发布:一个开源的、MIT 许可的推理模型,可与 OpenAI 的旗舰产品 o1 相媲美,这在几个月前是不可想象的。 DeepSeek 推理(测试时计算)模型有两种: DeepSeek-R1-Zero
  • 昨天,人工智能领域发生了一些事情:杨立昆领导的Meta 生成式人工智能部门(Meta genai org)陷入了恐慌模式。 杨立昆是 Meta(原 Facebook)的首席人工智能科学家,同时也是纽约大学的教授。杨立昆因其在深度学习领域的开创性工作而获得了图灵奖(Turing Award),这是计算 icon
  • DeepSeek 的出现是否意味着前沿 LLM 开发不再需要大规模 GPU 集群? 简单来说:不是的。虽然 DeepSeek 的 V3 模型通过一些非常厉害的优化技术,让 GPU 的使用效率变得更高了,但这并不意味着像 Google、OpenAI、Meta 和 xAI 这些公司之前花大钱搞的大规模 icon
  • DeepSeek-R1来了!性能与OpenAI-o 1相当,便宜30倍,甚至在几乎所有的基准测试中都优于Claude 3.5 Sonnet和o 1-mini! MIT许可:Distill免费商业化!网站API现已上线! DeepThink就在今天已经开放: icon
  • DeepSeek-R1:是如何让 OpenAI 级别的推理模型如此高效的? 最近我们都看到了关于 DeepSeek-R1 的讨论。它取得了一些惊人的成绩,在推理任务中经常匹敌甚至超过 OpenAI 的 o1 系列……而且它只用一小部分参数和低得多的成本就做到了。所以,自然而然地,我不得不深入研究他们 icon
  • 最近中国AI创业公司深度求索(DeepSeek)火了,他们搞的DeepSeek 3模型用更少的电脑算力就达到了和OpenAI差不多的水平,还省了好多钱。这下子好多投资人慌了,担心这会影响英伟达(NVIDIA)卖高端显卡的生意——毕竟现在训练AI都得用他们的顶级显卡。 不过这种担心有点太着急了,我给你 icon
  • DeepSeek之所以能如此迅速地击败其他公司,是因为他们都是[url= icon
  • 忘记 TikTok:美国可能需要禁止 DeepSeek-V3! Scale AI 公司的老板 Alexandr Wang 说,过去十年里,美国在人工智能(AI)比赛里可能一直比中国厉害,但到了圣诞节那天,情况变了。他的公司给 OpenAI、谷歌这些大 AI 公司提供训练数据。 他还提到 Meta 公 icon
  • DeepSeek就像打破了“四分钟跑一英里”的纪录一样,做了一件大家以前觉得不可能的事。突然之间,语言模型通过“RL强化学习”变得超级厉害,而且它的规模很小,小到一个博士生几天就能重新做出来,如下,今年肯定会很疯狂! 我们在CountDown游戏里重新做了[url= icon
  • 英伟达股价周一下跌17%,原因是投资者担心这家中国公司与OpenAI等竞争对手相比,使用的英伟达芯片远少于美国公司。但DeepSeek周一也在努力适应新用户的涌入,数次出现网络瘫痪,无法访问。 英伟达达周一表示,中国的人工智能公司DeepSeek的进步证明了他们的芯片对中国市场很有用,而且未来会需要 icon