Dojo
话题
新佳
订阅
极道
元认知
元逻辑
元设计
元编程
元语言
DeepSeek时刻
DeepSeek秘诀:能在学习过程中突然顿悟!
DeepSeek 的研究发现,模型在强化学习(RL)训练中,经过多次迭代后,会突然开始生成思维链,并显著提升在数学等复杂任务上的表现。 [b]什么是[url= 如果让大型语言模型(LLM)先“想一想”
Deepseek r1与OpenAI o1比较评测总结
DeepSeek 通过 r1 实现了令人难以置信的成就,这可能是自 GPT-4 以来最重要的 AI 发布:一个开源的、MIT 许可的推理模型,可与 OpenAI 的旗舰产品 o1 相媲美,这在几个月前是不可想象的。 DeepSeek 推理(测试时计算)模型有两种: DeepSeek-R1-Zero
杨立昆退休?中国Deepseek超Llama 4触发Meta内部恐慌
昨天,人工智能领域发生了一些事情:杨立昆领导的Meta 生成式人工智能部门(Meta genai org)陷入了恐慌模式。 杨立昆是 Meta(原 Facebook)的首席人工智能科学家,同时也是纽约大学的教授。杨立昆因其在深度学习领域的开创性工作而获得了图灵奖(Turing Award),这是计算
DeepSeek极端榨取硬件性能被曝光
DeepSeek 的出现是否意味着前沿 LLM 开发不再需要大规模 GPU 集群? 简单来说:不是的。虽然 DeepSeek 的 V3 模型通过一些非常厉害的优化技术,让 GPU 的使用效率变得更高了,但这并不意味着像 Google、OpenAI、Meta 和 xAI 这些公司之前花大钱搞的大规模
中国大模型DeepSeek-R1性能与OpenAI-o1不相上下
DeepSeek-R1来了!性能与OpenAI-o 1相当,便宜30倍,甚至在几乎所有的基准测试中都优于Claude 3.5 Sonnet和o 1-mini! MIT许可:Distill免费商业化!网站API现已上线! DeepThink就在今天已经开放:
DeepSeek-R1如何用极简参数实现OpenAI级推理?
DeepSeek-R1:是如何让 OpenAI 级别的推理模型如此高效的? 最近我们都看到了关于 DeepSeek-R1 的讨论。它取得了一些惊人的成绩,在推理任务中经常匹敌甚至超过 OpenAI 的 o1 系列……而且它只用一小部分参数和低得多的成本就做到了。所以,自然而然地,我不得不深入研究他们
DeepSeek不是英伟达的终结者
最近中国AI创业公司深度求索(DeepSeek)火了,他们搞的DeepSeek 3模型用更少的电脑算力就达到了和OpenAI差不多的水平,还省了好多钱。这下子好多投资人慌了,担心这会影响英伟达(NVIDIA)卖高端显卡的生意——毕竟现在训练AI都得用他们的顶级显卡。 不过这种担心有点太着急了,我给你
DeepSeek成功背后是宽客精神
DeepSeek之所以能如此迅速地击败其他公司,是因为他们都是[url=
下一个TikTok,美国可能会封禁DeepSeek!
忘记 TikTok:美国可能需要禁止 DeepSeek-V3! Scale AI 公司的老板 Alexandr Wang 说,过去十年里,美国在人工智能(AI)比赛里可能一直比中国厉害,但到了圣诞节那天,情况变了。他的公司给 OpenAI、谷歌这些大 AI 公司提供训练数据。 他还提到 Meta 公
DeepSeek强化学习被复制成功
DeepSeek就像打破了“四分钟跑一英里”的纪录一样,做了一件大家以前觉得不可能的事。突然之间,语言模型通过“RL强化学习”变得超级厉害,而且它的规模很小,小到一个博士生几天就能重新做出来,如下,今年肯定会很疯狂! 我们在CountDown游戏里重新做了[url=
英伟达暴跌17%!DeepSeek数次宕机
英伟达股价周一下跌17%,原因是投资者担心这家中国公司与OpenAI等竞争对手相比,使用的英伟达芯片远少于美国公司。但DeepSeek周一也在努力适应新用户的涌入,数次出现网络瘫痪,无法访问。 英伟达达周一表示,中国的人工智能公司DeepSeek的进步证明了他们的芯片对中国市场很有用,而且未来会需要
上页