Dojo
话题
新佳
订阅
极道
元认知
元逻辑
元设计
元编程
元语言
DeepSeek时刻
RTX 5060 Ti 16GB:本地AI性价比之王
我对在本地运行大型语言模型 (LLM) 的可能性感到兴奋。我决定为此买一张显卡,并想分享我使用 NVIDIA RTX 5060 Ti 16GB 的初步体验。简单来说,这是我的第一张专用显卡。我之前没有任何对比数据,所以一切对我来说都比较陌生。 我在迈阿密购买的技嘉 GeForce RTX 5060
阿里Qwen3暴打Claude3.7!代码实测封神
Qwen 3系列模型在编码任务中展现出了令人印象深刻的性能,特别是在Aider基准测试中表现优于编程王者模型Claude 3.7。 这个叫Qwen3的AI大模型可不得了!最新比武大会上,它家那个2350亿参数的"巨无霸"版本,在写代码比赛里居然干翻了[url=
本地AI:Qwen3+Unsloth=2倍速+少70%显存
Qwen3 现已在 Unsloth 中进行微调 - 速度提高 2 倍,VRAM 减少 70% [url=
DeepSeek新动向:DeepSeek-R1-0528
DeepSeek官方发布了一份声明,声称进行了升级,可能是类似于0324版本的新型号 网友充满期待等待DeepSeek新版本发布:DeepSeek-R1-0528 1、我喜欢DeepSeek保持低调的方式。它只是发布了另一个版本号,没有在上面大做文章。 2、他们不得不这样做,
苹果M3 Ultra对决:Qwen3完胜4大模型
[基准测试] 在 Mac Studio M3 Ultra 512 GB (LM Studio) 上对 5 种型号进行快速测试 – Qwen3 表现优异。 我曾是一名大学物理讲师(教了五年书),在购买 Mac Studio(M3 Ultra、128 CPU/80 GPU 核心、512 GB 统一 RA
阿里Qwen3全家桶炸场:小模型大能量
阿里千问发布超强AI大脑全家桶——Qwen 3!这次一口气放了8个型号,从迷你款(0.6B)到巨无霸(235B)全都有! [img]data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAAAfQAAAEZBAMAAACTIsrlAAAAGFBMVEX////29f
Qwen3-8B:本地推理小钢炮
Qwen3 是一个“推理”模型,所以它每个提示都以一个包含其思维链的区块开头。 Qwen3就是个爱动脑筋的'小机灵鬼'!每次你问它问题,它都会先在心里默默嘀咕一阵(就是那个标签里的内容),把解题步骤都想明白了才回答你。 我发现 Qwen3-8B 也出人意料地擅长做一些有用的事情: 它可以
DeepSeek Prover:数学证明自动化
同学们注意啦!DeepSeek搞了个数学证明界的"解题小霸王"——DeepSeek-Prover-V2!这就像给电脑装了个超级数学大脑,而且还是开源的(敲重点:不要钱随便用!)。 DeepSeek-Prover-V2是: 一种专门为Lean4中的定理证明而设计的语言模型 在DeepSeekMath-
Deepseek王者归来:世界第四大智能AI
DeepSeek R1型号进行了小版本升级,当前版本为DeepSeek-R1-0528。 改进基准性能 增强的前端功能 减少幻觉 支持JSON输出&函数调用 在最新的更新中,DeepSeek R1通过利用增加的计算资源和在后期训练中引入算法优化机制,显着提高了推理深度和推理能力
中国开源AI遭封杀:西方公司的科技洁癖
(拍黑板)同学们注意啦!今天咱们要聊一个特别魔幻的现实故事——关于那些宁可把"中国制造"的AI模型供起来吃灰,也不敢用的西方公司!(粉笔头砸中打瞌睡的小明) 第一幕:AI界的"文具歧视" 想象你书包里有支超好用的中国产钢笔(敲黑板),但班主任死活不让你用,非说笔水里藏着秘密情报!现在欧美公司看Qwe
国产小模型Qwen3暴打谷歌Gemini!
小语言模型本地AI能否干翻谷歌大模型Gemini 2.5?实测7款"野生学霸"表现! 参赛选手小模型名单: 通义千问Qwen 3 1.7B 小不点 通义千问Qwen3 4B 三好生 通义千问Qwen3 8B Q6 课代表 通义千问Qwen 3 14B Q4 学霸 谷歌Gemma3 4B 普通生 谷歌
沙特狂买1.8万AI芯!DeepSeek建算力中心
沙特土豪联手AI巨头搞大事!18000块顶级AI芯片即将落地沙漠王国! (前方高能!用最接地气的方式带你吃瓜这个科技大新闻) 1️⃣ 沙漠里的AI超级工厂 沙特国有公司HUMAIN(可以理解成"沙特国家队")周二和显卡大佬英伟达勾肩搭背宣布:要在沙漠里建AI兵工厂!首期就砸下18000块最新款GB3
推理大爆发!DeepSeek-R1立大功
如果说OpenAI就像班里第一个解出奥数题的学霸,那么,但咱们国产的Deepseek-R1直接秀出了更骚的操作——用更少的草稿纸(训练资源)写出了更牛掰的解题步骤!(粉笔头敲重点) 这个中国智造的小天才才出道四个月,就靠"最强大脑"技能火出圈了!连扎克伯格都连夜组了"抄作业小组"(Meta专门团队)
你敢告诉DeepSeek的事,绝不会去百度搜
ChatGPT就像个超级舒服的树洞!你偷偷跟它说小秘密(比如暗恋谁啊/作业没写啊)比去百度搜东西自在多了——就像躲在被窝里说悄悄话 vs 站在操场上用大喇叭喊话。 为啥呢?因为ChatGPT的设计让你感觉像在个小黑屋里说秘密,特别有安全感。所以啊,就算把Gemini这种AI硬塞进普通搜索引擎(就像把
51篇论文证明:AI让学生更聪明
ChatGPT这个AI学霸助手到底靠不靠谱?《自然》一篇论文扒了51篇论文告诉你答案! 最近ChatGPT这个AI聊天机器人可太火了,同学们不是拿它写作业就是问问题。但老师们都在纠结:这玩意儿真能帮学生提高成绩吗?会不会让学生变懒?我们研究团队当起了"学术侦探",把2022年底到2025年
5美分虐哭AI!开源测试让模型现原形
这个"SOLO Bench"测试有多变态! 这玩意儿是个专门折磨AI的"造句地狱"——让AI用大约4000个单词的词库,硬憋出250个句子!每个句子必须严格4个单词,还得符合特定语法格式。最狠的是:每个单词全篇只能用一次!(比如"apple"用过一次后,其他249个句子都不准再出现) 而且AI必须纯
Qwen3治好了AI的"满嘴跑火车"病
我跟你们说个超神奇的事儿!Qwen3这回居然把AI乱编瞎话的老毛病给治了!我每次测试新AI都像老师抽查背书一样,专门让它背法语德语的名诗。结果你猜怎么着?这个2350亿参数的Qwen3明明个头不够大(要知道背欧洲诗歌起码得6000亿参数的大块头),还是个"偏科生"模型(MoE技术让它不能同时用全部脑
微软Phi4推理plus版数学击败DeepSeek R1
微软刚刚在 HF 上发布了基于 Phi4 架构的[url=
上页
下页