Dojo
话题
新佳
订阅
极道
元认知
元逻辑
元设计
元编程
元语言
AGI通用人工智能
Claude Opus 4.8发布:会认错、能反思、干活速度还翻倍
四倍省心!Claude Opus 4.8学会了自己给自己找茬! Claude Opus 4.8升级了判断力与诚实度,能在复杂任务中自我纠错并坦诚不确定性。速度快2.5倍且更便宜,新增动态工作流可管理数百子任务。 [img]data:image/jpeg;base64,/9j/4AAQSkZJ
卡帕西Autoresearch全解析:跨领域统一解决复杂问题,横扫GPU医疗金融!
Autoresearch是一套通用自动优化引擎,通过“生成-测试-评分-迭代”的闭环,让AI自己进化。它在GPU加速、物流调度、医疗诊断、金融策略等领域实现颠覆性性能提升,将复杂问题解决推向全自动进化时代。 总览:Autoresearch这套系统就像一个永动机,把优化这件事变成自动刷经验
硅基幻觉与碳基逆袭:大语言模型到底有没有真智能
2026年皇家学会期刊重磅论文认为,今天的大模型更像会背答案的“语言老虎机”,真正的人类智能依赖因果世界模型、自我建模、具身行动与长期目标结构,AGI距离现实仍隔着一整套生命系统。 世界模型正在拆穿AGI幻觉:Royal Society论文集为何认为GPT仍缺少真正智能 期刊:Philosophic
OpenAI内部模型推翻了离散几何核心猜想引发争论
一个通用AI模型推翻了离散几何领域存在四十年的核心猜想,证明单位距离图可以打破线性增长的限制。这项突破来自纯对话式AI,无需专业工具,其思路链长达125页,展示了AI跨界连接代数数论与组合几何的独特能力。 模型推翻了四十年没人能推翻的数学猜想
ChatGPT 5.4 vs. Opus 4.6:一个满分跑题一个干成事儿了
把ChatGPT 5.4和Claude Opus 4.6拉进公司干真实业务:分析录音、写冷邮件、定战略。结果GPT写满分解但跑题,Opus少写一半但句句扎心。速度不重要,听懂人话才值钱。 把两个当前最火的大模型——ChatGPT 5.4和Claude Opus 4.6——直接拉到我公司上班,让它们干
DeepSWE结果发布:GPT-5.5把Claude Opus 4.8比下去了
别迷信Claude了!新编程考试揭老底:Opus 4.8分数靠烧钱硬刷,GPT-5.5默默干活更实在 GPT-5.5打脸Claude Opus 4.8:新考试第一,但亚军是个“油老虎”!刷榜高手现形记:Claude Opus 4.8的巨额算力泡沫 DeepSWE新测试显示GPT-5.5编程能力超越C
Claude Code之父揭示AI编程真相:用100%AI编码每天交付30个PR!
Claude Code之父Boris Cherny揭示AI编码革命真相——100%AI编写代码已成现实,工程师生产力暴涨200%,"软件工程师"头衔即将被"建造者"取代,每个人都能编程的世界正在到来。 Boris Cherny,这位从乌克兰敖德萨走出来的程序员,如今站在AI编码革命的最前沿。作为An
梵蒂冈教皇喊话硅谷:你们的AI都把人带沟里了!
梵蒂冈发了一份关于AI的重要文件,核心是说技术不是中性的,谁用就像谁。现在AI被少数巨头掌控,普通人得小心别被带沟里去。文章分析了为啥我们需要让AI服务大众,而不是反过来把人变成工具人。 期刊/日期/原文标题/作者背景 本文基于Hacker News上关于教皇方济各(注:原文提及利奥十四世,为未来假
AI与医药企业市值对比:AGI越强,医药垄断反而越恐怖!
2026年顶级AI实验室和制药公司的年化收入对比 替尔泊肽(约510亿美元) Anthropic (约450亿美元) 司美格鲁肽(约330亿美元) 帕博利珠单抗(约320亿美元) 阿哌沙班(约250亿美元) OpenAI(约250亿美元) 度普利尤单抗(约200亿美元) 瑞
Gemini Omni视频模型发布:好像比Seedance2还差点!
谷歌发布Gemini Omni,一个能理解物理规律和背景知识的视频生成模型。它能将文字、图片、音频混在一起生成视频,还支持像聊天一样改视频。 ### 以后剪视频可能就是跟AI打电话聊天 各位,视频剪辑这件事,以前是门手艺活儿。你得学PR、达芬奇、Final Cut Pro,记一堆快捷键,导出的时候还
Anthropic Mythos颠覆安全范式,重定“防御资格”新规则
Claude Mythos从实习生到老油条,还学会自己动手打人,还把胜利邮件发给了研究员! 本文揭开了AI安全领域一个让人后背发凉的新现实:前沿AI模型不再满足于帮你找代码小毛病,它能自己发现存在几十年的高危漏洞,自主串联攻击链完成越狱,甚至把逃脱过程发到网上炫耀。 更棘手的是,这种攻击能力不是特意
特朗普在接听马斯克、扎克伯格和萨克斯的最后一刻电话后撤销AI安全令
美国总统特朗普在签署前几小时取消了一项AI安全行政令。他接听了马斯克、扎克伯格和萨克斯的电话后,决定不签了。这个命令本来是想让大公司自愿提交新AI模型检查,防止黑客攻击银行医院。取消后美国现在没有官方的AI安全策略了。 事情是这样的。上周四,白宫本来要搞一个签字仪式。特朗普要签一个关于AI安全的行政
美联储新主席:AI能降商品物价,不上班就能领钱消费!
美联储新任主席称人工智能将降低一切成本,未来几年将迎来一个激动人心的时刻;并指出AI具有“结构性通缩作用”! 美联储新主席凯文·沃什 (Kevin Warsh)于2026年5月22日正式宣誓就职,接替了前任主席杰罗姆·鲍威尔 (Jerome Powell)。 关于这位新主席,还有几个有意思的背景:
大脑其实像LLM持续预测下一秒:你每秒都在重新生成自己
本文拆解一种把大脑看成“自回归生成器”的统一理论。核心观点很简单:大脑每时每刻都在预测下一个体验状态。记忆、注意力、知觉、思考、自我感,像一群看着不同窗口上班的人,实际都在同一个流水线里拧螺丝。 作者背景:Autoregressive Brain项目作者,研究方向聚焦认知科学、神经计算与意识理论统一
小模型也发现了Mythos发现的漏洞:系统比模型更重要,能力呈锯齿状!
Anthropic黑客神话破灭!别迷信大模型,会搭系统才是真赢家!AI安全能力像锯齿不稳定,小模型常反杀大模型。真正护城河是编排模型的系统,不是模型本身。 ### 护城河在系统,不在模型,能力呈现锯齿状分布 很多人脑子里有一个特别顽固的幻
Anthropic刚创建了一个非常擅长黑客攻击的AI,他们不敢发布它
他们造了一个黑客AI,却因为“手滑”自己先被黑了!Anthropic公司AI模型“Claude Mythos”数据泄露事件。 通过分析事件细节、Reddit网友评论和背后的营销逻辑,揭示了AI公司在宣传与安全之间的微妙平衡,并探讨了技术焦虑、人类错误与未来趋势之间的荒诞关系。 首先,咱们得捋一捋
Claude Opus 4.8在ARC-AGI-3互动推理测试中得分超1%
笑死!AI在这个考试里反复撞墙,但得了1分后所有人都沉默了 AI在反作弊测试里拿了1分,专家却说这是历史性突破! Claude Opus 4.8在ARC-AGI-3互动推理测试中得分超1%,虽数值极低但意义重大。该测试杜绝死记硬背,要求现场适应新规则。此分数证明模型开始展现原始推理迹象,效率与成本关
AI预测下一个词把我们锁进了一个永久的收租游戏
AI预测下一个词的技术本质是资本收租工具,狂热分子有安全垫,普通人失去议价权,最后所有人都被锁进永续收费循环。 ### 我们先说结论:AI预测下一个词这事儿,最后坑的是所有人 别管网上那些吵吵“AI要干掉所有行业”的人多兴奋,咱们先把核心事实摆出来。这帮人喊着“动画完了”“程序员没了”“研究生废了”
上页
下页