Dojo
话题
新佳
订阅
极道
元认知
元逻辑
元设计
元编程
元语言
大语言模型LLM
“幻觉”反而是大语言模型最有用之处
来自黑客新闻(Hacker News)的一个讨论帖子,主题是关于一个名为"Lamini"的人工智能记忆调整技术,它能够显著减少幻觉10 倍 在AI领域,幻觉通常指的是模型生成的错误或不准确的输出
经典论文:《注意力就是你所需要的》
Vaswani 等人在 2017 年发表的论文《注意力就是你所需要的》介绍了 Transformer 架构,这是近年来人工智能研究和进步蓬勃发展的关键驱动力
ARC奖:价值100万美元以上开放式AGI竞赛
ARC-AGI 的设计初衷是抵制大语言模型“记忆”技术 我们举办本次比赛的目标是: 1. 增加从事前沿 AGI 研究的研究人员数量(而不是修补 LLM)。我们需要新的想法,解决方案很可能来自局外人! 2. 建立一个流行的、客
柏拉图洞穴寓言 vs. AI表征假说 vs. 表观遗传
柏拉图的洞穴寓言是一个哲学思想实验,首次出现在他的著作《理想国》中。用来说明人类认知和现实之间的关系。 什么是柏拉图洞穴寓言?一群人从出生起就被囚禁在一个洞穴里,他们背对着洞口,只能看到洞穴的墙壁。在他们的背后,有
为什么大语言模型能将我们带入AGI?
杨立昆(Yann LeCun)提出,大型语言模型(LLM)并不能引领我们走向人工通用智能(AGI),因为它们缺乏形成心智模型的能力。尽管如此,一些观点认为LLM与人类智能的比较存在根本性的缺陷。 人类智能与LLM的比较分析 人类智能
语言主要是一种交流工具,而不是思维工具
《自然》杂志发表的题为《语言主要是交流工具而非思考工具》的文章探讨了语言在人类认知中的作用。
大模型缺乏基本推理能力?
本文探讨了大模型的戏剧性崩溃:面对一个简单的常识问题,称为“爱丽丝梦游仙境(AIW)的问题”,最先进的大模型推理能力面临崩溃。 尽管这些大模型在标准化推理基准上表现出色。关键是,目前这些LLM缺乏基本的推理能力,而现有的基准无法正确检测这些缺陷。<
本周17个github有趣项目Teo等
17个github有趣的项目、工具和库 1、Teo
笛卡尔:语言是思想唯一确定标志?
笛卡尔认为语言是思想的唯一确定标志,因为只有人类才能通过语言自由地表达思想,这是人之为人的根本特征。 笛卡尔认为: 人类个体,不管是愚蠢的人、白痴还是最笨的小孩,都能够通过语言表达和交流思想。 人类的行为是自由的,人类能够通
幻觉与创新:AlphaFold3为何失败?
AlphaFold3 是一个技术杰作: 它减少了多序列比对的使用(需要使用相似的例子来预测蛋白质相互作用),并引入了一个新的扩散模块来进行结构预测。 换句话说: 他们在提
从 GPT-4 到 AGI:计算OOM
本文讨论了人工智能的快速发展以及在不久的将来取得重大进展的潜力。以下是要点: 过去的AI进展: “#有效加速主义 计算”的增加已经导致模型性能在几年内和许多数量级(OOM)的一致增长。 GPT-2类似于学龄前儿童的智力水平,
苹果绝技:理解屏幕
每个人都在期待一个重生的Siri,Ferret-UI来了! Ferret-UI:一个多模态视觉语言模型,它可以理解iOS移动的屏幕上的图标、小部件和文本,以及它们的空间关系和功能含义。 您可以向Ferre
使用 Rust、OpenAI 和 Qdrant 构建 Agentic RAG
在本文中,我们将讨论如何使用 Rust 构建代理 RAG 工作流!我们将构建一个代理,它可以获取 CSV 文件、对其进行解析并将其嵌入到 Qdrant 中,以及从 Qdrant 中检索相关嵌入以回答用户有关 CSV 文件内容的问题。 有兴趣部署还是只想看看
大模型内部有一个平面和直边构成的几何对象
论文《大型语言模型中的分类和层次概念的几何形状》研究了如何在大型语言模型 (LLM) 的嵌入空间中表示分类和层次概念。 并且在 Gemma LLM 上验证了这些理论结果,估算了 WordNet 中 957 个层次相关概念的表示。 研究结果揭示了大模型 编码语义中蕴含非常简单的
Claude 3.5:大模型王者
大语言模型能用作世界模拟器吗?
语言模型可以被用作世界模拟器吗? 在我们的ACL 2024论文中,我们证明了这不是真的。 GPT-4在模拟基于常识任务(如沸水)的状态变化时,准确率仅为60%。 该论文题为 "语言模型能否作为基于文本的世界模拟器?
Llama 3:Meta新AI模型
Llama 3拥有卓越的自然语言处理 (NLP)功能,使Meta AI能够提供更智能的帮助、更丰富的搜索结果,甚至生成创意文本格式。准备好迎接前所未有的 AI 体验
MatMul:一种革命性的语言模型方法
一种革命性的语言模型方法,完全消除矩阵乘法 (MatMul),同时又不损失性能 论文《可扩展的无 MatMul 语言建模》讨论了如何开发可扩展且高效的语言模型,从而避免矩阵乘法(MatMul) 运算。 在这项工作中,我们表明 Mat
上页
下页