• 卡帕西用最原始的Python代码,从自动求导引擎开始,手写一个完整的GPT模型,实现训练、优化、推理与文本生成全过程,结构极简,逻辑透明,是理解大模型底层机制的绝佳范本。 这一整份代码干了一件非常燃的事:用最朴素的Python语法,从零开始,手工造一个可以训练
  • 本文逐步演示如何用Python从零构建具备持久记忆、多平台同步、工具执行、权限控制、定时任务和多代理协作的AI私人助理,完整复现OpenClaw核心架构,附可运行代码与文件结构。 你也能造出“AI私人管家”!直接上代码、上命令、上文件结构,一步一步从最简单的“会回消息的机器人”开始,慢慢给它加上记忆
  • Localsandbox 是一个轻量级开源库,为 AI 代理提供隔离的虚拟文件系统、安全的 Bash 执行环境和沙箱化的 Python 代码运行能力,基于 AgentFS、just-bash 和 Pyodide 构建,让代理在本地也能拥有类似虚拟机的自主操作权限,同时避免破坏真实系统。 智能体从只会 icon
  • DeepSeek员工刚刚开源了nano-vllm ,点击标题。 它是一个从头开始构建的轻量级vLLM实现。 关键特征 [list] [*]快速离线推理-与vLLM的推理速度相当 [*]易读的代码库-在约1,200行Python代码中实现干净 [*]优化套件-前缀缓存,张量优化,火炬编译,C icon
  • AMD发布ROCm 7.11.0技术预览版,采用全新TheRock构建系统实现模块化架构,支持从数据中心到边缘设备的统一GPU编程体验,开源生态涵盖PyTorch、Kubernetes等主流框架,为AI开发者提供低成本高灵活性的CUDA替代方案。 AMD(超威半导体公司)终于开窍了 icon
  • Python正在变成编程界的拼音,你还学不学? 文章讨论人工智能写代码对 Python 未来的影响,提出 Python 可能从主要开发语言转变为教学工具,类似拼音之于汉字。核心观点包括输出语言不再重要、开源维护面临挑战、Python 仍是入门最佳选择。 很多人不知道中国小孩学汉字前先学拼音。拼音用拉 icon
  • 深度对比vLLM与TensorRT-LLM在5000亿参数模型上的实测表现,揭示性能优势背后的运维代价,提供生产部署决策框架。 AI推理界的"华山论剑"——vLLM和TensorRT-LLM到底谁才是5000亿参数大模型的真命天子? vLLM像是一辆改装性能车,随时能调参数、换轮胎、改悬挂,适合那些 icon
  • Astral一直在开发这个“用Rust编写的极快的Python类型检查器和语言服务器”,虽然很安静,但已经公开了一段时间。这是PyPI上的第一个alpha公开发布版。 As icon
  • 详细拆解了在NVIDIA H100 GPU上从零开始优化矩阵乘法(GEMM)的全过程。通过七个渐进式内核,生动展示了如何从最原始的全局内存访问,逐步运用共享内存分块、寄存器分块、向量化加载、填充避冲突等技巧,并最终驾驭Tensor Core与TMA等Hopper架构黑科技,实现逼近甚至超越cuBLA icon
  • OpenAI 宣布收购 Astral 及其明星工具 uv、Ruff,引发社区激烈辩论。开发者担忧工具商业化、维护停滞及 AI 强制植入,但也讨论了开源许可证的保护作用及社区分叉的可能性。 2026 年 3 月 19 日OpenAI 官宣要收购 Astral,也就是那个开发了 Python 界超级明星 icon
  • 这一篇从基本原理翻译讲清楚CUDA是让程序员主动管好并行工作、数据搬运和内存访问。它的性能关键在内存访问模式、线程并行覆盖等待、分块合作重用数据等,而不是简单“更多线程”。 ### 为什么过去CPU自动加速终结了 很久以前电脑之所以变快,是因为CPU主频不断提高,同样的代码跑得更快。这时候程序员根本 icon
  • 你还在用 ORM?2026 年最潮数据库玩法是“裸奔+数据类”! 话说,编程圈里有个老规矩:写代码连数据库,得靠 ORM。 啥是 ORM?就是那种能把数据库里的表格自动变成你代码里“对象”的魔法工具。比如你查一个订单,ORM 就会给你返回一个 Order 对象,你 icon
  • Pandas 3.0以稳定优先哲学问世,Copy-on-Write机制彻底根除SettingWithCopyWarning,pandas.col表达式解放链式写法,可插拔UDF引擎引入JIT加速,Arrow字符串采用环境自适应的折中策略,老用户无痛升级新用户需权衡Polars。 Pandas 3.0 icon
  • 一个可用于生产的模板,用于启动您的生成式AI项目,并考虑到结构和可扩展性。 一个生产就绪的模板,帮助您启动和组织生成式AI项目,并考虑清晰度和可扩展性。旨在减少早期开发中的混乱,并通过经过验证的结构和实践支持长期可维护性。 项目目录结构 generati icon
  • 技术迁移真实案例:三个月,一个人,砍掉90%服务器成本! 我们换了套技术,服务器账单直接打了一折 Wasmer团队将一个运行了七年的Django后端用Rust完全重写。重写后,CPU从220核降至24核,内存从800GB降至64GB,数据库连接数减少3-5倍,查询延迟提升5-10倍。本文详细记录了迁 icon
  • 我在Cursor摸爬滚打学到的血泪经验!手把手教你用AI搞开发,看完绝对不踩坑! [b]1️⃣ 项目起手式:先问清楚再干![/b] 重要警告:别像我一样傻乎乎直接开干!先抓着AI问明白: icon
  • Furiosa没有制造一块“更快的GPU”,而是试图让AI芯片直接理解神经网络本身,而不是理解矩阵乘法。 过去十几年,几乎所有AI加速器都建立在同一个假设之上:矩阵乘法(Matrix Multiplication,MatMul)才是人工智能计算最核心的基础操作。因此,无论是NVIDIA GPU的Te icon
  • 这张图片通过对比“期望”和“现实”来幽默地展示了机器学习编译器和硬件支持的实际情况。 [img]data:image/jpeg;base64,/9j/4AAQSkZJRgABAQAAAQABAAD/2wBDABMNDhAODBMQDxAVFBMWHC4eHBoaHDkpKyIuQztHRkI7QUB icon