<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>好文摘译 on mayulu的AI笔记</title><link>https://mayulu.co/categories/%E5%A5%BD%E6%96%87%E6%91%98%E8%AF%91/</link><description>Recent content in 好文摘译 on mayulu的AI笔记</description><generator>Hugo</generator><language>zhcn</language><copyright>Copyright © 2025–2026 mayulu All Rights Reserved</copyright><lastBuildDate>Sat, 08 Aug 2026 10:48:06 +0800</lastBuildDate><atom:link href="https://mayulu.co/categories/%E5%A5%BD%E6%96%87%E6%91%98%E8%AF%91/index.xml" rel="self" type="application/rss+xml"/><item><title>异星心智</title><link>https://mayulu.co/posts/an-alien-mind/</link><pubDate>Mon, 07 Sep 2026 11:17:23 +0800</pubDate><guid>https://mayulu.co/posts/an-alien-mind/</guid><description>OpenAI 首席科学家 Jakub Pachocki《异星心智》一文警示，具备递归自我改进能力的 AI 雏形已然出现，智能正沿着算力驱动的路径快速演进。AI 是培育而非设计出来的系统，内部涌现机制难以完全解析，对齐分为目标对齐与价值对齐两大维度，现有对齐手段存在泛化短板，思维链监控等验证方案也面临效能衰减风险。超强 AI 既可以构筑网络安全防御，也可能催生恶意自主智能体。作者认为尚无实验室具备全速扩模的完备安全能力，呼吁行业主动减速，建立强制安全门槛与国际协同机制，确保人类保留在 AI 自我改进闭环中，掌控技术转型的主动权。</description></item><item><title>Sebastian Raschka 对 Kimi K3 架构的观察笔记要点</title><link>https://mayulu.co/posts/rasbt-kimi-k3-arch/</link><pubDate>Wed, 29 Jul 2026 08:53:39 +0800</pubDate><guid>https://mayulu.co/posts/rasbt-kimi-k3-arch/</guid><description>本文全文翻译 Sebastian Raschka 解读的开源超大模型 Kimi K3 架构，该模型由 48B 参数扩容至 2.8T，沿用前代 Kimi Linear 核心设计，新增 LatentMoE 提升效率，搭配多头隐注意力、注意力残差模块优化性能。模型摒弃 RoPE，全域采用 NoPE，原生支持多模态；该设计小幅提升任务效果，仅轻微增加训练与推理开销，是兼顾性能与效率的前沿大模型。</description></item><item><title>注意力机制其实是对数复杂度-重新思考计算复杂度</title><link>https://mayulu.co/posts/attention-is-logarithmic/</link><pubDate>Wed, 22 Jul 2026 07:56:01 +0800</pubDate><guid>https://mayulu.co/posts/attention-is-logarithmic/</guid><description>本文提出 Work-Depth 工作量 - 深度模型，指出传统时间复杂度不适用于多核并行硬件，以张量、矩阵乘、Softmax 等算子逐层推导，论证标准 Transformer 注意力机制并行计算深度为对数计算复杂度O(logn)。文章拆解各类深度学习基础运算并行瓶颈，分析缓存溢出导致实际性能退化的原因，结合 FlashAttention 分块思路给出工程解释，同时探讨该理论对 GPU、AI 芯片等下一代算力硬件设计的指导价值，适合大模型、高性能计算从业者阅读。</description></item><item><title>你和你的研究 - 理查德.汉明那场经典演讲的完整记录</title><link>https://mayulu.co/posts/you-and-your-research/</link><pubDate>Mon, 20 Jul 2026 08:10:27 +0800</pubDate><guid>https://mayulu.co/posts/you-and-your-research/</guid><description>本文完整整理图灵奖得主理查德・汉明 1986 年经典演讲《You and Your Research》全文，含主讲介绍、演讲正文、问答与汉明生平荣誉。汉明结合贝尔实验室、洛斯阿拉莫斯从业经历，剖析顶尖学者产出里程碑成果的核心特质：深耕核心课题、持续深度投入、开放交流、转换视角化劣势为优势，同时分享课题选择、成果推广、规避性格短板等实操科研方法论，适合科研人、研究生研读。</description></item><item><title>循环工程：Claude官方入门指南</title><link>https://mayulu.co/posts/loop-engineering-anthropic/</link><pubDate>Tue, 14 Jul 2026 15:41:33 +0800</pubDate><guid>https://mayulu.co/posts/loop-engineering-anthropic/</guid><description>本文解读 Anthropic Claude Code 官方循环工程指南，定义智能体循环为重复迭代至达标，划分回合、目标、时间、主动四类循环，详解`/goal`、`/loop`、`/schedule`指令用法与适配场景，配套技能文件、多智能体评审等代码质量保障方案，提供轮次、调度、模型选型等 Token 成本管控手段，附选型对照表，适合 AI 编程、智能体自动化开发从业者学习落地自主工作流。</description></item></channel></rss>