AI 日报

ARTIFICIAL INTELLIGENCE DAILY

🤖 AI 日报 · 2026年3月30日 早


【Twitter/X 热议】

1️⃣ Anthropic 意外泄露 Claude Mythos 模型,已开始 Beta 测试 Anthropic 因 CMS 配置失误,意外泄露了尚未正式发布的新模型"Claude Mythos"(内部代号 Capybara)。这是一个全新的模型层级,定位比目前最强的 Opus 系列还要更大更强。Fortune 率先发现并核实了存储在公开缓存中的草稿文档。随后 Anthropic 迅速反应,Mythos 5.0 Beta 已开始向部分用户推送。早期测试显示,Mythos 在软件编程、学术推理、网络安全等基准测试中得分明显高于 Opus 4.6,导致网络安全相关企业股价普遍下跌 4% 以上。社区反应热烈,被称为"你爷爷一发模型,我爷爷股价就暴跌"。 🔗 https://x.com/i/status/2037934153736323533

2️⃣ Sam Altman 宣布 Stargate 密歇根数据中心开建 OpenAI CEO Sam Altman 宣布,与 Oracle 和 Related Digital 合作的 Stargate 密歇根站点本周已竖起第一根钢梁。这标志着 OpenAI 大规模算力基础设施建设进入实质阶段,是美国 AI 产业"算力军备竞赛"的重要里程碑。该项目旨在为下一代 AI 模型训练提供海量算力支持。推文获得近 7000 点赞和超过 115 万次浏览,业界高度关注。Altman 同时分享了用户用 ChatGPT 设计 mRNA 疫苗方案拯救宠物狗的感人故事,展示 AI 在生命科学领域的潜力。 🔗 https://x.com/i/status/2037610000122839116

3️⃣ Karpathy 发推引发 LLM 辩论反思,AutoResearch 持续火热 Karpathy 发推分享了一个有趣经历:用 LLM 花 4 小时精心打磨一篇博客论点,自我感觉极佳,结果让 LLM 反过来论证相反观点,瞬间被说服了。这条推文获得近 3 万点赞,引发社区对 LLM "说服力幻觉"的广泛讨论。同时,他上月开源的 AutoResearch 项目持续走红,已有人将其 loop 机制应用到 8 个完全意想不到的领域,从自动化科研实验到药物发现,展现了 Agent 自主研究范式的巨大潜力。 🔗 https://x.com/i/status/2037921699824607591

4️⃣ Dario Amodei 发文呼吁 AI 安全与政府合作 Anthropic CEO Dario Amodei 发表长文,强调 AI 将帮助发现新科学(如疾病治愈方案),这是长期提升生活质量最重要的途径。但他同时警告,AI 也将带来新的社会威胁,没有任何一家公司能单独应对,需要政府层面的协调合作。此前他发布的关于"技术青春期"的万字长文讨论 AI 对国家安全、经济和民主的风险,获得超过 1.5 万点赞和 600 万次浏览,是近期最受关注的 AI 安全类文章之一。 🔗 https://x.com/i/status/2036488680769241223

5️⃣ 宝玉:Claude Cowork 重大更新,新增电脑操控能力 知名科技博主宝玉(@dotey)报道了 Claude Cowork 的重磅更新:新增电脑操控(Computer Use)、手机派任务(Dispatch)和定时任务三大能力。这意味着 Claude 不再只是对话助手,而是真正能操作你的电脑执行复杂工作流。此外,Claude Code 新增了 auto 模式,走中间路线让 AI 自主判断权限,既不需要逐次审批也不完全放开。宝玉的 baoyu-skills 项目也在 2 个月内突破 10K stars 和 19 万次安装,反映出 Agent Skills 生态的蓬勃发展。 🔗 https://x.com/i/status/2036202248238473607

6️⃣ Harness Engineering 兴起:AI Agent 从玩具走向生产级 开源项目 awesome-harness-engineering 引发社区关注,专注于 AI Agent harness 工程化的资源整理,包括架构约束、反馈回路、运行时 scaffolding 等。同时有开发者分享了让 Codex 和 Claude Code 在同一终端协作的实践——Codex 负责审核 Claude 写的代码,形成自动交互-修改-返工-通过的闭环。还有人实现了 Agent 无人值守稳定运行 4-8 小时的方案,关键不是"持续跑",而是让任务一轮轮往更好的方向收敛,在模型外面放一层控制层。这标志着 Agent 开发正从实验阶段迈向工程化。 🔗 https://x.com/i/status/2038222350085398608


【GitHub 热榜】

1️⃣ claude-mem — Claude Code 自动记忆插件 ⭐ 42.6K 由 thedotmack 开发的 Claude Code 插件,能自动捕获 Claude 在编码会话中的所有操作,用 AI(基于 Claude agent-sdk)进行压缩,并在未来会话中注入相关上下文。解决了 AI 编码助手"失忆"问题,让每次对话都能建立在之前工作的基础上。今日新增 373 stars,适合重度 Claude Code 用户提升开发连续性。 🔗 https://github.com/thedotmack/claude-mem

2️⃣ VibeVoice — 微软开源前沿语音 AI ⭐ 27.4K 微软推出的开源前沿语音 AI 项目,今日新增 1056 stars。定位为开源语音 AI 的最前沿,涵盖语音识别、合成和对话等核心能力。Python 实现,社区参与度极高,由微软研究团队维护。适合需要构建语音交互应用的开发者和研究人员,是目前开源语音 AI 领域最热的项目之一。 🔗 https://github.com/microsoft/VibeVoice

3️⃣ last30days-skill — 跨平台 AI 研究 Agent Skill ⭐ 15.4K 一个 AI Agent Skill,能自动在 Reddit、X、YouTube、Hacker News、Polymarket 和整个互联网上研究任意主题,然后生成有据可查的综合摘要。今日爆增 1308 stars,是当日增长最快的项目之一。基于 Python 实现,适合需要快速获取某领域近期动态的研究者和分析师。 🔗 https://github.com/mvanhorn/last30days-skill

4️⃣ learn-claude-code — 从零构建类 Claude Code Agent ⭐ 42.8K 由 shareAI-lab 出品的教学项目,口号是"Bash is all you need",从零到一构建一个类似 Claude Code 的 Agent Harness。TypeScript 实现,今日新增 919 stars。帮助开发者理解 AI 编码 Agent 的底层原理,包括命令执行、上下文管理、工具调用等核心机制。非常适合想深入理解 Agent 架构的工程师。 🔗 https://github.com/shareAI-lab/learn-claude-code

5️⃣ airi — 开源 AI 伴侣/虚拟偶像平台 ⭐ 36.4K moeru-ai 团队打造的自托管 AI 伴侣项目,支持实时语音聊天、Minecraft/Factorio 游戏、多平台客户端(Web/macOS/Windows)。灵感来自 Neuro-sama,目标是让用户拥有自己的 AI "灵魂容器"。TypeScript 实现,今日新增 224 stars,是虚拟偶像与 AI 伴侣赛道最活跃的开源项目。 🔗 https://github.com/moeru-ai/airi


【YouTube 热门】

1️⃣ Lex Fridman Podcast #490:2026 AI 全景对话 频道:Lex Fridman | 播放量:789,047 | 时长:4:25:13 Lex Fridman 这期超长播客全面覆盖 2026 年 AI 现状:LLM 发展、编码 Agent、Scaling Laws、中国 AI 竞赛、GPU 供应链、AGI 路线图等核心议题。嘉宾深入讨论了当前模型能力的实际边界、Agent 系统的工程化挑战,以及中美 AI 竞争格局的最新变化。作为该系列中观看量最高的 AI 主题之一,反映出公众对 AI 全景理解的强烈需求。适合需要系统了解 AI 行业现状的观众。 🔗 https://www.youtube.com/watch?v=EV7WhVT270Q

2️⃣ Bloomberg Tech:AI 如何重塑战场 频道:Bloomberg Technology | 播放量:20,314 | 时长:22:46 | 发布:2天前 Bloomberg 最新一期亚洲科技专题,深入报道 AI 在军事领域的最新应用,包括自主无人机编队、战场态势感知系统、以及 AI 辅助决策指挥链。节目分析了各国军方对 AI 技术的投入力度和伦理争议,特别关注了 AI 武器化带来的地缘政治影响。作为主流财经媒体的深度报道,提供了 AI 军事应用的权威视角。 🔗 https://www.youtube.com/watch?v=h9TqjOFceBk

3️⃣ ABC News Australia:AI 如何改变白领工作的价值 频道:ABC News (Australia) | 播放量:46,213 | 时长:2:43 | 发布:23小时前 最新发布的新闻报道,分析 AI 对白领职业市场的冲击。Alan Kohler 从经济学角度探讨了 AI 自动化对法律、金融、咨询等传统高薪行业的影响,以及劳动力市场正在发生的结构性变化。虽然时长较短,但观点犀利,发布不到一天已获超 4.6 万观看,说明就业话题持续引发公众焦虑。 🔗 https://www.youtube.com/watch?v=fvItHlMsHtY

4️⃣ Tech With Tim:2026 AI 就业市场真实观察 频道:Tech With Tim | 播放量:128,944 | 时长:15:01 | 发布:3周前 知名技术 YouTuber 以"No Hype"为标签,分享了对 2026 年 AI 就业市场的诚实观察。内容涵盖哪些技术岗位需求增长、哪些正在被替代、开发者应如何调整技能树,以及 AI 工具对初级程序员的实际影响。比起行业炒作,这期视频更注重数据和个人经验,给技术从业者提供了务实的职业规划参考。 🔗 https://www.youtube.com/watch?v=PEFso88LkC4

5️⃣ 前 OpenAI 科学家警告:"2026 年它就来了" 频道:AI Upload | 播放量:164,178 | 时长:17:44 前 OpenAI 研究科学家接受采访,对 AI 发展速度发出"令人不安的警告"。视频深入讨论了 AGI 时间线的最新预测、Scaling 瓶颈是否已被突破、以及 AI 安全研究是否跟上了能力增长的速度。作为业内人士的一手观点,提供了对 AI 风险的深层思考。该视频在 AI 社区引发热议,评论区讨论活跃。 🔗 https://www.youtube.com/watch?v=bv9s4ilotIE


【Reddit 精选】

1️⃣ Nicolas Carlini 称 Claude 是比他更好的安全研究员 Google DeepMind 的著名安全研究员 Nicolas Carlini(Google Scholar 引用量 67,200+)在最新访谈中表示,Claude 已经是比他更好的安全研究员。他透露 Claude 通过利用智能合约漏洞赚取了 370 万美元,还发现了 Linux 内核中一个自 2003 年存在至今从未被发现的重大安全漏洞——该漏洞允许攻击者窃取管理员密钥。这一表态引发了 AI 在网络安全领域能力边界的热烈讨论,也解释了为何 Mythos 发布后安全公司股价下跌。 🔗 https://reddit.com/r/artificial/comments/1s738xf/nicolas_carlini_672k_citations_on_google_scholar/

2️⃣ ZINC:用 Zig 编写的 LLM 推理引擎,让 $550 AMD GPU 跑 35B 模型 一位开发者发布了用 Zig 语言从零编写的 LLM 推理引擎 ZINC,专门为 AMD GPU 优化。众所周知 ROCm 不支持消费级显卡,vLLM 无法工作,llama.cpp 的 Vulkan 方案也只是凑合。ZINC 针对 AMD GPU 架构做了深度调优,实现了在 $550 的 AMD GPU 上运行 35B 参数模型的能力。项目引起了 LocalLLaMA 社区的强烈关注,被视为打破 NVIDIA 推理垄断的重要一步。 🔗 https://reddit.com/r/LocalLLaMA/comments/1s79w6u/zinc_llm_inference_engine_written_in_zig_running/

3️⃣ Voxtral TTS 开源语音克隆的缺失拼图被找到 Mistral 的 Voxtral TTS 开源模型此前缺少 codec encoder 权重,导致无法使用参考音频进行声音克隆。有开发者找到并公开了这些缺失的权重,使得 Voxtral 的声音克隆功能终于可用。这条帖子获得 197 点赞,被视为开源语音合成领域的重要突破。社区开发者已经开始基于此构建各种语音克隆应用,本地 TTS 的能力边界再次被拓展。 🔗 https://reddit.com/r/LocalLLaMA/comments/1s6rmoi/the_missing_piece_of_voxtral_tts_to_enable_voice/

4️⃣ KV Cache 旋转量化新发现:Q8 量化对数学推理有严重损害 llama.cpp 最新的 KV rotation PR 中发现了一个重要问题:现有的 Q8 KV 缓存量化在 AIME25 数学基准测试上表现大幅下降,但通过引入旋转(rotation)技术可以基本恢复性能。这一发现对所有使用量化推理的用户都很重要——如果你在用 Q8 KV 量化跑需要精确推理的任务,可能正在不知不觉中损失大量性能。帖子获得 163 点赞,引发了关于量化精度与推理能力 trade-off 的深入讨论。 🔗 https://reddit.com/r/LocalLLaMA/comments/1s720r8/in_the_recent_kv_rotation_pr_it_was_found_that/

5️⃣ Kimi K2.6 将在两周内发布,K3 正在研发中 来自 Moonshot 内部消息,Kimi K2.6 将在未来 10-15 天内发布,是一次小幅改进。更令人期待的是 K3 正在紧锣密鼓地开发中,目标是在参数规模上匹配美国模型,力争接近其性能水平。帖子获得 107 点赞,社区对中国 AI 公司追赶头部模型的进展保持高度关注。这也反映了全球 AI 竞赛正在加速,各家都在争分夺秒地迭代。 🔗 https://reddit.com/r/LocalLLaMA/comments/1s6stgl/kimi_k26_will_drop_in_the_next_2_weeks_k3_is_wip/