第2周智能体走向主流第1周开源模型与智能体基建加速第4周AI安全与开源之争第3周开源模型逼近前沿,安全事件引发关注第2周智能体化加速与安全隐忧并存第1周模型开源与部署加速,AI安全与就业分化加剧第5周模型军备竞赛与智能体落地第4周智能体生态加速成型第3周AI应用黄金时代与地缘博弈第2周超级应用与模型军备竞赛第1周AI基础设施竞赛与智能体生态爆发第4周AI安全与伦理成焦点,模型竞赛白热化第3周AI进入自主代理与多模态时代第2周智能体落地与模型生态分化第1周AI部署竞赛白热化,模型与生态双线突破模型军备竞赛与智能体落地本周AI行业主线是模型能力的快速迭代与智能体应用的大规模落地。美团LongCat的Owl Alpha和LongCat-2.0以1.6万亿参数MoE和国产ASIC训练成为焦点,性能对标顶级模型;Anthropic发布Claude Sonnet 5,定价更低且智能体能力大幅提升。同时,智能体工具链全面扩展:Cursor推出iOS版,OpenClaw发布移动应用,Claude Desktop支持Linux,Claude Science科研工作台上线。安全与伦理事件引发关注:美军AI误炸学校、Claude Code被利用执行恶意代码。此外,国务院推进AI全学段教育,三星、SK海力士巨资扩产,黑石在日本投建AI数据中心,显示AI基础设施投资持续升温。01模型竞赛:国产大模型崛起与开源生态多元化402智能体工具链全面爆发:从桌面到移动端703安全与伦理:AI误炸、恶意代码与隐私争议304基础设施投资:芯片扩产与数据中心建设405AI就业与技能:替代与创造并存406前沿研究:脑机接口、数学证明与可解释性4模型竞赛:国产大模型崛起与开源生态多元化本周最引人注目的是美团LongCat系列模型的强势表现。Owl Alpha以1.6万亿参数MoE成为OpenRouter最流行模型,性能达Gemini/Opus 4.6级别,且完全在国产ASIC上训练;随后发布的LongCat-2.0进一步专为Agentic Coding设计,支持1M上下文,定价极具竞争力。与此同时,开源生态从少数中国公司扩展到全球:新浪开源3B参数的VibeThinker-3B,在数学编程基准上媲美大200倍模型;NVIDIA发布Nemotron-3-Ultra-550B;Cohere开源旗舰模型。模型小型化与专业化趋势明显,Qwen 3.6 27B被推荐为本地开发理想选择。美团 LongCat 发布旗舰模型 LongCat-2.0新浪开源VibeThinker-3B:推理可压缩,事实知识不能Artifacts 22:Zyphra、Cohere 和 Poolside 正在扩展生态系统广度Qwen 3.6 27B 是本地开发的理想选择智能体工具链全面爆发:从桌面到移动端智能体应用进入全平台时代。Cursor推出iOS公测版,支持云端智能体远程操控;OpenClaw发布原生iOS与Android应用,将智能体装进口袋;Claude Desktop推出Linux公测版,覆盖更多开发者。Anthropic推出Claude apps gateway,让企业在Bedrock和Google Cloud上运行Claude Code,并发布Claude Science科研工作台,提供60余项预配置技能。此外,X推出hosted X MCP,AI智能体可直接调用X API;Google发布ADK Go 2.0,支持多智能体编排。这些产品表明智能体正从单一工具演变为跨平台、跨领域的操作系统级能力。从任何地点构建——Cursor for iOS 公测版发布OpenClaw 发布原生 iOS 与 Android 应用Claude Desktop 推出 Linux 公测版为 Amazon Bedrock 和 Google Cloud 推出的 Claude apps gatewayClaude Science 科研工作台正式上线X(Twitter)发布 hosted X MCP,AI 智能体可直连 X APIADK Go 2.0 发布:构建可靠的多智能体应用,新增基于图的工作流引擎、人工参与循环与动态编排安全与伦理:AI误炸、恶意代码与隐私争议本周多起事件凸显AI安全与伦理的紧迫性。美军首次大规模使用AI选择目标,却因情报系统脱节误炸伊朗学校,导致约120名儿童死亡,暴露AI在军事决策中的致命风险。安全研究发现,Claude Code打开GitHub仓库时可能执行隐藏恶意代码,攻击者可获完全控制,提示AI编码工具的安全设计缺陷。Meta秘密测试竞品AI安全性的方式引发争议:承包商假扮未成年向ChatGPT等发送数万条危机提示,被测试公司不知情。这些事件表明,AI的部署需要更严格的验证、透明度和伦理审查。美军用AI选目标却误炸伊朗学校,Anthropic Claude嵌入Palantir系统首日建议约1000目标Claude Code 打开 GitHub 仓库即执行隐藏恶意代码,攻击者可获完全控制Meta秘密测试ChatGPT等竞品:承包商假扮未成年发送数万条危机提示基础设施投资:芯片扩产与数据中心建设AI需求持续推动基础设施投资。三星和SK海力士计划投资5900亿美元扩产芯片,控制全球近80%高带宽内存市场,内存价格预计持续上涨。SK集团宣布到2035年建设15GW AI数据中心,总投资1000万亿韩元。黑石计划未来3-5年在日本投资300亿美元建设AI数据中心,并联合成立AI XPV平台。然而,NVIDIA的Rubin Ultra因制造问题被取消,显示硬件迭代的挑战。这些投资表明,AI算力需求远未见顶,但供应链瓶颈和成本压力正在显现。三星和SK海力士计划投资5900亿美元扩产芯片,AI需求推高内存价格SK 集团会长崔泰源:到 2035 年建设 15GW AI 数据中心,总投资达 1000 万亿韩元黑石未来3~5年拟投300亿美元在日本建AI数据中心,联合成立AI XPV平台Rubin Ultra取消,新版尺寸性能减半AI就业与技能:替代与创造并存AI对就业的影响呈现复杂图景。截至2026年5月,AI相关裁员近9万个,但高AI投入企业总员工数增长10.2%,入门级岗位增长12%,表明AI在资源充裕的企业中成为扩张工具。英国职场AI采用率一年内从34%升至73%,但仅15%的深度用户获得晋升加薪优势。国务院印发规划推进AI全学段教育,目标2030年高质量教育体系基本建成。专业化趋势不可避免,通用模型在特定任务上不如专门系统。AI正重塑劳动力市场,但技能鸿沟和资源分配不均可能加剧不平等。AI就业争论变得更加混乱英国职场AI采用率翻倍,仅15%“AI先锋”获得晋升加薪优势国务院印发《教育发展“十五五”规划》,推进人工智能全学段教育专业化为何不可避免前沿研究:脑机接口、数学证明与可解释性本周多项研究突破值得关注。Meta发布Brain2Qwerty v2,实现非侵入式实时句子解码,有望帮助无法沟通的人群。AI用prover-verifier LLM循环攻克9个未解数学难题,展示AI在科学发现中的潜力。Anthropic提出回合平均稀疏自编码器,提升模型可解释性。OpenAI发布GeneBench-Pro,评估AI在计算生物学中的判断能力。这些研究推动AI从语言处理向更广泛的科学和认知领域扩展。Meta发布Brain2Qwerty v2:非侵入式实时句子解码AI 用 prover-verifier LLM 循环攻克 9 个未解数学难题Anthropic 提出回合平均稀疏自编码器 (Turn-Averaged SAE)OpenAI 发布 GeneBench-Pro:计算生物学研究级基准测试
AIHOT周报
为什么值得读AIHOT 周报:美团 LongCat Owl Alpha 与 LongCat-2.0 以 1.6 万亿参数参战,模型迭代与智能体落地并进。
如果可以重来,你还愿意花这段时间读它吗?
· 匿名阅读记录只用于改进推荐