AI 快讯 · 第 52 页
-
NVIDIA XR AI 发布:为 AR 眼镜和 XR 设备构建 AI Agent 的完整基础设施
NVIDIA 推出 XR AI 框架,解决 AR 眼镜等设备上构建 AI Agent 的基础设施缺口。支持实时摄像头/麦克风流、多模态模型、工具调用和企业数据集成。了解其架构、中文开发者如何上手及与国产方案的对比。
-
Amazon Bedrock 推出 InvokeGuardrailChecks API,为 AI Agent 提供无资源安全检测
AWS 发布 InvokeGuardrailChecks API,无需创建 Guardrail 资源即可在 AI Agent 多轮交互中按需调用安全检测。支持内容过滤、提示攻击检测、敏感信息识别,返回数值分数,开发者可自定义阈值和动作。对国内 Agent 开发者的安全合规实践有参考意义。
-
AI不会取代软件工程师:数据与论证揭示真正瓶颈,对中文开发者意味着什么
普林斯顿教授Arvind Narayanan与Sayash Kapoor撰文指出,AI并未导致程序员大规模失业。纽约州WARN法案一年数据显示无一家公司因AI裁员。软件工程真正瓶颈在于需求决策、验证交付和领域知识,而非写代码。中文开发者应关注自身不可替代的技能。
-
Claude Code 2026 完整指南:25 个功能详解与实战演示
本文详解 Claude Code 的 25 个核心功能,包括 CLAUDE.md、Skills、Subagents、Hooks、MCP 等,提供代码示例和交互式 Demo。从中文开发者视角分析其与国内 AI 编程工具的差异,以及实际使用门槛与场景。
-
Z.ai 发布 GLM-5.2:百万 token 上下文窗口,两种思考模式,无基准测试数据
Z.ai 于 2026 年 6 月 13 日发布 GLM-5.2,核心亮点是 1M token 上下文窗口和 High/Max 两种思考模式。模型可兼容 Claude Code、Cline 等工具,承诺下周开源 MIT 权重。本文解析其能力、配置方法及对中文开发者的实际影响。
-
Anthropic出口管制引爆全球AI主权争夺:Fable 5和Mythos 5突遭美国政府下线
2026年6月13日,美国政府对Anthropic最强大的两个AI模型Fable 5和Mythos 5实施出口管制,导致全球用户无法访问,甚至波及公司外籍员工。此举引发欧洲、加拿大等地的AI主权恐慌,各国加速寻求技术自主。本文详解事件始末、技术争议及对中文圈用户的启示。
-
Flash-KMeans 开源发布:IO 感知的精确 K-Means 在 GPU 上比 FAISS 快 200 倍以上
UC Berkeley 和 UT Austin 团队推出 Flash-KMeans,一种 IO 感知的精确 K-Means 实现,在 NVIDIA H200 上比 FAISS 快 200 倍以上。它不改变算法或近似,通过 FlashAssign 和 Sort-Inverse Update 优化 GPU 内存访问,适合训练和推理循环中的高频聚类场景。
-
微软CEO纳德拉警告:少数AI系统可能攫取全部经济回报,企业需构建“Token资本”
微软CEO萨提亚·纳德拉呼吁企业构建基于内部数据和专有学习循环的AI能力,即“Token资本”,以避免少数大型模型攫取整个行业的经济价值。这一观点与Azure平台的商业逻辑高度契合,对国内企业AI战略有重要启示。
-
埃森哲报告:74%消费者更信任AI购物代理而非好友,自主购物时代来临
埃森哲2026年消费者脉搏研究显示,74%受访者信任AI购物代理超过好友,32%愿让AI在限定范围内代购。报告揭示消费者对AI代理的信任度提升,但自主购物仍有边界。中文用户需关注数据安全、平台兼容性及国产替代方案。
-
Anthropic被令全球关停Fable 5和Mythos 5,欧洲主权AI辩论再起
美国命令迫使Anthropic全球关停Fable 5和Mythos 5,欧洲委员会评估影响。欧洲研究者争论应自建基础模型还是通过合同保障访问,但专家警告欧洲缺乏算力、能源和竞争性供应商。本文分析事件经过、欧洲困境及对中国的启示。
-
世界-动作模型(WAM)崛起:从预训练想象到微调执行,机器人AI新范式
NVIDIA 提出世界-动作模型(WAM)概念,将预训练的世界模型或视频生成模型微调为机器人策略,相比传统VLA方法更高效、更泛化。本文解读WAM原理、优势及对中文圈机器人开发者的意义。
-
Pokémon Go玩家AR扫描数据被用于训练军事无人机AI,Niantic空间智能引发争议
Niantic利用Pokémon Go玩家的AR扫描数据训练空间AI模型,该技术现与美国国防承包商结合,用于无人机GPS失效时的导航。中文用户需关注数据隐私与军事用途的伦理问题。
-
AWS 发布 Deep Agents + Bedrock AgentCore:构建上下文丰富的研究代理,实现隔离执行环境
AWS 推出 Deep Agents 与 Bedrock AgentCore 集成方案,允许开发者构建多步骤 AI 研究代理,每个子代理在隔离的 MicroVM 中运行浏览器或代码解释器。本文详解架构、代码实现及对中文开发者的实际意义。
-
Anthropic 模型因内部冲突被下线:美国政府出口管制与 jailbreak 难题
Axios 爆料 Anthropic 与白宫因人格冲突导致模型下线,涉及出口管制 Mythos/Fable 事件。本文梳理幕后细节、jailbreak 攻防困境,并分析对中国 AI 用户和开发者的潜在影响。
-
英伟达加入AI债务热潮,拟发行200亿美元债券融资
英伟达计划通过2021年以来首次债券发行筹集至少200亿美元,加入AI基础设施投资债务热潮。本文分析此举对芯片供应链、数据中心建设及国内AI企业融资环境的潜在影响。
-
NVIDIA 发布融合内核提升 MoE 训练吞吐量,加速大模型规模化
NVIDIA 推出高级融合内核,显著提升混合专家(MoE)模型训练吞吐量。本文详解技术原理、性能提升数据,并分析对国内大模型训练与国产 GPU 生态的启示。
-
Strands Evals 新工具:AI Agent 故障自动检测与根因分析,诊断时间从小时缩短到分钟
AWS 发布 Strands Evals SDK 的 Detectors 功能,可自动识别 AI Agent 执行轨迹中的故障并进行根因分析,输出分类故障、因果链和修复建议。本文详解其工作原理、代码示例及对中文开发者的实用价值。
-
NVIDIA BioNeMo 食谱:用 LoRA 微调生物基础模型 ESM2 与 Evo 2
NVIDIA 发布 BioNeMo 食谱,支持用 LoRA 高效微调 ESM2、Evo 2 等生物基础模型。本文详解方法、优势与对中文科研用户的实际意义,包括计算资源需求与国产替代方案。
-
美国政府要求Anthropic打造不可破解的LLM,专家称这是不可能的任务
美国政府指责Anthropic无视特朗普网络安全指令,未经批准发布Fable 5模型。安全专家认为,要求LLM完全不可破解在技术上不现实。本文分析事件经过、技术挑战,以及对中文AI行业和用户的启示。
-
Gemma 4 模型登陆 Amazon Bedrock:三款开源变体支持推理、函数调用与多模态
Google DeepMind 的 Gemma 4 系列模型现已在 Amazon Bedrock 上可用,包括 31B 密集、26B-A4B MoE 和 E2B 三种指令微调变体,支持内置推理、原生函数调用和图文多模态输入。本文介绍模型能力、架构亮点及在 Bedrock 上的使用方式。