AI 快讯 · 第 57 页
-
WWDC 2026:苹果发布新一代Siri AI,采用Gemini衍生模型,开发者可通过Core AI库在本地运行PyTorch模型
苹果在WWDC 2026上宣布了新一代Siri AI,通过视觉LLM提取屏幕信息,无需应用单独适配。同时推出Core AI库,支持开发者将PyTorch模型在Apple硬件上本地运行。本文分析这些更新对中文开发者和用户的实际影响。
-
哈佛与Perplexity联合研究:AI Agent每次会话自主工作26分钟,远超搜索的33秒
哈佛和Perplexity的最新研究对比了AI Agent与搜索助手,发现Agent每次会话自主工作26分钟,是搜索的48倍,且任务完成时间缩短87%、成本降低94%。本文解读该研究对中文用户的实际意义。
-
DevOps中自主AI数据丢失风险与防御:构建高效恢复策略
自主AI代理在加速软件开发的同时,也带来了前所未有的数据丢失风险。本文分析AI代理如何成为内部威胁,导致生产数据库在9秒内被擦除,并提出物理解耦、不可变备份等防御策略。对中文圈用户而言,需关注国产DevOps平台(如阿里云效、腾讯CODING)的备份机制是否独立,以及如何应对AI代理误操作。
-
NVIDIA cuTile Python 教程:在 Colab 中构建分块 GPU 内核实现向量加法、矩阵加法和矩阵乘法
本教程手把手教你使用 NVIDIA cuTile Python 在 Colab 中编写分块 GPU 内核,涵盖向量加法、矩阵加法和矩阵乘法。提供 PyTorch 回退方案,即使环境不满足 cuTile 要求也能运行。包含性能基准测试和正确性验证。
-
OpenAI 转向人机协作,称完全自动化不是未来,呼吁国际监管机构
OpenAI 放弃 2028 年实现完全自主 AI 的目标,转而强调人机协作。CEO Sam Altman 和首席科学家 Jakub Pachocki 呼吁成立国际机构以在必要时减缓前沿 AI 发展。本文解读这一立场转变对中文圈用户的影响。
-
Apple Intelligence 借助 Google 和 Nvidia 卷土重来,WWDC 2026 展示全新 Siri
在 WWDC 2026 上,Apple 展示了基于 Google 基础模型、运行于 Nvidia GPU 的全新 Siri。本文解析 Apple Intelligence 的最新进展,并探讨其对中文用户的影响、与国产 AI 的对比及合规考量。
-
北京2950亿美元AI基建计划:80%芯片国产化,锁定美国供应商出局
中国计划五年内投资2950亿美元建设全国AI数据中心网络,要求至少80%技术来自华为等本土供应商。同时台湾首次考虑将AI芯片走私至中国定为刑事犯罪。本文分析该计划对国产芯片、中美科技竞争及中文用户的影响。
-
NVIDIA Nemotron Speech 加速临床 ASR 评估:Agent Skills 助力医疗语音识别
NVIDIA 推出 Nemotron Speech 临床 ASR 评估方案,结合 Agent Skills 自动化测试医疗术语识别精度。本文详解技术原理、中文医疗场景适用性及与国产方案的对比,帮助开发者快速验证模型性能。
-
德国法院里程碑判决:Google AI Overviews 视为自身言论,须为错误答案担责
德国地区法院裁定 Google 对其 AI 搜索概览内容直接负责,不适用搜索引擎的有限责任豁免。该案中 AI 错误将两家出版商与欺诈关联,可能为全球 AI 生成内容责任判定树立先例。
-
使用 Amazon Quick 和 New Relic 构建智能事件分类助手,降低 MTTR
本文介绍如何利用 Amazon Quick 的 AI Agent 与 New Relic MCP Server 集成,构建一个自动化事件分类助手。该助手可自动收集证据、生成根因分析报告并创建 Asana 任务,帮助 SRE 团队缩短平均解决时间(MTTR),提升运维效率。
-
NVIDIA FLARE Auto-FL 用 AI 智能体加速联邦学习研究,自动调参优化模型
NVIDIA 推出 FLARE Auto-FL,利用 AI 智能体自动搜索联邦学习中的超参数和聚合规则,大幅减少手动调优工作量。本文详解其工作原理、对研究者的价值,并分析中文圈用户如何利用该工具加速隐私计算研究。
-
AWS 推出免手动理赔录入系统:Strands Agents 与 Bedrock AgentCore Browser Tool 结合,智能处理保险索赔
AWS 发布新方案,将 Strands Agents SDK 与 Amazon Bedrock AgentCore Browser Tool 结合,实现保险理赔首次损失通知(FNOL)的自动化录入。系统自动处理门户操作、证据验证和标签化,让理赔专家专注于高价值决策。本文详解技术架构、工作流程及对中文保险科技行业的启示。
-
Google 发布 Gemini 3.5 Live Translate:流式语音翻译覆盖 70+ 语言,集成 Meet、Translate 和 Live A
Google 推出 Gemini 3.5 Live Translate,一个流式语音到语音翻译模型,支持 70+ 语言,延迟仅几秒。开发者可通过 Live API 集成,企业版在 Google Meet 内测,普通用户可在 Translate 应用使用。本文详解技术细节、中文用户可用性及国产替代对比。
-
Google Gemini 3.5 Live Translate 发布:实时语音翻译支持70+语言,保留语气和节奏
Google 推出 Gemini 3.5 Live Translate,一个专门用于实时语音翻译的音频模型,支持超过70种语言,无需等待句子结束即可连续翻译,并声称保留说话者的语气、语速和音调。在 Google Meet 中,语言支持从5种扩展到70多种。本文介绍其功能、技术细节及对中文用户的影响。
-
NVIDIA TensorRT 模型量化:将 FP8 检查点转换为高性能推理引擎
了解如何使用 NVIDIA TensorRT 将 FP8 量化检查点转换为高性能推理引擎,提升推理速度、吞吐量和 GPU 利用率。本文涵盖 CLIP 模型示例,并探讨对中文用户的实际意义。
-
NVIDIA DGX Spark 企业级管理功能发布:大规模 AI 基础设施生命周期控制
NVIDIA 推出 DGX Spark 企业级可管理性方案,支持大规模 AI 基础设施的自动化部署、监控、安全与生命周期管理。本文详解其核心功能、对中文企业用户的部署价值,以及与国产 AI 基础设施管理的对比。
-
Andrej Karpathy谈AI软件需求激增:杰文斯悖论在编程领域显现
Andrej Karpathy在Claude Fable 5上分享观点:随着AI让软件生产变得像拧开水龙头一样简单,他对软件的需求大幅增长。杰文斯悖论正在发生——效率提升反而刺激了更多使用。本文解读这一趋势对中文开发者和用户的启示。
-
NVIDIA Isaac Lab 结合 Amazon SageMaker AI 规模化训练机器人强化学习:Unitree H1 人形机器人案例
本文介绍如何利用 NVIDIA Isaac Lab 在 Amazon SageMaker AI 上训练 Unitree H1 人形机器人策略,涵盖 SageMaker HyperPod 和 Training Jobs 两种计算选项。了解物理 AI 从研究到生产的规模化路径,以及中文用户如何借鉴此方案进行机器人强化学习训练。
-
AgentsView 自定义模型价格教程:手动添加 Claude Fable 5 等新模型
Wes McKinney 开发的 AgentsView 工具可追踪本地 AI 编程助手的 token 消耗与费用。当新模型(如 Claude Fable 5)发布但价格数据库未更新时,可通过修改配置文件手动添加。本文详解操作步骤,并讨论对中文用户使用类似工具(如 OpenCost)的参考价值。
-
Anthropic发布Claude Fable 5:最强模型伴随争议性安全措施,用户可能被降级而不自知
Anthropic推出Claude Fable 5,性能全面超越GPT-5.5 Pro,但新增安全分类器会将部分请求降级到Opus 4.8,甚至在不告知用户的情况下限制模型能力。本文分析模型能力、安全措施争议及对中文用户的影响。