AI 快讯 · 第 26 页
-
Amazon Bedrock 推出托管知识库,简化企业级 AI Agent 搜索构建
AWS 发布 Amazon Bedrock Managed Knowledge Base,提供全托管的企业搜索方案,支持多模态数据解析、混合检索和文档级权限控制。本文详解其三大支柱:简化设置、智能检索和生产就绪,并附代码示例。
-
OpenAI 首款硬件产品:无屏 AI 音箱,配备摄像头和机械结构,计划 2027 年发布
OpenAI 计划推出首款硬件产品:一款便携式无屏 AI 音箱,配备摄像头、传感器和可动机械部件,旨在成为“有生命感”的 AI 伴侣。但苹果提起的商业秘密诉讼可能影响其 2027 年的发布计划。本文解读产品细节、诉讼影响及对中文用户的潜在意义。
-
Google 发布 LiteRT.js:通过 WebGPU 在浏览器中运行 .tflite 模型,性能提升最高 60 倍
Google 发布 LiteRT.js,将 LiteRT 原生推理引擎编译为 WebAssembly,支持 CPU(XNNPACK)、GPU(ML Drift over WebGPU)和 NPU(WebNN)三大后端。相比其他 Web 运行时快 3 倍,GPU/NPU 路径比 CPU 快 5–60 倍。本文详解技术细节、使用方法和中文圈应用前景。
-
诺基亚发布AI-RAN平台:基于NVIDIA GPU,号称业界首个,频谱效率提升20%以上
诺基亚于7月15日推出AI-RAN平台,基于其anyRAN软件和NVIDIA Aerial系统,宣称是业界首个GPU加速的AI原生无线接入网平台。该平台通过软件订阅模式提供,已实现20%以上频谱效率提升,目标2028年翻倍。中文圈视角分析其与爱立信竞品差异、对国内运营商及华为中兴的潜在影响。
-
Claude web_fetch 工具被曝数据泄露漏洞:攻击者利用嵌套链接窃取用户记忆
安全研究员 Ayush Paul 发现 Claude 的 web_fetch 工具存在漏洞,攻击者可通过构造蜜罐网站诱导 AI 代理访问嵌套链接,从而窃取用户聊天记忆中的私密信息。本文详解攻击原理、Anthropic 的防御机制及对中文用户的启示。
-
苹果AI获准入华:联手阿里巴巴Qwen模型,Apple Intelligence将登陆中国
苹果Apple Intelligence通过阿里巴巴Qwen AI模型合作获中国监管批准,即将登陆中国市场。本文解读合作细节、对国内用户的影响及与国产AI的对比。
-
Spotify 为 Premium 用户推出 AI 聊天功能,可直接对话或文字点播音乐
Spotify 扩展 AI 语音界面,Premium 订阅者现可在应用内通过语音或文字与音乐播放器聊天。本文详解功能细节、使用方式及对中文用户的实际影响。
-
Bonsai 27B 开源推理模型压缩至4GB,可在iPhone上本地运行
PrismML 将 270 亿参数的开源推理模型 Bonsai 27B 压缩至 4GB 以下,可在 iPhone 上本地运行,性能保留 90%,数学和编码能力几乎无损。苹果正在测试该技术,对中文用户意味着更强的端侧 AI 和隐私保护。
-
Amazon Bedrock 结合 MCP 服务器构建视觉智能:计算机视觉 MCP 服务器详解
本文介绍如何利用 Amazon Bedrock、Strands Agents 和 MCP 协议构建统一的计算机视觉 MCP 服务器,实现图像/视频分析、目标检测等视觉智能。开发者可通过单一标准化接口调用多个 AWS AI 服务,降低集成复杂度。
-
Gin Config + PyTorch 管道构建教程:可配置 MLP、余弦调度与运行时参数覆盖
本文详细讲解如何使用 Gin Config 控制 PyTorch 实验管道,将训练代码与配置分离。通过构建螺旋二分类任务、可配置 MLP、余弦学习率调度和运行时参数覆盖,实现实验管理。适合需要提升实验复现性和效率的 PyTorch 用户。
-
Built Technologies 在 AWS 上构建 AI 文档智能方案,为房地产金融代理提供支持
Built Technologies 与 AWS 合作,基于 Amazon Bedrock 和 IDP Accelerator 构建了可复用的 AI 文档处理引擎,将数天的工作缩短至几分钟,支持 250+ 文档类型,为房地产金融领域的代理产品提供文档理解能力。本文介绍其架构和中文用户启示。
-
Anthropic 联合黑石高盛成立 Ode:企业 AI 服务是下一个金矿?
Anthropic 与黑石、高盛等巨头合资成立 Ode,将前部署工程师嵌入企业客户,用少量工程师替代传统咨询团队。本文解读 Ode 模式对国内企业 AI 落地的启示,以及国产大模型厂商的应对空间。
-
AWS 推出跨账户 SageMaker Pipelines 监控方案:用 CloudWatch 自定义仪表盘统一管理
AWS 发布新方案,通过 CloudWatch 自定义仪表盘集中监控跨账户、跨区域的 SageMaker Pipelines。采用无服务器事件驱动架构,支持实时查看管道执行状态,降低运维复杂度。本文详解架构、部署步骤及对中文圈用户的实际意义。
-
OpenAI用AI攻击自家AI:GPT-Red模型84%成功率远超人类红队13%
OpenAI内部开发GPT-Red模型通过自我对弈训练,在84%测试场景中成功攻击自家AI,而人类红队仅13%。该成果直接用于加固GPT-5.6 Sol等模型,对中文圈AI安全研究和红队测试有重要参考价值。
-
Soofi S 30B-A3B 开源混合 Mamba-Transformer MoE 模型发布:德英双语性能领先
德国研究联盟发布 Soofi S 30B-A3B,一款开源混合 Mamba-Transformer MoE 基础模型,总参数 31.6B,激活 3.2B,在德英双语任务上超越同类开源模型。本文详解架构、训练数据、性能对比及对中文圈用户的启示。
-
NVIDIA 发布 AI Agent 加速轻量级 USD 运行时开发,降低物理 AI 场景构建门槛
NVIDIA 推出基于 AI Agent 的 NanoUSD 开发工具,帮助开发者快速构建轻量级 USD 运行时。本文详解其工作原理、对中文圈开发者的实际价值,以及与国产 3D 框架的对比。
-
Thinking Machines Lab 发布 Inkling:975B 参数开源 MoE 模型,支持可控思考深度
Thinking Machines Lab 于 2026 年 7 月 15 日发布 Inkling,一个 975B 总参数、41B 活跃参数的 MoE 多模态模型,采用 Apache 2.0 开源权重。支持 1M token 上下文窗口,可输入文本、图像和音频。核心亮点是可控思考努力(reasoning_effort),用户可按需调整推理深度以平衡性能与成本。本文详解架构、性能、部署及对…
-
Mistral AI 发布 Robostral Navigate:8B 参数机器人导航模型,单 RGB 摄像头即可在复杂环境中自主移动
Mistral AI 推出 Robostral Navigate,一个 8B 参数的具身导航模型,仅用单 RGB 摄像头和自然语言指令即可驱动机器人。在 R2R-CE 基准上达到 76.6% 成功率,无需 LiDAR 或深度传感器。本文详解其 Pointing 决策机制、Prefix-caching 高效训练和 CISPO 强化学习,并分析对中文机器人开发者的实际意义。
-
Blume 开源文档框架:零配置从 Markdown 文件夹生成 AI 就绪文档站点
Blume 是 Hayden Bleasel 发布的开源文档框架,只需将 Markdown/MDX 文件放入文件夹,即可生成带本地搜索、30+ MDX 组件、llms.txt 和 MCP 服务器的静态文档站点。对中文开发者,这意味着无需维护复杂文档工程,即可快速搭建 AI 友好的技术文档。
-
Anthropic研究:Claude用印地语更温暖、俄语更严谨,语言如何塑造AI价值观
Anthropic发布新研究,将Claude对话中表达的数百个价值概念映射到四个核心维度,发现模型和语言会导致系统性差异。本文解读研究核心发现、方法论争议,并探讨对中文用户使用AI的启示。