AI 快讯 · 第 28 页
-
斯坦福TRACE:将智能体反复失败转化为合成RL环境,能力定向训练提升15.3个百分点
斯坦福团队提出TRACE系统,通过诊断智能体缺失的具体能力、合成可验证训练环境、训练LoRA适配器并组合成MoE模型,在τ²-Bench上提升+15.3点,SWE-bench Verified达73.2% Pass@1。了解其原理及对中文开发者的实用意义。
-
Google SensorFM:万亿分钟可穿戴数据训练的健康基础模型,34/35任务超越现有基准
Google Research发布SensorFM,一个基于500万Fitbit和Pixel Watch用户超过万亿分钟可穿戴数据训练的基础模型,在34/35项健康和行为任务上超越现有基准。本文解读其技术细节、对中文用户的可及性及国产替代可能性。
-
Cloudflare 9月起默认拦截AI代理爬虫,中文用户需了解权限获取方法
Cloudflare 宣布从9月15日起默认拦截AI代理爬虫,将爬虫分为搜索、代理和训练三类。本文详解新规对中文用户的影响,包括如何获取权限、对国产AI代理的潜在冲击,以及广告页面内容访问受限后的应对策略。
-
德国AI联盟发布Soofi S 30B开源模型,英德双语基准测试领先
德国研究联盟推出Soofi S 30B-A3B开源语言模型,采用混合架构,仅激活部分参数,在英德双语基准测试中超越所有开源竞品。了解其技术细节、性能表现及对中文用户的意义。
-
微软CEO纳德拉炮轰OpenAI和Anthropic:禁止蒸馏却用他人数据训练,呼吁企业掌控AI学习基础设施
微软CEO萨提亚·纳德拉公开批评OpenAI和Anthropic存在“反向信息悖论”:它们以合理使用为由训练公开数据,却禁止他人蒸馏自家模型,同时从用户交互中学习。纳德拉呼吁企业掌控自己的学习基础设施,而微软恰好提供相关解决方案。本文分析这一争议对中文AI生态的启示。
-
NVIDIA 引导式生成模型:高效估算极端事件概率,助力风险评估
NVIDIA 发布引导式生成模型新方法,用于高效估算低概率高影响极端事件的发生概率。相比传统蒙特卡洛模拟,该方法大幅减少所需样本量,适用于气候、金融、工程等领域的风险评估。本文详解技术原理、应用场景及对中文圈用户的实际意义。
-
16位诺奖得主与AI领袖联合警告:应对AI经济冲击的准备窗口正在关闭
200多位经济学家和AI研究者(含16位诺奖得主及Google、OpenAI、Anthropic代表)联合声明,警告AI变革速度将超越工业革命,呼吁立即准备应对经济冲击。本文解读声明核心内容及对中文圈用户的影响。
-
Amazon SageMaker AI 推出生成式 AI 推理优化 UI,无需代码即可部署最佳配置
AWS 为 SageMaker AI 新增推理优化 UI,支持预设场景(交互/生成/摘要)和优化目标(成本/延迟/吞吐量),一键部署生产级配置。中文用户可降低 ML 基础设施门槛,无需编写代码即可完成模型部署优化。
-
图灵奖得主Rich Sutton创立Oak Lab,打造自主持续学习的AI智能体
2024年图灵奖得主、强化学习之父Richard Sutton在多伦多创立Oak Lab,批评当前深度学习“弱且低效”,致力于构建能持续从环境中自主学习的AI智能体。本文解读其技术愿景及对中文圈的影响。
-
Bluesight 用 Amazon Bedrock AgentCore 构建医疗合规 AI 助手 Prism,从原型到上线仅 9 个月
Bluesight 借助 Amazon Bedrock AgentCore 将单一产品 AI 原型升级为覆盖 6 个医疗合规产品的统一智能体方案 Prism。Prism Assistant for ControlCheck 已于 2026 年 5 月上线,被 20 家医疗系统使用。本文详解其架构、开发历程及对中文医疗 AI 开发者的启示。
-
Amazon Bedrock AgentCore Gateway 实现多租户 AI Agent 的 OBO 令牌交换指南
本文详细介绍了如何在 Amazon Bedrock AgentCore Gateway 中实现 OAuth 2.0 令牌交换(RFC 8693),以解决多租户 AI Agent 调用下游 API 时的身份传播和权限控制问题。通过 TravelBot 示例,展示了 JWT 声明转换、受众绑定等关键步骤,实现端到端用户身份保留和最小权限原则。
-
OpenAI 发布新版提示指南:面向普通用户,强调从结果出发而非步骤
OpenAI 推出面向普通用户的提示指南,建议使用目标、上下文、格式和约束四个可选模块,核心是描述想要的结果而非步骤。这是首次将 Chat 和 Codex 统一在一个框架下,对中文用户提升 ChatGPT 使用效率有直接参考价值。
-
AI 作为无障碍工具:神经多样性专业人士如何用 Amazon Quick 补偿执行功能缺陷
一位 AuDHD(自闭症+多动症)解决方案架构师分享如何用 Amazon Quick 桌面助手构建 AI 工作流系统,实现邮件分类、任务优先级管理、上下文保持,解决执行功能缺陷。对中文圈用户,探讨国产替代方案与神经多样性适配现状。
-
VideoAgent多智能体系统构建教程:意图解析、图规划与工具路由实现视频编辑任务
本文详细解析如何构建一个无需API key的多智能体视频编辑系统,涵盖意图解析、图规划、工具路由等核心组件,并连接FFmpeg、Whisper等工具实现视频问答、摘要和自动剪辑。适合对AI视频处理和多智能体系统感兴趣的开发者。
-
OpenAI GPT-5.6 Sol/Terra/Luna 在 Amazon Bedrock 上正式可用,三档模型覆盖旗舰推理到快速推理
OpenAI 最新 GPT-5.6 系列模型(Sol、Terra、Luna)已在 Amazon Bedrock 上架。Sol 在编码和网络安全基准上创下新高,Terra 平衡性能与成本,Luna 主打低延迟。支持 prompt caching 和区域数据驻留,定价与 OpenAI 官方一致。中文用户可通过 AWS 直接调用,无需额外梯子。
-
Datasette 项目代码频率图揭示 AI 编程助手对开源贡献的巨大影响
Simon Willison 通过 Datasette 项目的 GitHub 代码频率图,直观展示了 Opus 4.8、GPT-5.5 等 AI 模型如何大幅提升其编程产出。2026 年单周代码增加量达 37,022 行,远超往年峰值。本文分析这一趋势对中文开发者的启示。
-
DOOMQL:用SQLite做游戏引擎,GPT-5.6生成的复古FPS,在终端里玩
Peter Gostev用GPT-5.6 Sol构建了DOOMQL,一个完全用SQLite数据库驱动的Doom风格游戏。移动、碰撞、敌人、战斗、渲染全部由SQL查询完成,包括递归CTE实现的光线追踪器。本文介绍如何运行、背后的技术细节,以及对中文开发者和数据库爱好者的启发。
-
Skyfall AI 发布 MORPHEUS:持续强化学习企业仿真基准,应对非平稳环境
Skyfall AI 推出 MORPHEUS,一个持续强化学习(CRL)企业仿真平台,模拟永不重置的运营环境。它通过故障注入和配置偏移制造非平稳性,并用六维评估协议测试 PPO、HER、EWC、LCM 等算法。本文解析其架构、评估方法及对中文圈 AI 应用与研究的启示。
-
NVIDIA 基于块的 GPU 编程实战指南:从 cuTile 和 Triton 到 Flash Attention
本文通过 Colab 教程,讲解 NVIDIA 基于块的 GPU 编程模型,涵盖 cuTile 和 Triton 后端,实现向量加法、GELU、Softmax、矩阵乘法和 Flash Attention,并与 PyTorch 对比。适合想深入 GPU 编程的中文开发者。
-
Mira Murati 的 Thinking Machines Lab 发布报告:以可定制模型权重构建以人为本的 AI
Thinking Machines Lab 发布报告《值得建设的未来是人》,提出通过可定制模型权重、LoRA 微调等技术方向,让 AI 更贴近用户。本文解读其技术主张,并分析对中文圈开发者和企业的意义。