AI 快讯 · 第 50 页
-
MiniMax 发布 MSA 稀疏注意力:109B MoE 模型实现 28.4 倍注意力计算缩减,中文开发者可试用开源推理内核
MiniMax 推出 MSA(MiniMax Sparse Attention),一种基于 GQA 的两阶段块稀疏注意力机制。在 109B MoE 模型上训练后,MSA 在 1M 上下文下将每 token 注意力计算量降低 28.4 倍,同时保持下游基准性能。中文开发者可通过开源内核和 MiniMax-M3 模型直接体验长上下文推理加速。
-
Google Cloud 生成式 AI 在英国地方政府规划审批中部署,目标缩短 50% 决策时间
英国政府部署 Google Cloud 生成式 AI 工具 Extract 和 APD,自动化处理规划申请,减少人工录入 255 小时/年,目标 2027 年覆盖 300 多个地方当局。对中文圈用户意味着政务 AI 落地的可参考路径。
-
Epoch AI分析:超大规模云厂商AI基建支出增速远超现金流,2026年Q3或需外部融资
Epoch AI最新分析显示,微软、亚马逊、谷歌、Meta和甲骨文等超大规模云厂商的AI基础设施支出年增70%,而运营现金流仅增23%。若趋势持续,2026年Q3支出将超过现金流,多家公司已开始寻求外部融资。本文解读这一趋势对全球AI产业及中文圈用户的影响。
-
OpenAI 研究员提出新方法:预测 AI 模型发布后的失败频率,弥补安全测试空白
OpenAI 研究员提出一种预测 AI 模型发布后错误频率的方法,旨在弥补标准安全测试的不足。本文解读该方法的核心原理、对中文用户的实际意义,以及与国产模型的对比。
-
AI博客Interconnects中期回顾:独立写作与开放生态的坚守
Nathan Lambert在离开AI2后分享博客运营策略:坚持独立声音、保护小众技术读者群、付费订阅与评论付费墙。对中文圈独立AI写作者有参考价值。
-
Amazon Bedrock AgentCore 新能力:让 AI Agent 接入组织、网络和付费知识,实现持续学习
AWS 推出 Amazon Bedrock AgentCore 三大新能力:托管知识库、网络搜索和 Agent 支付,让 AI Agent 能访问内部文档、实时网络和付费数据,并提供生产环境优化工具。了解这些更新对中文开发者和企业的实际意义。
-
AWS 发布 Context 服务:为 AI Agent 提供大规模上下文智能,自动构建知识图谱
AWS 在纽约峰会上推出 AWS Context 服务,自动将企业数据关系映射为知识图谱,为 AI Agent 提供运行时上下文。同时发布 Glue 语义搜索、S3 注释等新功能。本文详解这些创新对中文企业用户的意义、与国产方案的对比及实际应用场景。
-
Charity Majors:AI让代码生产成本趋近于零,但工程纪律反而更重要
Charity Majors指出2025年AI彻底颠覆了代码生产的经济学:生成代码变得免费且即时,代码从精心维护的资产变为可随意丢弃的消耗品。这一观点对国内开发者意味着什么?本文解读其核心论点并探讨对中文编程社区的启示。
-
Vercel 开源 AI Agent 框架 Eve:每个 Agent 就是一个文件目录,内置持久执行、沙箱、审批等能力
Vercel 发布开源 AI Agent 框架 Eve(Apache-2.0),将 Agent 定义为一个文件目录,每个文件映射一项能力。内置持久执行、沙箱、审批、连接、渠道和评估,支持 npx eve@latest init 快速启动,vercel deploy 一键部署。本文详解其设计理念、内置能力、内部用例及对中文开发者的影响。
-
智谱GLM-5.2开源发布:百万token上下文,编码能力逼近Claude Opus 4.8
智谱AI发布GLM-5.2,采用MIT开源协议,支持稳定百万token上下文。在长时间编码任务基准FrontierSWE上,仅落后Anthropic的Claude Opus 4.8一个百分点。推理能力仍落后闭源对手。本文解读该模型对中文开发者的实际意义。
-
亚马逊、英伟达、AMD 联合投资 3.1 亿美元,押注 3D 世界模型 AI 初创公司 Odyssey ML
亚马逊、英伟达和 AMD 向世界模型初创公司 Odyssey ML 投资 3.1 亿美元,公司估值达 14.5 亿美元。CIA 关联基金 IQT 和谷歌首席科学家 Jeff Dean 也参与投资。世界模型被视为继语言模型后的下一个 AI 风口,本文解析其技术方向及对中文圈的影响。
-
微软研究员用《帝国时代2》山羊搭建神经网络,讽刺AI研究过度拟人化
微软研究员在《帝国时代2》地图编辑器中用山羊、桥梁和冰坡构建了一个可运行的神经网络,以此讽刺AI研究中的拟人化倾向。他分析了315篇论文,发现超过一半在实验前就默认语言模型具有人类特质。这一创意实验揭示了AI评测中的盲点。
-
NEA投资人谈AI IPO、个人代理与ROI清算:硅谷“Tokenmaxxing”热潮退去
NEA合伙人Tiffany Luck在TechCrunch播客中讨论AI行业从“Tokenmaxxing”狂热到ROI清算的转变,分析AI IPO前景、个人代理趋势及企业AI投资回报。对中文圈用户,本文揭示AI泡沫风险与理性投资启示。
-
企业AI投资回报率仍在摸索:NEA合伙人谈Tokenmaxxing热潮后的成本反思
NEA合伙人Tiffany Luck指出,企业仍在摸索AI投资回报率(ROI)。年初硅谷的Tokenmaxxing热潮导致Uber等公司预算超支,如今企业开始反思AI成本与收益。本文分析企业AI应用现状、成本控制策略及对中文圈用户的启示。
-
Amazon SageMaker AI 异步推理新增内联请求负载支持,简化小负载推理流程
AWS 宣布 SageMaker AI 异步推理支持内联负载,可直接在 API 请求体中发送不超过 128KB 的推理数据,无需先上传至 S3。本文详解新功能原理、代码对比、适用场景及对中文开发者的实际影响。
-
Amazon Quick 推出自主 AI 代理:后台持续工作,帮你每天省下数小时
Amazon Quick 发布自主 AI 代理,可在后台持续执行任务,如跟进商机、总结合规变更、准备会议材料。新活动摘要视图整合多应用信息,支持跨数据源提问。本文详解功能、集成与中文用户适用性。
-
白宫与Anthropic冲突升级:Fable越狱事件揭示AI安全审查的灰色地带
《大西洋月刊》报道白宫对Anthropic施压,曝光Fable越狱测试细节。网络安全专家指出,Anthropic的Claude模型在特定提示下会绕过安全限制执行代码修复任务。本文分析此事件对中文AI安全研究、模型合规及国产大模型安全机制的启示。
-
Fable 5 出口管制误伤美国网络防御:修复代码被误判为越狱攻击
Anthropic 的 Claude Fable 5 因修复代码漏洞被美国出口管制禁止,安全专家指出这荒谬地削弱了防御能力。本文解析事件真相,并讨论对中国 AI 安全工具开发者的启示。
-
Docling Parse 教程:构建布局感知的 PDF 解析管道,提取文字与坐标
本文详细教程如何使用 Docling Parse 构建 PDF 解析管道,从环境搭建、生成测试 PDF 到提取文字、字符和行级坐标,并输出 JSON/CSV。适合文档 AI、RAG 和布局分析场景,中文用户可借鉴用于本地文档处理。
-
AI红队测试是什么?企业为何需要它及顶级服务商推荐
AI红队测试通过模拟攻击场景暴露系统漏洞,提升模型安全性与合规性。本文详解其定义、商业价值,并推荐CBIZ、Reply、Mindgard等顶级服务商,助你选择适合的AI安全测试方案。