AI 快讯 · 第 58 页
-
Datasette Agent Edit 0.1a0 发布:基于 Claude 文本编辑工具模式的插件基础库
Datasette Agent Edit 0.1a0 发布,这是一个为 Datasette Agent 设计的插件基础库,实现了类似 Claude 文本编辑工具的 view、str_replace、insert 三个核心工具,用于支持协作式 Markdown 编辑、SQL 查询更新和 SVG 文件编辑等场景。了解其设计思路、工具接口及对中文开发者的实用价值。
-
Google Research 在 Gemini Enterprise Agent 平台推出 Agentic RAG,Sufficient Context
Google Research 发布 Agentic RAG 框架,集成于 Gemini Enterprise Agent 平台,通过 Sufficient Context Agent 迭代搜索确保上下文完整,处理多源多跳查询,事实准确性提升 34%,现已公开预览。
-
微软发布MAI-Transcribe-1.5语音转文字模型:43语言支持、2.4%词错误率、1小时音频15秒内转录
微软AI推出MAI-Transcribe-1.5语音转文字模型,支持43种语言,在Artificial Analysis榜单上达到2.4%词错误率,1小时音频转录仅需15秒。新增关键词偏置功能,可降低30%词错误率。已在Azure AI Foundry上线。本文详解其性能、中文场景适用性及与国产模型的对比。
-
美国超市Weis Markets引入Instacart AI购物车Caper Cart,支持数字优惠券与忠诚度积分
Weis Markets在宾夕法尼亚州部分门店部署Instacart的AI购物车Caper Cart,配备摄像头、秤和触屏,支持商品识别、实时消费追踪、数字优惠券和忠诚度积分。本文解读该技术对国内零售和AI应用场景的启示。
-
月之暗面Kimi母公司寻求300亿美元估值,较2025年底增长超6倍
月之暗面(Moonshot AI)在最新融资轮中寻求高达300亿美元估值,较2025年底增长超6倍。Kimi聊天机器人用户增长强劲,推动公司成为国内AI领域估值最高的独角兽之一。本文分析融资背景、对中文用户的影响及与国产竞品的对比。
-
英杰华部署AI识别2.3亿英镑保险欺诈,用生成式AI对抗AI造假
英国保险公司Aviva利用AI工具识别出创纪录的2.3亿英镑保险欺诈,其中包含大量由生成式AI制造的假事故现场图片和假文件。本文详解Aviva如何用AI反制AI欺诈,并探讨对中国保险业和普通用户的启示。
-
Instagram AI客服机器人漏洞致超2万账户被盗,Meta首次披露具体数字
Meta披露其Instagram AI支持聊天机器人存在安全漏洞,导致至少20,225个账户被入侵。该漏洞持续近七周,系统向任意邮箱发送密码重置链接而未验证归属。本文分析事件详情及对中文用户的影响。
-
微软收紧冲突地区云服务规则:调查以色列军方使用Azure后新增人权审查
微软完成对以色列军方使用Azure云服务的内部调查,宣布收紧冲突地区服务规则并新增人权审查。但报告未审查军事数据内容,也未提及微软以色列员工离职事件。本文分析事件核心:云基础设施、大规模监控和AI辅助目标选择在加沙的应用,并探讨对中国云服务商的启示。
-
AI代理将token变成核心商业指标:从订阅制到按量付费的token经济转型
随着AI代理工作流消耗数十倍于传统聊天的token,按量付费模式取代月费订阅成为主流。本文解析token定价差异、隐藏成本陷阱,以及为何token消耗量不是衡量AI价值的正确指标。
-
KPMG调查:仅26%企业完全掌握AI支出,多数公司盲目投入
KPMG调查显示,仅26%企业能完全追踪AI成本,多数公司对AI支出缺乏可见性。Ramp分析数十万公司数据发现AI支出激增,但管理滞后。本文解读调查核心发现,并分析对中国企业AI投入管理的启示。
-
Amazon Quick ARN 解析:跨账户迁移与命名空间权限管理实战指南
本文详解 Amazon Quick ARN 结构,通过类比邮政地址帮助理解跨账户迁移时权限失效的根本原因,并介绍 Asset Bundle API 的 OverrideParameters 用法。中文用户可借此掌握多租户架构下的资源隔离与权限设计要点。
-
AWS SageMaker AI 结合全同态加密实现端到端加密推理,保护数据隐私
AWS 发布新方案,将全同态加密(FHE)集成到 SageMaker AI 中,实现推理过程中数据全程加密。本文详解如何使用 concrete-ml 库训练和部署 FHE 模型,并对比机密计算方案。对医疗、金融等数据敏感行业意义重大,但需注意商用许可限制。
-
亚马逊 Nova Sonic 语音代理大规模测试工具开源,无需麦克风即可自动化评估
AWS 发布 Nova Sonic Test Harness 开源框架,支持自动运行多轮对话、LLM-as-judge 评估和音频幻觉检测,无需麦克风即可大规模测试语音代理。本文详解其工作原理、配置方法及对中文开发者的实用价值。
-
数学优化:当直觉失效时,企业如何用确定性AI做出更优决策
本文介绍数学优化作为AI子领域如何与机器学习互补,解决物流、制造、排班等复杂决策问题。AWS创新中心通过四步框架帮助客户实现显著成本节约和效率提升,对国内企业应用优化技术有参考价值。
-
Amazon Bedrock AgentCore 让代码代理在云端安全运行,合上笔记本也不怕
AWS 推出 Bedrock AgentCore Runtime,为每个代码代理分配独立微VM,支持 Claude Code、Codex、Kiro 等并行运行,持久化工作区、安全工具网关和可观测性,解决笔记本运行代理的痛点。了解对中文开发者的实际意义和替代方案。
-
AWS 推出跨区域推理功能,帮助欧洲用户合规使用生成式 AI 并优化模型访问
AWS 在 Amazon Bedrock 上推出跨区域推理(CRIS)功能,支持全球和欧盟地理区域内的模型请求自动路由,帮助用户平衡模型可用性与数据合规要求。本文详解 EU CRIS 配置、安全机制及对中文用户的意义。
-
小米MiMo与TileRT实现1万亿参数模型在商用GPU上每秒超1000 tokens推理速度
小米MiMo团队联合TileRT推出MiMo-V2.5-Pro-UltraSpeed,在单节点8块商用GPU上实现1万亿参数模型每秒超1000 tokens的推理速度。本文详解FP4量化、DFlash投机解码和TileRT运行时三大技术,并分析对中文用户的实际意义与国产替代可能性。
-
Google下单300万颗AI芯片,NVIDIA测试Intel工艺,台积电备胎计划浮出水面
Google向Intel订购超过300万颗AI芯片用于2028年,NVIDIA也在测试Intel的制造工艺用于下一代Feynman架构。台积电产能不足,Intel代工业务迎来翻身机会。本文分析这对中文芯片产业和AI用户的影响。
-
WWDC 2026 发布 Siri AI、iOS 27、Apple Intelligence 等,库克最后一次主持
苹果 WWDC 2026 主题演讲发布 Siri AI 升级、iOS 27、Apple Intelligence 平台等多项更新。这是 CEO 蒂姆·库克最后一次主持。了解新功能、中文用户可用性及国产替代对比。
-
微软Lens模型:3.8B参数靠GPT-4.1生成8亿详细描述,训练成本远低于竞品
微软研究院发布Lens文本到图像模型,仅3.8B参数,性能媲美更大模型。核心创新是用GPT-4.1生成8亿详细描述替代模糊网页alt文本,大幅降低训练成本。代码和权重开源,对中文用户意味着什么?