AI 快讯 · 第 44 页
-
AWS SageMaker AI 集成 NVIDIA Blackwell GPU:训练配置优化指南与中文用户实践建议
AWS 宣布 SageMaker AI 支持 NVIDIA Blackwell GPU(P6-B200 实例),通过更大内存、新精度格式和激活检查点技术,可显著提升大模型训练效率。本文详解如何配置 batch size、序列长度和精度格式以优化吞吐量,并分析对中文开发者的实际价值。
-
NVIDIA TensorRT 多设备推理支持:跨 GPU 扩展 AI 推理,优化生产部署
NVIDIA TensorRT 推出多设备推理支持,允许开发者跨多个 GPU 扩展生成式 AI 推理,同时保留内核融合、内存规划和量化等关键优化。本文详解其工作原理、性能优势及对中文开发者的实际意义。
-
DeepReinforce 发布开源编程模型 Ornith-1.0:模型在强化学习中自主习得 Scaffold,397B 版本 SWE-Bench 达 82
DeepReinforce 推出 Ornith-1.0 开源编程模型家族,基于 Gemma 4 和 Qwen 3.5,涵盖 9B 到 397B 四种尺寸。核心创新是模型在强化学习中自主习得 scaffold,而非使用固定框架。397B 旗舰模型在 SWE-Bench Verified 上达到 82.4,超越 Claude Opus 4.7,所有权重 MIT 许可。本文详解技术细节、基准成…
-
AWS 提出 Agentic Overlay:无需重写代码,为遗留 REST 服务添加 A2A 智能体通信能力
AWS 联合作者发布技术方案:通过 Agentic Overlay 薄包装层,将传统 REST 服务转化为支持 Agent-to-Agent (A2A) 协议的智能体,无需重写业务逻辑或并行部署。本文详解架构、代码示例及对中文企业用户的实用价值。
-
德国法院裁定Google对AI概览错误负责:AI不是免责挡箭牌
德国里程碑式判决:Google必须为AI Overviews中的错误信息承担法律责任。安全专家Bruce Schneier指出,AI代理是部署者的代理,企业不能以AI出错为由逃避责任。这对国内AI应用合规有重要参考价值。
-
DFlash 投机解码:并行生成整块 Token,NVIDIA Blackwell 上吞吐量提升 15 倍
UC San Diego 团队提出 DFlash,用轻量块扩散模型替代自回归草稿模型,实现并行生成整块 Token。在 Qwen3-8B 上实现 6.08 倍无损加速,NVIDIA Blackwell 上吞吐量提升 15 倍。支持 SGLang、vLLM、TensorRT-LLM,已开源 20 个检查点。
-
2026年16款最佳AI编程工具对比:功能、适用场景与中文用户选择指南
2026年AI编程工具已从自动补全进化到全应用生成。本文对比16款主流工具,包括Atoms、GitHub Copilot、Tabnine等,分析各自特点与适用场景,并给出中文用户的选择建议,帮助开发者找到最适合自己的AI编程助手。
-
Anthropic 在 Slack 中推出 Claude Tag 功能,让 AI 代理直接融入团队协作
Anthropic 发布 Claude Tag 测试版,允许用户在 Slack 频道中通过 @Claude 调用 AI 代理执行任务。该功能基于 Opus 4.8 引擎,支持异步工作、上下文追踪和跨应用操作。企业采用率达 34.4%,超越 OpenAI。本文分析其对中文用户的意义、国产替代方案及合规风险。
-
Anthropic推出Claude Tag:在Slack中@Claude即可调用AI,内部65%代码由AI生成
Anthropic发布Claude Tag功能,将AI助手直接嵌入Slack,团队成员通过@Claude即可分配任务。该公司称内部产品团队65%的代码已由AI生成。本文介绍功能细节、对中文用户的使用门槛及国产替代方案。
-
Mistral 发布 OCR 4 模型:盲测 72% 胜率,文档识别能力超越竞品
Mistral AI 推出 OCR 4 模型,专用于从 PDF、Word、PPT 等文档中提取文字。据公司称,在盲测中该模型以 72% 的胜率击败竞品。本文详解其技术细节、性能表现,并分析对中文用户的实际价值与国产替代方案。
-
Nous Research 为 Hermes Agent 新增 /learn 命令:无需手写 SKILL.md,自动从文档、对话中生成可复用技能
Nous Research 为开源 AI 代理 Hermes Agent 的 Skills System 新增 /learn 命令。用户只需提供本地目录、文档 URL、历史对话或笔记,代理即可自动生成符合标准的 SKILL.md 文件,无需手写。本文详解工作原理、使用场景及对中文开发者的实用价值。
-
Graphify + NetworkX 教程:离线构建 Python 代码知识图谱,分析上帝节点与社区结构
本教程演示如何用 Graphify 和 NetworkX 离线构建 Python 代码知识图谱,无需 API key 或 LLM。你将学会提取模块依赖、发现上帝节点、检测社区结构,并生成可视化。适合代码重构、架构审查场景。
-
三星全面开放ChatGPT Enterprise和Codex,员工AI工具使用解禁
三星电子宣布为全体员工提供ChatGPT Enterprise和Codex访问权限,覆盖韩国及全球DX部门。此举解除2023年因数据安全担忧实施的AI工具限制,涉及软件开发、营销、制造等业务。了解三星如何平衡AI生产力与数据保护,以及对中国企业AI部署的启示。
-
Pangram CEO:语言模型生成论点高度雷同,人类多样性成AI检测突破口
Pangram CEO Max Spero指出,语言模型在生成多个论点时往往高度相似,而人类推理更具多样性。这一差异可能成为AI文本检测的新方法。本文解析该观点对中文用户的意义,包括AI写作工具的使用和检测技术发展。
-
OpenAI部署主管谈Codex爆发式增长、AI价格暴跌与ROI问题
OpenAI部署主管Arnaud Fournier详解DeployCo如何用自研工程师将AI嵌入大企业,Codex爆发式增长,客户反馈驱动模型迭代,以及AI智能价格为何大幅下降。对中文圈企业部署AI有参考价值。
-
OpenAI与博通联合发布Jalapeño芯片,专为大模型推理设计,2026年底规模部署
OpenAI与Broadcom合作推出定制芯片Jalapeño,专为LLM推理优化,计划2026年底大规模部署。本文解读该芯片的技术定位、对中文用户的影响,以及与国产芯片的对比。
-
NVIDIA GPU 加速 BEV Pooling:自动驾驶与机器人感知性能提升 10 倍
NVIDIA 发布 TensorRT 插件加速 BEV Pooling 操作,在自动驾驶、机器人等物理 AI 应用中实现 10 倍性能提升。本文详解技术原理、实测数据,并分析对国内自动驾驶和机器人开发者的实际影响。
-
Figma Config 2026:押注人类判断,但AI能力全来自第三方API,利润承压
Figma在Config 2026上推出代码、动画、着色器和AI代理,将画布扩展为完整工作空间。但其AI能力全部租用第三方API,利润被挤压,且其中一家供应商正在构建竞品设计工具。本文分析Figma的战略赌注及对中文设计圈的启示。
-
Loka 用 Amazon Nova 2 Sonic 构建低延迟语音助手,Big Bench Audio 得分超 GPT Realtime
Loka 基于 Amazon Nova 2 Sonic 构建了自然低延迟的语音代理,在 Big Bench Audio 上语音推理得分 87.0,超越 GPT Realtime 的 83.0。本文详解其架构、成本(约 $0.27/小时)及提示词优化方法,对中文圈开发语音助手有直接参考价值。
-
Snowflake 语义视图 + Amazon Quick 实现 AI 驱动 BI,中文用户如何受益?
AWS 发布教程,展示如何集成 Snowflake 语义视图与 Amazon Quick,实现自然语言查询 BI 仪表盘。本文详解架构、步骤,并分析对中文圈用户的实际价值、国产替代方案及合规考量。