AI 快讯 · 第 45 页
-
用 Amazon Nova 2 Sonic 构建医疗预约语音助手,降低爽约率
AWS 发布基于 Nova 2 Sonic 和 Bedrock AgentCore 的医疗预约语音代理示例,支持患者身份验证、预约确认/取消/改期、预诊信息收集,并可转接人工。本文详解架构与工具链,并分析对中文医疗场景的适用性。
-
亨廷顿银行用AWS从4亿文档中自动识别并删除敏感数据,处理时间从数年缩短至数月
亨廷顿银行利用Amazon Textract、SageMaker、Step Functions等AWS服务,构建可扩展的文档处理流水线,从4亿+文档中检测并删除PII和PCI数据,准确率超95%,成本仅为原估算的5%。本文详解技术架构与规模化挑战。
-
Tom MacWright 谈 AI 生成简历:完美但匿名,招聘者看不到真实的你
Tom MacWright 指出,越来越多求职者用 LLM 生成简历、作品集和 GitHub 项目,导致简历千篇一律、毫无个性。本文分析这一现象对招聘的影响,并探讨中文圈求职者应如何平衡 AI 工具使用与个人真实表达。
-
从零搭建OpenHarness风格Agent运行时:工具、记忆、权限、技能与多智能体协作
本文手把手教你从零实现一个OpenHarness风格的Agent运行时,涵盖工具调用、权限管理、记忆、技能、上下文压缩、重试逻辑、成本追踪和多智能体协调等核心模块。无需API Key即可运行,适合想深入理解Agent框架内部机制的中文开发者。
-
OpenAI 更新 GPT-5.5 Instant:意图识别和上下文理解大幅提升,对话更自然
OpenAI 升级其最常用的 ChatGPT 模型 GPT-5.5 Instant,重点改善对话质量:意图识别更准、多轮上下文保持更好、复杂条件指令处理更可靠。了解这次更新对中文用户的实际影响和国产替代方案。
-
Gradium 发布实时语音翻译模型 stt-translate 和 s2s-translate,精度和延迟超越 GPT 实时翻译
Gradium 推出两款实时语音翻译模型 stt-translate 和 s2s-translate,支持英语、法语、德语、西班牙语和葡萄牙语共 20 个语言对。通过将传统三模型级联压缩为两阶段,在 BLEU 和 MetricX 指标上超越 gpt-realtime-translate 和 gemini-3.5-live-translate,平均延迟 3.0 秒,并支持输出语音选择和克隆…
-
Moebius 0.2B 图像修复模型成功移植到浏览器,WebGPU 运行无需显卡
Simon Willison 将仅 0.2B 参数的 Moebius 图像修复模型移植到浏览器,通过 WebGPU 实现本地运行。本文介绍移植过程、技术细节,并分析对中文用户的意义:无需高端显卡、可离线使用、国产平替对比。
-
Prompt Injection 新研究:模型更信风格而非内容,攻击成功率从 61% 降至 10%
最新研究揭示 LLM 在区分角色标签时更依赖文本风格而非内容,导致 prompt injection 攻击。通过“去风格化”可将攻击成功率从 61% 降至 10%。对中文开发者使用 API 和本地模型有重要安全启示。
-
电信运营商如何用Agentic AI构建自治网络:NVIDIA技术详解
NVIDIA发布博文详解电信运营商如何利用Agentic AI(自主AI代理)从TM Forum L2-L3自动化迈向L4-L5完全自治网络。本文翻译核心内容,并分析对国内运营商、设备商及中文AI从业者的启示与潜在影响。
-
GLM-5.2 OpenAI 兼容 API 上手指南:推理控制、函数调用与长上下文检索实操
本文手把手教你通过 OpenAI 兼容 API 调用 GLM-5.2,涵盖推理强度控制、流式推理、函数调用、工具代理、结构化 JSON 输出和长上下文检索,并附 token 成本计算,适合开发者快速上手。
-
Prime Intellect 发布 prime-rl 0.6.0:开源框架支持万亿参数 MoE 模型强化学习训练
Prime Intellect 推出 prime-rl 0.6.0,一个用于万亿参数 MoE 模型异步强化学习的开源框架。该框架在 28 个 H200 节点上训练 GLM-5 模型,支持 131k 序列长度,步骤时间低于 5 分钟。本文详解其 FP8 推理、专家并行、预填充/解码分离等优化技术,并探讨对中文圈用户的实际意义。
-
五眼联盟警告:AI网络威胁将在数月内影响普通用户,GPT-5.5-Cyber等模型降低犯罪门槛
五眼联盟网络安全负责人发布罕见联合情报简报,指出GPT-5.5-Cyber、Mythos等AI模型将在数月内大幅提升黑客攻击能力,普通用户面临更严峻的钓鱼攻击和数据泄露风险。本文解读威胁机制、对中文用户的影响及防御建议。
-
OpenAI 发布 GPT-5.5-Cyber 安全模型,在网络安全基准测试中超越 Anthropic Mythos
OpenAI 推出 GPT-5.5-Cyber 专用安全模型,在网络安全基准测试中超越 Anthropic 的 Mythos。该模型集成于 Daybreak 计划,可自动发现并修复漏洞,已与 25 家安全公司和多个政府合作。了解其对中文用户的安全工具选择影响。
-
字节跳动Seedance 2.5突破30秒AI视频生成时长,7月初上线火山引擎
字节跳动在火山引擎FORCE大会上发布Seedance 2.5视频模型,支持生成30秒以上连贯视频,突破行业时长瓶颈。本文解读技术亮点、中文用户使用门槛及与国产竞品对比。
-
NVIDIA BioNeMo Agent Toolkit 发布:用 AI 科学家加速生命科学发现
NVIDIA 推出 BioNeMo Agent Toolkit,让开发者构建能自主阅读论文、编写代码、生成假设的 AI 科学家。本文详解其架构、应用场景,并分析对中文生命科学研究者及国产 AI 工具的影响。
-
NVIDIA Blackwell 用 DFlash 投机解码将推理性能提升 15 倍
NVIDIA 发布 DFlash 投机解码技术,在 Blackwell GPU 上实现最高 15 倍推理加速。本文详解其原理、性能数据,并分析对中文开发者使用国产 GPU 进行大模型推理的启示与平替方案。
-
Amazon Bedrock AgentCore 多租户架构:池模型实现租户隔离与成本追踪
AWS 发布基于 Bedrock AgentCore 的多租户 AI 应用架构方案,通过池模型实现租户隔离、服务分层和成本归因。本文详解其设计思路,并分析对国内 SaaS 开发者和 AI 应用构建者的参考价值。
-
用 Amazon Bedrock AgentCore 构建蛋白质研究助手:自然语言搜索相似肽段
本文介绍如何用 Amazon Bedrock AgentCore 和 Strands Agents SDK 构建一个对话式蛋白质研究助手,实现自然语言查询解析、基于 ESM-C 300M 的向量相似搜索和 AI 生成科学摘要。适合生物信息学开发者、AWS 用户及对 AI+生命科学感兴趣的技术人员。
-
NVIDIA 全栈推理与训练优化:AI 工厂能效提升,每瓦特性能决定 Token 成本
NVIDIA 发布全栈推理与训练优化方案,从硬件、软件到系统层面提升 AI 工厂能效。电力成本占运营支出 40%,每瓦特性能直接影响 Token 成本。本文详解优化策略及对中文圈用户的影响。
-
Omio 整合 OpenAI 模型加速旅游产品开发,工程效率提升 80%
旅游平台 Omio 将 OpenAI Codex 嵌入全软件开发生命周期,工程效率提升至原来的 20%,并推出基于实时数据的对话式预订界面。本文详解其技术落地细节及对中文用户的启示。