AI 快讯 · 第 59 页
-
ClawHub Security Signals 教程:用 AI 技能数据集做端到端安全信号分析与分类
本文通过 ClawHub Security Signals 数据集,展示如何加载、分析并建模多个安全扫描器对 AI 技能文件的评估结果,包括 VirusTotal、静态分析和 SkillSpector 的对比与一致性计算,并构建逻辑回归模型预测 ClawScan 判定。适合安全分析师和 AI 开发者了解多扫描器协同分析流程。
-
NVIDIA garak 教程:构建完整的大模型红队防御工作流,含自定义探针与检测器
本文详解 NVIDIA garak 框架,教你如何设置、发现插件、运行扫描、分析安全评分与攻击成功率,并创建自定义探针和检测器,最终导出 AVID 格式漏洞报告。读完可掌握 LLM 红队测试的完整流程。
-
Harness-1 发布:20B 参数检索子智能体,用强化学习在状态化搜索框架中训练,开源权重和代码
UIUC、UC Berkeley 和 Chroma 联合推出 Harness-1,一个 20B 参数的检索子智能体。它通过状态化搜索框架分离决策与簿记,在 8 个基准上平均 curated recall 达 0.730,超越其他开源模型 11.4 分,仅次于 Opus-4.6。权重和代码已开源。
-
研究揭示大语言模型为何能学会小模型学不会的技能:频繁任务覆盖是关键
一项新研究解释了为什么大语言模型能掌握小模型学不会的罕见技能:频繁任务会不断覆盖小模型已学内容。通过4M到4B参数模型实验,研究者发现增加目标任务在训练数据中的出现频率,可能比单纯扩大模型规模更有效。这对中文用户优化模型训练成本有重要启示。
-
2026年最佳21款低代码/无代码AI工具盘点:从提示词到应用一键生成
2026年低代码/无代码AI平台已进化至从提示词直接生成应用、智能体或模型。本文盘点21款主流工具,涵盖应用构建、自动化、AI Agent和机器学习平台,并附官方链接。读完可快速了解各工具定位及选型建议。
-
ChatGPT 推出 Lockdown Mode:禁用联网与 Agent 模式,防御提示注入攻击
OpenAI 为 ChatGPT 新增 Lockdown Mode,可禁用联网、Deep Research 和 Agent 模式,防止敏感数据通过提示注入被窃取。该模式并非完全免疫,但能阻断数据外泄的最后一步。了解其原理、局限性及对中文用户的影响。
-
Perplexity 推出 Search as Code:让 AI 模型用 Python 自写搜索管道,成本降低 85%
Perplexity 发布全新 Search as Code 架构,AI 模型不再调用固定搜索 API,而是用 Python 代码自主构建搜索管道。在关键基准测试中超越 OpenAI 和 Anthropic,token 成本最高降低 85%。了解这一创新对中文开发者和搜索场景的影响。
-
OpenAI 称“聊天已死”,计划将 ChatGPT 重构为全能 Agent 应用
OpenAI 计划对 ChatGPT 进行自发布以来最大规模的重构,将其打造成集成编程工具、AI Agent 和第三方应用(如 Canva、Booking.com)的“超级应用”。内部认为“聊天已死”,未来属于能自主处理任务的 Agent。本文解读这一战略转变对中文用户的影响。
-
DeepSeek 登顶美国企业软件增速榜:2026 年 6 月 Ramp 数据揭示企业追逐低价 AI 模型
2026 年 6 月,DeepSeek 成为美国企业支出管理平台 Ramp 上增速最快的付费软件供应商,反映出美国公司对低成本 AI 模型的强烈需求。Ramp 首席经济学家指出成本意识是主要驱动力,但也警告使用中国模型存在安全风险。本文分析 DeepSeek 在美国企业中的崛起及其对中文圈用户的影响。
-
GEPA 框架教程:多组件提示词优化与结构化反馈提升小模型算术能力
本文介绍 GEPA 反思式提示词进化框架,通过多组件提示词、结构化反馈和留出验证集,优化小语言模型解决多步算术应用题的能力。包含完整代码实现与中文用户视角分析。
-
OpenAI 推出 Lockdown Mode 锁定模式,防御提示注入攻击数据窃取
OpenAI 正式上线 Lockdown Mode(锁定模式),旨在阻止提示注入攻击的最后阶段——数据外泄。该功能通过限制出站网络请求来防止敏感数据被窃取,适用于 Free、Go、Plus、Pro 及 ChatGPT Business 账户。本文解析其原理、对中文用户的安全意义及与国产模型的对比。
-
MicroPython+WASM沙箱运行Python代码:开源项目micropython-wasm发布
Simon Willison发布micropython-wasm,通过MicroPython编译为WASM在浏览器或服务器端沙箱中安全运行Python代码,解决插件系统权限过高问题。对中文开发者意味着低成本的代码隔离方案,但需注意性能限制和国产替代方案。
-
阿里Qwen3.7-Plus发布:多模态AI变身自主智能体,11小时写万行代码
阿里Qwen团队推出Qwen3.7-Plus,一个将视觉感知、GUI操作和编程整合为自主智能体的多模态模型。演示中,它11小时内自主开发了一款单词学习应用,生成超万行代码。模型在屏幕理解基准上领先,但整体表现参差不齐。本文解读其能力、定价及对中文开发者的意义。
-
OpenAI与特朗普政府谈判政府持股,拟设公共财富基金直接向美国公民分红
OpenAI正与特朗普政府谈判政府直接持股,计划通过公共财富基金向美国公民分红。参议员桑德斯提议对AI股票征收50%税。分析人士担忧此举可能制造类似2008年金融危机的“大而不倒”风险。了解谈判细节、各方立场及对AI行业的影响。
-
NVIDIA 开源 Nemotron 3.5 ASR:600M 参数流式语音模型,单模型支持 40 种语言实时转录
NVIDIA 发布 Nemotron 3.5 ASR,一个 600M 参数的流式语音识别模型,单 checkpoint 支持 40 种语言实时转录,内置标点和大小写,缓存感知架构实现低延迟。开源权重可自托管,支持 fine-tuning,中文用户可关注其多语言覆盖和国产替代对比。
-
SpaceX IPO前与谷歌签9.2亿美元月租协议,提供11万块英伟达AI芯片
SpaceX在IPO前与谷歌达成每月9.2亿美元的AI计算能力租赁协议,提供约11万块英伟达芯片,用于支撑Gemini Enterprise平台。这笔交易凸显AI基础设施的稀缺性,以及科技巨头间日益紧密的依赖关系。
-
月之暗面开源 Kimi Code CLI:终端 AI 编程代理,支持子代理与 MCP 配置
月之暗面(Moonshot AI)发布 Kimi Code CLI,一款 MIT 开源协议、基于 TypeScript 的终端 AI 编程代理。它可读/写代码、运行命令、搜索文件,并内置子代理与 MCP 配置。本文详解功能、安装、使用场景,并对比 Claude Code、Codex CLI 等同类工具,分析对中文开发者的实用价值。
-
开源语音模型Audio Interaction:持续监听每0.4秒决定是否说话,超越GPT-4o
新开源模型Audio Interaction实现不间断语音交互,每0.4秒决策是否响应,支持翻译、转录、聊天及环境音识别。对比GPT-4o和Qwen3.5-Omni,无需等待录音结束。代码和权重已开源,对中文开发者意味着什么?
-
xAI被曝数月用Claude输出训练代码模型,遭封禁后仍用私人账户绕过
据The Decoder报道,马斯克的xAI被指长期使用Anthropic的Claude输出训练自家代码模型,即使被切断访问仍通过私人账户和Blackbox AI服务继续。同时xAI预训练团队缩至不足5人,多名负责人离职,马斯克囤积的算力反而租给了Anthropic和Google。
-
Meta 推出付费 AI 代理 Hatch,月费最高 200 美元,首次尝试 AI 产品收费
Meta 正在开发名为 Hatch 的付费 AI 代理,用户用自然语言描述需求,Hatch 即可构建工具、安排日程或发送邮件。月费最高 200 美元,这是 Meta 首个付费 AI 产品,旨在开辟广告之外的收入来源。本文分析其对中文用户的影响及与国产 AI 代理的对比。