AI 快讯 · 第 23 页
-
阿里通义实验室发布Qwen-Audio-3.0-TTS:Flash和Plus双版本,支持16种语言和86种精细标签控制
阿里通义实验室推出Qwen-Audio-3.0-TTS,提供Flash(实时)和Plus(高质量)两个版本,通过阿里云Model Studio以API形式提供服务。模型支持16种语言和20种中文方言,Plus版在Artificial Analysis TTS排行榜上排名第一,定价约$27.59/百万字符。本文详解技术细节、中文用户使用门槛及与国产竞品对比。
-
单GPU微调Qwen3:NVIDIA NeMo AutoModel + LoRA完整Colab教程
本文详细演示如何在Google Colab单GPU环境下,使用NVIDIA NeMo AutoModel对Qwen3-0.6B进行LoRA参数高效微调。涵盖环境配置、YAML配方修改、训练执行及模型对比,适合资源有限的开发者快速上手。
-
Kimi K3 vs DeepSeek V4 Pro vs GLM-5.2:三款万亿级开源MoE模型对比评测
深度对比月之暗面Kimi K3、DeepSeek V4 Pro和智谱GLM-5.2三大国产开源MoE模型,从基准测试、许可证和部署成本三个维度分析,帮你选择最适合的模型。
-
Claude Code 已改用 Rust 重写的 Bun 运行时,启动速度提升 10%
Anthropic 的 Claude Code v2.1.181 起内部集成了用 Rust 重写的 Bun 运行时,启动速度在 Linux 上提升 10%。本文通过技术验证确认了这一变化,并分析对中文开发者的实际影响。
-
10个开源无代码AI平台:构建LLM应用、RAG系统和AI代理,中文用户如何选?
本文盘点10个开源无代码/低代码AI平台,涵盖LLM应用、RAG系统和AI代理构建。每个平台均附许可证、仓库地址和适用场景。中文视角分析国内平替、部署门槛和合规建议,帮你快速选型。
-
AI狂热正在摧毁全球决策能力:高管未用ChatGPT却制定AI战略
一篇揭露AI行业泡沫的辛辣文章,通过匿名高管和工程师的爆料,展示企业如何因AI狂热做出非理性决策。对中文圈用户意味着警惕跟风,回归业务本质。
-
Perplexity 发布 WANDR 基准测试:评估研究型 AI Agent 的广度和深度搜索能力
Perplexity AI 推出 WANDR,一个包含 500 个证据密集型任务的开源基准测试,用于评估 AI 研究 Agent 的广度和深度搜索能力。其 Search as Code 系统以 0.363 soft F1 领先,但所有系统均未解决该基准。本文详解 WANDR 的评估方法、结果及对中文开发者的意义。
-
AI读X光片自信满满却错误频出:RadLE 2.0基准测试揭示风险,人类放射科医生仍不可替代
RadLE 2.0基准测试评估AI在放射影像诊断中何时应交给人类。结果显示,许多AI模型在错误时仍高度自信,人类放射科医生准确率远超AI。对中文医疗AI应用有重要警示。
-
AI文本检测器遇新挑战:当大模型模仿作者风格时,漏检率最高达48%
Epoch AI最新测试显示,Pangram、GPTZero和Originality.ai等主流AI文本检测器在应对风格模仿文本时表现不佳,科学写作场景漏检率高达48%。本文解析测试结果及其对中文用户的影响。
-
月之暗面 Kimi K3 前端代码超越 Claude Fable 5,但复杂数学仅 39% 落后 OpenAI 近 90%
月之暗面发布 Kimi K3,在 Code Arena 前端代码排行榜上超越 Claude Fable 5 和 GPT-5.6 Sol,成为首个登顶的中国模型。但在 FrontierMath Tier 4 高级数学测试中仅得 39%,远低于 OpenAI 和 Anthropic 的近 90%。本文分析 Kimi K3 的强项与短板,并探讨对中文开发者的实际意义。
-
Google DeepMind 新模型 GenCeption:视频生成器已蕴含计算机视觉所需的通用世界模型
Google DeepMind 提出 GenCeption 方法,利用视频生成器完成深度估计、分割等经典视觉任务,性能媲美 SOTA 系统,且训练数据几乎全为合成视频。这一成果引发热议:视频生成器是否已内建通用世界模型?对中文圈用户意味着什么?
-
阿里预览Qwen3.8-Max:2.4万亿参数多模态模型,紧随月之暗面Kimi K3开源之后
阿里Qwen团队预览Qwen3.8-Max-Preview,号称2.4万亿参数、仅次于Fable 5。预览版已上线,但基准测试、模型卡、许可证均未公布。本文区分已确认与仅声称的信息,并分析对中文开发者的实际意义。
-
Feyn AI 发布 SQRL 文本转 SQL 模型族:查询前先探查数据库,BIRD 准确率 70.6% 超越 Claude Opus 4.6
Feyn AI 推出 SQRL 模型族,通过只读探查数据库解决文本转 SQL 的歧义问题。旗舰版 SQRL-35B-A3B 在 BIRD Dev 上达 70.6% 执行准确率,超越 Claude Opus 4.6。提供 4B、9B 和 35B 三个开源版本,支持本地部署,适合中文用户构建私有数据查询系统。
-
Claude Fable 5 永久保留:Anthropic 因竞争压力取消移除计划,Max 和 Team Premium 用户可用
Anthropic 宣布 Claude Fable 5 将永久保留在订阅计划中,Max 和 Team Premium 用户可享 50% 限额。此前计划因 GPT-5.6 Sol 和 Kimi 3 竞争而调整,Pro 用户获 $100 信用额度。了解对中文用户的影响与替代方案。
-
用 Biopython 在 Google Colab 搭建质粒工程工作台:环形图谱、酶切分析、虚拟凝胶与引物设计
本教程教你用 Biopython、NumPy 和 Matplotlib 在 Google Colab 中构建一个功能完整的质粒工程工作台,支持环形/线性图谱绘制、限制性酶切位点分析、虚拟酶切凝胶模拟、ORF 扫描、CDS 翻译和引物设计。无需本地安装,离线也能运行,适合生物信息学初学者和分子生物学研究者快速上手。
-
Sakana AI 提出 Error Diffusion:无需反向传播训练 Dale 兼容网络,MNIST 达 96.7%、CIFAR-10 达 61.7%
Sakana AI 发布新研究 Error Diffusion(误差扩散),一种无需权重传输的局部学习规则,训练出符合 Dale 原则的双流兴奋/抑制网络。在 MNIST 和 CIFAR-10 上分别达到 96.7% 和 61.7% 准确率,并首次在卷积网络和强化学习中验证。本文解读其核心机制、性能对比及对中文圈生物启发 AI 研究的启示。
-
Google Cloud 发布 Always-On Memory Agent,用持续 LLM 整合替代 RAG 和 Embedding
Google Cloud 开源 Always-On Memory Agent,基于 Gemini 3.1 Flash-Lite 和 ADK,无需向量数据库和 embedding,通过持续运行的 LLM 将记忆写入 SQLite。本文解析其 Ingest-Consolidate-Query 架构,并讨论对中文开发者的意义。
-
美国海军AI战略:慢速采用风险大于“不完美对齐”,LLM将直接部署战舰
美国海军部签署新战略,将AI“武器化”并打造“AI优先”舰队,大型语言模型直接运行在军舰上。核心观点:行动缓慢比“不完美对齐”风险更大。本文解读该战略对军事AI竞赛的影响,以及对中国AI安全与军事应用的启示。
-
开源模型网络攻击能力追上四个月前闭源前沿,成本仅几分之一,英国AI安全机构警告
英国AI安全研究院(AISI)报告称,GLM-5.2、DeepSeek V4-Pro等开源权重模型在网络攻击能力上已接近四至七个月前的闭源前沿水平,且安全措施几乎无效。中文用户需关注开源模型滥用风险及国产模型的安全防护。
-
习近平宣布成立世界人工智能合作组织,中国打造平行AI治理体系
在上海世界人工智能大会上,习近平宣布成立“世界人工智能合作组织”,并为全球南方国家提供5000个AI培训名额。中国正系统性地构建一个不受西方影响的平行AI治理架构,计划与东盟、非盟、金砖国家等建立合作中心。