AI 快讯 · 第 11 页
-
Cursor 开源 MoK:面向 GB300 NVL72 的确定性 MoE 训练内核,性能提升 2.37 倍
Cursor Research 开源了 Mixture-of-Kittens (MoK),一个用于 MoE 训练的确定性 megakernel,在 GB300 NVL72 机架上比最强公开基线快 2.37 倍。本文解析其技术亮点、硬件门槛,并探讨对国内 AI 开发者的实际意义。
-
亚马逊 Bedrock 推出 Web Search 功能,为模型提供实时网络知识检索
亚马逊云科技宣布 Amazon Bedrock 的 Web Search 功能正式可用,作为内置工具,无需第三方供应商即可为模型提供实时网络知识,减少幻觉。本文介绍其工作原理、启用方法及对中文用户的意义。
-
MiniMax-H3 视频生成模型登陆 Apple Silicon:MLX 移植版实测,115GB 模型本地跑通
MiniMax 发布全模态生成系统 MiniMax-H3,支持文本、图像、音频和视频输入,可生成带音频的 15 秒视频。开发者 PipeNetwork 将其移植到 MLX,可在 Apple Silicon 上本地运行。本文实测 M5 Max MacBook Pro 运行效果,下载 115GB 模型,生成耗时 45 分钟,并分析对中文用户的实用价值与替代方案。
-
Pixel-Native RAG 实战:把网页和 PDF 当图片来做检索增强生成
本文介绍 PixelRAG,一个把网页和 PDF 渲染成图像、用多模态嵌入和混合检索构建视觉文档检索系统的端到端方案。涵盖渲染、分块、嵌入、FAISS 索引、混合搜索和评估,帮开发者实现高性能视觉 RAG。
-
Onton发布神经符号搜索模型Ontology 1,电商搜索精度超谷歌和亚马逊2.7倍
旧金山初创公司Onton推出神经符号搜索模型Ontology 1,在90个查询基准测试中,其precision@10达0.630,远超Google Shopping和Amazon。本文解析其技术原理、性能对比及对中文电商和AI搜索的启示。
-
Cogent AI发布VR-1:专为网络安全打造的推理模型,验证企业攻击路径
Cogent AI推出VR-1,首个专为网络安全后训练的推理模型,配合IntrusionBench基准和AI Harness运行时,能组合并验证企业攻击路径。本文解析其功能、性能及对中文圈安全从业者的意义。
-
阿里Qwen3.8-Max正式发布:2.4万亿参数MoE模型,开放权重下周上线
阿里Qwen团队将Qwen3.8-Max转为正式可用,2.4万亿参数MoE模型支持1M上下文,定价每百万输入2美元。开放权重下周发布,但部署需多节点数据中心。本文解析技术细节、性能表现及对中文开发者的影响。
-
GSK与Relation Therapeutics达成1.1亿美元合作,生物数据成AI药物发现关键
GSK与英国生物技术公司Relation Therapeutics达成最高1.1亿美元的研究合作,聚焦AI辅助药物发现。Relation将生成大规模人类细胞响应数据,用于训练AI模型识别药物靶点。本文解析合作细节、生物数据的重要性及对中文圈AI制药领域的启示。
-
量子密码难题被GPT-5.6 Sol Ultra三小时内独立破解两次,科研独立性引热议
两个研究团队使用OpenAI的GPT-5.6 Sol Ultra在3小时内独立解决了同一量子密码学开放问题,论文提交仅相隔3小时。本文解析事件细节、对科研独立性的影响,以及中文圈研究者如何利用AI工具加速科研。
-
Karpathy用Claude Opus 5将《指环王》段落转为3D场景,探索AI新测试
OpenAI联合创始人Andrej Karpathy用Claude Opus 5将《指环王》开篇段落转化为3D浏览器场景,生成5500行代码。本文解读这一AI能力测试的意义,并分析对中文开发者和创作者的启示。
-
MiniMax H3开源视频模型登顶AI视频排行,中国模型首次领跑
MiniMax发布H3视频模型权重,成为首个登顶AI视频排行榜的开源模型。本文解析H3的技术亮点、对中文圈开发者的意义,以及国产开源模型的竞争格局。
-
Interconnects 推出 Artifacts Hub 与 Adoption Dashboard,助力开源模型生态追踪
Interconnects 发布 Artifacts Hub 和 Adoption Dashboard,提供开源模型趋势、下载量及衍生模型数据,支持按地域和组织分析,揭示中美差距。本文详解功能、数据来源及对中文圈开发者的意义。
-
Interpol报告:AI已成非洲网络犯罪核心驱动,55%案件涉AI,损失翻倍至4.84亿美元
国际刑警组织最新报告显示,AI已深度介入非洲网络犯罪,55%案件涉及AI,经济损失从1.92亿增至4.84亿美元,深度伪造勒索案达60万起。本文解读报告要点,并分析对中文圈用户的安全启示与防范建议。
-
IBM报告:92%遭遇AI安全事件的企业缺乏基本访问控制,模型本身很少是问题
IBM最新报告显示,92%遭遇AI安全事件的企业在AI系统访问控制上存在不足,问题多出在权限管理而非模型本身。本文解析报告核心发现,并探讨对国内企业AI安全实践的启示,包括访问控制、数据合规等关键点。
-
欧盟AI法案第50条生效:生成式AI透明义务落地,企业如何合规?
欧盟AI法案第50条正式生效,要求AI提供商和部署者披露人机交互、标记AI生成内容。本文解析合规要点,并探讨对中文圈企业的影响与应对策略。
-
Amazon Bedrock 推出自动推理策略优化,简化策略调试流程
Amazon Bedrock 新增自动推理策略优化功能,自动诊断并修复策略中的规则和语言问题,用户审批后生效。本文详解两种优化模式及 API 工作流,帮助开发者提升策略验证效率。
-
David Crawshaw 提出用 cron 任务自动 rebase 开源软件,AI 编程代理的运维新思路
David Crawshaw 建议设置 nightly cron 任务,用一条 prompt 让 AI 自动拉取上游更新、rebase 本地修改并验证软件。本文解析这一思路对开源维护和中文开发者的实际意义,以及如何用现有工具实现类似自动化。
-
阿里发布Qwen 3.8模型,宣传视频反讽AI取代工作,中文用户如何看
阿里巴巴推出新AI模型Qwen 3.8,宣传视频展示AI工作而人享受爱好,与OpenAI和Anthropic的失业警告形成对比。本文解析该模型对中文用户的意义,包括与国产模型的对比、使用门槛及潜在影响。
-
AI 编程助手让开源软件自由修改成为现实:Simon Willison 谈 LLM 改变开发者生态
Simon Willison 认为 LLM 让开源软件的检查与修改门槛大幅降低,开发者可借助 Claude、Codex 等工具快速理解并构建代码。本文分析这一趋势对中文开发者的影响,以及国产 AI 编程工具的机遇。
-
F1 与 AWS 合作:agentic AI 将数据接入从 8 周缩短至 40 分钟
F1 与 AWS 合作构建 Data Accelerator,利用 Amazon Bedrock AgentCore 的 agentic AI 自动化数据源接入,将时间从 6-8 周降至约 40 分钟,并实现 GDPR 自动分类和端到端可观测性。本文详解其架构,并探讨对中文圈数据工程和 AI 应用的启示。