AI 快讯 · 第 36 页
-
Anthropic开发者分享Fable 5提示技巧:先发现自己的盲点,再交给Claude
Anthropic开发者Thariq Shihipar提出,Claude新模型Fable 5的瓶颈已从模型转向用户自身的盲点。他分享了盲点扫描和结构化访谈等技巧,帮助程序员系统性地发现无意识的知识缺口,再让Claude执行。对中文开发者而言,这些方法可提升提示工程效率,但需注意模型可用性和国产替代。
-
Anthropic 发布 Claude Science Beta:面向基因组学、蛋白质组学与化学信息学的多智能体 AI 工作台
Anthropic 推出 Claude Science Beta,一个专为科学家设计的 AI 工作台,支持多智能体协作、可重复性验证和本地/HPC/云端计算。它集成了 60+ 数据库和 NVIDIA BioNeMo 技能,可自动执行文献分析、数据管道和图表生成,并内置审查智能体确保结果准确性。
-
NVIDIA HORIZON 发布:免手动硬件设计 Agent,Git 工作树驱动 RTL 基准测试 100% 完成率
NVIDIA Research 推出 HORIZON,一个免手动硬件设计 Agent 框架,将 RTL 设计问题作为版本化仓库处理,通过 Git 工作树循环迭代,在 ChipBench、RTLLM-2.0 等基准测试中达到 100% 完成率。本文详解其工作原理、基准表现及对中文芯片设计社区的启示。
-
开源工具 pxpipe 将文本藏入 PNG 图片,为 Claude Code 节省最高 70% Token 费用
pxpipe 是一个新开源工具,通过将长文本 prompt 编码为紧凑 PNG 图片,利用 Anthropic 按像素而非文本内容计费的漏洞,为 Claude Code 和 Fable 5 节省 59%-70% 的 token 成本。但代价是准确性和速度下降。本文解析其原理、效果及对中文用户的实用价值。
-
模型越强,工具越差?Claude Opus 4.8 在第三方编程工具中编造字段导致调用失败
Armin Ronacher 发现新版 Claude 模型(Opus 4.8、Sonnet 5)在调用第三方编程工具 Pi 的自定义编辑工具时,会凭空编造额外字段,导致工具调用被拒绝。这源于 Anthropic 针对自家 Claude Code 编辑工具的强化训练,却意外破坏了其他工具的兼容性。本文分析问题根源,并探讨对中文开发者使用类似工具的影响。
-
Interfaze 开源 diffusion-gemma-asr-small:首个多语言扩散 ASR 模型,6 种语言单适配器转录
Interfaze 开源了 diffusion-gemma-asr-small,一个基于扩散解码器的多语言语音识别模型。它通过约 42M 参数的适配器,在 Google 的 DiffusionGemma 上实现音频转录,支持英语、德语、法语、西班牙语、印地语和普通话。转录成本取决于去噪步数而非文本长度,LibriSpeech 上 WER 6.6%,领先其他扩散 ASR 模型。
-
WebBrain 开源浏览器 AI 代理:本地运行、自动提取数据与操作网页,支持 Chrome 和 Firefox
WebBrain 是一款免费、MIT 许可的开源浏览器 AI 代理,支持 Chrome 和 Firefox。它能在本地模型上运行,保护隐私,也可连接云端 API。提供 Ask(只读)和 Act(操作)模式,可自动提取数据、填写表单、执行多步任务。本文介绍其功能、安全设计、定价及与同类工具的对比。
-
快手AI视频生成平台Kling融资20亿美元,筹备香港IPO
快手旗下AI视频生成平台Kling完成约20亿美元融资,并计划赴港IPO。本文解读Kling的技术优势、融资用途,以及对中文视频创作者和国内AI视频赛道的影响。
-
武田制药与英矽智能达成6亿美元AI药物发现合作,获全球独家开发权
日本武田制药与香港英矽智能签署6亿美元AI药物发现协议,武田将利用英矽智能的Pharma.AI平台进行靶点发现、分子设计和临床试验预测。合作首期支付6000万美元,总价值含里程碑付款。对中文圈用户,这标志着中国AI制药公司获得国际认可,国产AI药物发现平台商业化能力提升。
-
桥水基金测试:GPT和Claude在金融文档评估中败给开源微调模型,因正确答案从未公开
桥水基金与Thinking Machines Lab联合测试发现,经过微调的开源模型在金融文档评估中超越GPT-4和Claude,成本仅为十分之一。原因在于正确答案从未公开,揭示了通用大模型在专业领域的局限性。
-
Meta AI代理进展不及预期,扎克伯格内部承认重组遇阻
Meta CEO扎克伯格在内部全体会议上承认,公司围绕AI代理的重组进展慢于计划,暴露出组织调整的弱点。AI主管则给出更乐观的评估。本文分析Meta AI代理战略的现状及对中文圈用户的影响。
-
英国AI安全研究所:标准基准测试系统性地低估了AI Agent的真实能力
英国AI安全研究所(AISI)研究发现,标准AI评估因限制计算预算而低估了Agent能力。在软件工程任务中,token预算增加10倍,成功率提升约25%。前沿模型的实际进步速度比此前测量结果陡峭约60%。了解这一发现对AI能力评估和中文用户的影响。
-
AI 漏洞猎手引爆安全报告:2026年6月CVE数量创纪录,月报1500个高危漏洞
Epoch AI报告显示,2026年6月21家组织提交约1500个高危和严重级别CVE,是此前月纪录的3.5倍以上。AI驱动的漏洞挖掘程序是主要推手。本文分析这一趋势对中文网络安全社区的影响,包括国产AI漏洞工具的机会与挑战。
-
Claude Code 新技巧:让 Fable 模型自主判断,用低功耗模型子代理省 token
Anthropic Claude Code 团队分享使用技巧:不要硬性规定 Fable 模型的行为,而是让它自主判断何时用自动化测试、何时用低功耗模型。Jesse Vincent 建议用子代理运行低功耗模型来节省 token,适用于中文开发者优化 AI 编程成本。
-
微软合并Copilot应用并推出AutoPilot代理,加入AI超级应用竞赛
微软计划8月将消费者和企业版Copilot合并为一个应用,并推出名为AutoPilot的AI代理,可后台自动执行任务。了解这一变化对国内用户的影响、与国产AI的对比,以及中文用户如何受益。
-
lift-pdf 构建发票智能提取管线:从 PDF 到结构化 JSON 的完整教程
本文介绍如何使用 lift-pdf 构建端到端的应付账款提取管线,通过合成发票 PDF 和结构化 JSON schema 实现发票解析、验证与账目生成。包含 GPU 加载、4-bit 量化、提取评分等实用技术细节,适合财务自动化开发者。
-
知名前端开发者Josh Comeau:AI导致技术课程销量暴跌超50%,开发者学习意愿受冲击
前端专家Josh Comeau透露其新课程销量仅为以往的1/3,整体收入下降超50%。AI的双重冲击——就业焦虑和LLM替代教学——正在瓦解付费技术教育市场。本文分析这一趋势对中文圈开发者和课程创作者的启示。
-
Mistral AI 发布 Leanstral 1.5:Apache-2.0 开源 Lean 4 代码智能体,解决 587 个 Putnam 数学难题
Mistral AI 推出 Leanstral 1.5,一款基于 Apache-2.0 协议开源的 Lean 4 代码智能体模型。该模型采用 119B 参数混合专家架构,每 token 仅激活 6.5B 参数,在 PutnamBench 上解决 587/672 问题,并发现 5 个未报告的开源软件 bug。本文详解其架构、训练方法、性能基准及部署方式,并探讨对中文开发者和数学爱好者的实际…
-
开源AI差距地图发布:Current AI索引421个产品,揭示开源生态全景
Current AI发布Open Source AI Gap Map v0.1,详细索引421个开源AI产品,包括模型、工具、数据集和硬件项目。数据以MIT许可证开源,含1184个YAML文件,可通过Datasette Lite探索。本文解读地图内容及其对中文开发者的意义。
-
Google Health API 开源 CLI 工具 ghealth:用终端或 AI 代理管理 Fitbit 健康数据
ghealth 是一个开源 CLI 工具,将 Google Health API v4 封装为单一 Go 二进制文件,支持 40 种健康数据类型(如心率、睡眠、步数)以 JSON 格式输出。本文介绍其安装、使用方法、与官方 API 的对比,以及中文用户如何利用它管理 Fitbit 或 Pixel Watch 数据。