AI 快讯 · 第 7 页
-
Liquid AI发布LFM2.5-2.6B:128K上下文、工具调用、开放权重的端侧智能体模型
Liquid AI推出LFM2.5-2.6B,一款2.69B参数的端侧智能体模型,支持128K上下文、工具调用,权重开放。本文解析其架构、性能、部署方式,并探讨对中文开发者的影响与国产模型对比。
-
微软开源 code-testing-generator:多语言单元测试 Agent 任务完成率 92.1%,超越 Copilot
微软开源 code-testing-generator,一个基于 Research-Plan-Implement 管道的多语言单元测试 Agent,在内部基准上任务完成率达 92.1%,优于 GitHub Copilot 的 78.9%。本文解析其工作原理、基准数据,并探讨对中文开发者的实用价值与替代方案。
-
亚马逊、Cursor、微软、OpenAI、Vercel联手推出AI代理插件开放标准Agent Plugins
亚马逊、Cursor、微软、OpenAI和Vercel共同发布Agent Plugins开放标准,统一AI代理扩展的包格式,支持agent skills和MCP servers。了解这一标准如何简化插件开发、对开发者的意义,以及国内生态的应对。
-
阿里发布Qwen3.8-Max,DeepSeek V4-Flash低价搅局,中国AI模型价格战升级
阿里推出2.4万亿参数的Qwen3.8-Max,DeepSeek V4-Flash以超低推理价格搅局,中国AI模型竞争转向成本效率。本文解析模型参数、定价策略及对中文用户的实际影响,帮助开发者选择性价比最高的模型。
-
字节跳动训练10万亿参数AI模型,规模达Kimi K3三倍,或成中国最大
据金融时报报道,字节跳动正在训练参数高达10万亿的AI模型,规模是月之暗面Kimi K3的三倍,有望成为中国最大AI模型。本文解析其技术意义、对国内AI竞争格局的影响,以及普通用户何时能用上。
-
OpenAI智能音箱2027年上市:冰球大小、售价超300美元,硬件布局初现
OpenAI首款硬件设备智能音箱预计2027年发货,外形似冰球,售价超300美元。本文解析其设计、定位及对中文用户的影响,对比国内智能音箱市场与AI硬件趋势。
-
PRISM2模型:Paige与微软合作,用临床对话解读病理切片,提升癌症检测准确率
Paige和微软联合推出PRISM2病理AI模型,通过临床对话训练解读全切片图像,在泛癌检测中AUC达0.967。本文解析其架构、性能及对中文医疗AI的启示。
-
Red Hat、NVIDIA、IBM 力挺 asago 项目,把 AI 政策变成代码
Red Hat 推出开源项目 asago,旨在将 AI 治理政策自动转化为生产级部署代码,获得 NVIDIA、IBM 等支持。本文解析 asago 的四阶段工作流、审计追踪特性,并探讨对中文企业合规与国产 AI 生态的启示。
-
斯坦福与Arc研究所用AI设计新病毒杀死细菌,实现完整基因组生成设计
斯坦福大学与Arc研究所科学家利用AI设计出能杀死细菌的新型病毒,号称首次实现完整基因组的生成设计。本文解读这一突破对生物技术、合成生物学及中文圈科研与产业的影响,并探讨潜在风险与监管挑战。
-
阿里测试Qwen开源AI新商业模式,拟对商用大客户引入收入分成
阿里巴巴计划为其下一代Qwen开源模型引入收入分成条款,要求通过模型服务盈利的大公司与阿里达成商业协议。本文解析该模式对国内开发者和企业的潜在影响,并对比Kimi K3的类似做法。
-
MIT研究:医疗AI解释界面需适配用户专业水平,非专家更易受误导
MIT与斯坦福等机构研究发现,医疗AI解释工具对非专家和初级保健医生的效果截然不同。非专家更依赖AI解释,错误输出时受损更大;医生则不受影响。研究强调界面设计需考虑用户专业水平,对中文圈医疗AI应用有重要启示。
-
AI 如何改变 Instagram 互动而不取代人性化:2026 年算法与内容策略解析
Instagram 2026 年互动率仅 0.7%,AI 算法决定内容分发,但人性化内容更受青睐。本文解析 AI 在互动、私信和内容创作中的作用,探讨对中文用户和创作者的影响,提供实用策略。
-
斯坦福Evo 2 AI模型生成噬菌体对抗大肠杆菌,开启AI设计病毒新纪元
斯坦福大学研究人员利用Evo 2生成式AI模型设计并合成了近300种噬菌体,其中16种对大肠杆菌有强杀灭作用。本文详解技术流程、抗药性策略及开源影响,并探讨对中文圈生物科技与AI应用的意义。
-
AWS用约束编程自动确定NHL季后赛晋级场景,数学上保证准确
AWS生成式AI创新中心开发了一套系统,利用约束编程和自定义树搜索,自动确定NHL球队何时以及如何锁定季后赛席位,结果与官方发布完全一致。本文介绍其技术原理、验证结果及对体育分析和中文圈用户的潜在影响。
-
Cohere Health用Amazon Bedrock AgentCore数字化临床政策:多租户智能体架构实践
了解Cohere Health如何利用Amazon Bedrock AgentCore构建多租户智能体系统,将临床政策数字化为机器可读数据,加速审批流程。本文详解AgentCore Runtime、Gateway、Memory及Agent Skills的应用,对国内医疗AI和智能体开发具有借鉴意义。
-
TReNDS 用 Amazon Bedrock 自动化根因分析:错误排查从 30 分钟降至 60 秒
佐治亚州立大学 TReNDS 中心基于 Amazon Bedrock 和开源 Strands Agents SDK 构建 agentic AI 管道,实时调查生产错误,将根因分析从 15-30 分钟缩短至 60 秒内。本文解析架构、工具构建及对中文开发者的启示。
-
Token 危机:企业为削减 AI 成本,发现 PDF 转 Markdown 是最大消耗源
埃森哲内部数据显示,非工程师员工消耗大量 token,PDF 转 Markdown 是主要元凶。了解 token 消耗真相,优化 AI 成本策略,避免无谓支出。
-
OpenAI 智能音箱 2027 年发布,售价超 300 美元,无屏幕带摄像头
OpenAI 计划于 2027 年推出首款甜甜圈造型智能音箱,售价超 300 美元。设备无屏幕,配备摄像头和麦克风,能通过对话学习适应用户,体现 Sam Altman 的 "Her" 愿景。本文解析产品细节、对中文用户的影响及国产替代方案。
-
AMD收购Taalas:把AI模型直接烧进芯片,推理速度冲到每秒1.6万token
AMD收购加拿大初创公司Taalas,其技术将模型权重直接硬编码进推理芯片,实现极速推理,但每颗芯片只能跑单一模型。演示芯片跑Llama 3.1-8B时速度超每秒1.6万token。本文聊聊对中文圈的影响、国产芯片的对比,以及未来走向。
-
Anthropic放宽Fable 5生物学限制,误报率降85%,病毒学与毒理学仍设防
Anthropic将Fable 5的生物学安全过滤器误报率降低约85%,此前几乎所有生物学查询都被拦截并转至Opus 5。病毒学与毒理学等敏感双重用途主题仍保留限制。了解这一调整对国内用户使用AI进行科研与学习的影响。