AI 快讯 · 第 61 页
-
xAI 发布 Grok Imagine 1.5:图像转视频生成,支持 720p 分辨率
xAI 推出 grok-imagine-video-1.5-preview,可将静态图片和文本提示转化为 720p 电影级视频,并支持多片段拼接。了解该功能对中文用户的使用门槛、国产替代方案及实际应用场景。
-
AI 已能指导业余病毒学家操作实验室,科技领袖呼吁国会立法强制合成 DNA 筛查
Sam Altman、Dario Amodei、Demis Hassabis 等科技领袖联合敦促美国政府将合成 DNA 订单筛查列为法律要求。他们警告称,AI 系统在实验室操作上已超越博士级病毒学家,增加了生物武器滥用的风险。本文解读事件核心、中文圈视角及关键细节。
-
亚马逊推出AI购物助手服务,Kate Spade首批接入,零售商可快速部署
亚马逊基于AWS推出Agentic Shopping Assistant服务,让零售商快速构建AI购物助手。Kate Spade率先上线AI Gift Concierge,帮助用户通过对话选礼物。该服务使用Amazon Bedrock、AgentCore和OpenSearch,转化率是传统搜索的3.5倍。了解对国内电商和AI购物助手的启示。
-
微软推出 Scout 智能体:在 M365 中自主工作的 Autopilot 开启更广泛测试
微软在 Build 大会上宣布扩大 Autopilot 功能测试,首款智能体 Scout 可在 Outlook、Teams 等 M365 应用中自主执行任务,如安排会议、标记邮件、管理日历。Scout 基于 OpenClaw 构建,具备企业级安全控制,学习用户习惯以提升效率。本文详解其功能、部署要求及对中文用户的影响。
-
OpenAI CEO Sam Altman 提出 AI 下一阶段:从聊天机器人到主动式 AI,持续后台运行
OpenAI CEO Sam Altman 提出 AI 发展的下一阶段是“主动式 AI”,它持续在后台运行并自主行动,无需用户提示。同时,企业面临 AI 成本飙升和员工不知如何提问的难题。Altman 承诺帮助用户以更低成本获得更多价值。本文解读这一趋势对中文圈用户的影响。
-
贝恩调查:近40%企业AI成本节省不足10%,人类干预是主因
贝恩对951家企业的调查显示,近40%的公司AI成本节省不到10%,远低于11%-20%的目标。原因之一是仅7%的企业运行完全自主的AI agent,而商业案例却假设了这一点。本文分析企业AI落地中的“人机协作”困境,并探讨对中文用户的启示。
-
ChatGPT记忆系统升级:自动生成工作、爱好、旅行偏好档案,准确率提升至75%
OpenAI更新ChatGPT的Dreaming记忆系统,从零散要点转为连贯用户档案,按工作、爱好、旅行偏好分类。记忆更新成功率从52.2%跃升至75.1%。了解这一变化对中文用户隐私、使用习惯及国产AI的启示。
-
NVIDIA Nemotron 3 Ultra 登陆 Amazon SageMaker JumpStart:550B MoE 模型推理速度提升 5 倍,成本
NVIDIA Nemotron 3 Ultra 现已在 Amazon SageMaker JumpStart 上提供一键部署。该模型拥有 550B 总参数、55B 活跃参数,采用混合 Transformer-Mamba MoE 架构,支持百万 token 上下文,专为长时间运行的自主智能体工作负载优化,推理速度提升 5 倍,成本降低 30%。
-
谷歌员工内部传梗吐槽自家AI烂,官方删掉“人类参与”声明引争议
据404 Media报道,谷歌员工在内部流传表情包吐槽自家AI产品糟糕。事件曝光后,谷歌发言人要求修改声明,删除了“保持人类参与至关重要”的表述,引发对AI伦理和公司文化的讨论。
-
Meta Business Agent 上线:在 Instagram 和 Messenger 内实现 AI 驱动的对话式电商
Meta 推出 Business Agent,在 Instagram、Messenger 和 WhatsApp 中嵌入 AI 代理,自动完成交易和客服。本文详解其工作原理、原生集成优势、对零售商的部署挑战,并分析中文圈用户能否用上、与微信生态的对比。
-
Cloudflare CEO:机器人流量已超人类,未来网站将“付费爬取”
Cloudflare CEO Matthew Prince 指出,AI 代理驱动的机器人流量已超过人类流量,比预期提前两年。他预言网站将转向“付费爬取”模式,这对内容创作者和 AI 公司意味着什么?本文解读事件细节及对中文圈的影响。
-
StrictlyVC洛杉矶大会6月18日举行:聚焦国防科技、AI与融资趋势
StrictlyVC洛杉矶大会将于6月18日在埃尔塞贡多举行,汇聚投资人、创始人和科技领袖,探讨风险投资、国防科技、人工智能和先进工业领域的最新变革。活动包括主题演讲和圆桌讨论,为参会者提供洞察行业趋势和拓展人脉的机会。
-
NVIDIA 发布 Nemotron 3 Ultra:550B 参数开源 MoE 混合 Mamba-Transformer,专为长时 Agent 设计
NVIDIA 开源 Nemotron 3 Ultra,550B 总参数(55B 激活)MoE 模型,采用 Mamba-Attention 混合架构,支持 1M token 上下文,推理吞吐量比同类开源 LLM 高约 6 倍,并附带完整训练数据与配方。本文详解其架构、训练技巧、基准测试结果及对中文开发者的实用价值。
-
ResearchMath-14k 数据集教程:构建语义搜索引擎与开放状态分类器
本文详细讲解如何使用 ResearchMath-14k 数据集构建 NLP 管道,包括 TF-IDF 关键词提取、Sentence Embeddings、UMAP 降维、K-Means 聚类、语义搜索引擎及开放状态分类器,并检测近似重复问题。适合 NLP 学习者和数学研究数据分析者。
-
LFM2 模型微调教程:用 QLoRA 和 DPO 在 Google Colab 上完整实现
本文提供一份完整的 LFM2 模型微调教程,涵盖 QLoRA、监督微调(SFT)和直接偏好优化(DPO),所有步骤均在 Google Colab 上运行,使用 TRL 和 PEFT 等开源工具。适合希望低成本微调大模型的开发者。
-
NVIDIA 开源 Cosmos 3:双塔 MoT 架构统一物理推理、世界生成与动作生成
NVIDIA 发布 Cosmos 3 系列开源世界模型,采用双塔 Mixture-of-Transformers 架构,将物理推理、视频生成和机器人动作生成统一在一个模型中。提供 16B/64B 两种规模,支持文本、图像、视频和动作输入,输出物理感知视频与同步音效。本文详解架构、性能与中文用户实际应用场景。
-
微软Majorana 2量子芯片发布:可靠性提升1000倍,Agentic AI加速研发周期
微软发布Majorana 2量子芯片,量子比特可靠性提升1000倍,平均寿命达20秒。背后Agentic AI平台Microsoft Discovery同步GA,可压缩实验周期,已用于材料科学等领域。本文解读技术细节及对中文圈研发团队的启示。
-
Nous Research 发布 Hermes Desktop:开源 AI Agent 的跨平台桌面端,支持流式工具输出
Nous Research 推出 Hermes Desktop 公开预览版,为开源 Hermes Agent 提供原生 macOS/Windows/Linux 图形界面。无需终端即可使用,支持流式工具输出、跨会话记忆、自改进技能,并与 CLI 共享核心和配置。本文详解功能、中文用户适用性及国产替代对比。
-
沃尔玛限制员工AI助手使用量:大模型成本压力从企业预算表传导到每个工位
沃尔玛开始给员工分配固定AI token额度,限制内部AI助手Code Puppy的使用。背后是LLM从固定订阅转向按量计费,企业面临生产力提升与成本飙升的两难。本文分析事件细节、token maxxing现象,并探讨对国内企业和AI厂商的启示。
-
Nous Research 发布 Hermes Desktop:跨平台开源 AI 智能体应用,MIT 许可
Nous Research 推出 Hermes Desktop,一款 MIT 许可的开源 AI 智能体应用,支持多平台运行。本文介绍其核心功能、对中文用户的意义及与国产同类产品的对比。