SheepNav

AI 资讯

每日聚合最新人工智能动态

**火箭引擎初创公司 Impulse Space 近日宣布完成 5 亿美元 D 轮融资,资金将主要用于招聘约 200 名新员工,而非投资于 AI 取代人类工程师。** 这一决策背后,是公司对硬件工程领域人才不可替代性的深刻认识。 ## 融资背景与用途 本轮融资由 **137 Ventures** 和 **BANNER VC** 领投,Founders Fund、Lux Capital 及 Linse Capital 跟投。随着美国政府加大对国家安全领域的投入,以及 SpaceX 筹备 IPO 引发的太空投资热潮,Impulse 成功吸引了大量资本。公司专注于在轨机动能力,其开发的 **Mira** 平台具备高机动性,主要面向美国太空军客户;另一款产品 **Helios** 则用于将卫星从近地轨道快速送至更高轨道。公司总裁兼首席运营官 Eric Romo 表示,新资金将用于建造和测试更多太空飞行器,并强调在航空航天人才需求旺盛的当下,招聘是公司的首要任务。 ## 硬件工程 vs. AI:人才为何不可替代? 尽管 Impulse 的软件团队已开始采用 AI 编码工具,但在解决实际工程问题时,Romo 认为深度学习模型尚未准备就绪。他本人曾是 SpaceX 的第 13 号员工(2003 年入职),负责用计算机模拟引擎设计性能。他回忆道:“如果模拟结果能接近真实值的 20% 以内,我就算成功了——因为当时的模拟精度就是那么差。”Romo 指出,模拟技术虽有改进,但进步有限,**“设计、分析、建造、测试”的物理迭代流程至今仍无可替代**。 他进一步解释,硬件设计 AI 工具之所以发展缓慢,根本原因在于训练数据的匮乏。与互联网上海量的文本和代码不同,**“如果你想找到世界上最好的涡轮泵密封组件设计方案,你在网上是找不到的”**。这种领域知识的稀缺性,使得 AI 难以在硬件工程中快速落地。 ## 人才竞争与战略布局 Impulse 最初专注于推进系统,后拓展至整星建造,因此需要补充飞行器结构、飞行计算机等领域的工程师。公司最近在科罗拉多州开设新办公室,正是为了应对航空航天人才选择多样化的趋势——如今工程师不再局限于洛杉矶,西雅图、丹佛、德州等地都提供了大量机会。 公司下一步计划是再次发射其 **Mira** 航天器(去年底已完成第三次飞行)。在 AI 热潮席卷各行各业的当下,Impulse 用真金白银投票,表明**物理世界的工程创新,最终仍取决于人类智慧**。

TechCrunch1个月前原文
独立磁力测量:GPS 的新替代方案

全球定位系统(GPS)无处不在,从导航应用到位置共享,它已成为现代生活不可或缺的一部分。然而,其依赖卫星信号的特性也带来了脆弱性:在隧道、地下停车场、室内环境或信号干扰严重的情况下,GPS 可能失效。现在,一种基于手机中常见磁力计的新技术正在崛起,有望成为 GPS 的可靠替代或补充方案。 ## 从指南针到导航工具 手机中的磁力计最初仅用于电子罗盘,提供方向指示。但通过分析地球磁场在不同位置的细微变化,这些微型传感器能够实现精确定位,这一技术被称为**独立磁力测量**。与 GPS 不同,它不依赖外部信号,因此天然具有抗干扰、无盲区的优势。 ## 技术原理与进展 地球磁场并非均匀分布,其强度和方向会因地理位置、地下矿物结构等因素而呈现独特的“指纹”。通过预先绘制高精度的地磁场地图,并利用手机磁力计实时采集数据,算法可以将测量结果与地图匹配,从而确定位置,精度可达米级。 多家公司正在推动这一技术的商业化。例如,**SandboxAQ** 开发了基于量子传感器和磁力计的导航系统,已在美国军方测试中展示了在 GPS 拒止环境下的可靠性。另一家初创公司 **InfiniDome** 则专注于为无人机和车辆提供抗干扰的磁导航方案。手机厂商也在探索集成更灵敏的磁力计,以增强室内导航和增强现实(AR)体验。 ## 应用场景与挑战 独立磁力测量的应用前景广阔: - **室内导航**:在商场、机场、医院等大型建筑内,GPS 信号微弱,磁力导航可提供精确的路径指引。 - **地下与水下作业**:隧道、矿井、潜水器等场景可受益于不依赖卫星的定位。 - **军事与关键基础设施**:在电子战环境下,磁导航可作为 GPS 的备份,确保导航能力。 - **物联网与自主系统**:为机器人、自动驾驶车辆提供鲁棒的定位能力。 然而,该技术也面临挑战。地球磁场会随时间缓慢漂移,且受建筑物内钢筋、电子设备等干扰,需要频繁更新地图并校准传感器。此外,当前手机磁力计的精度有限,难以满足高精度要求,而更高性能的量子磁力计成本高昂。 ## 未来展望 尽管存在不足,独立磁力测量作为 GPS 的补充技术,其价值已获业界认可。随着传感器小型化和算法进步,未来手机可能同时集成 GPS、磁力计、Wi-Fi 和蓝牙等多源定位能力,实现无缝切换。这不仅是技术迭代,更是对导航基础设施韧性的重要提升。 总之,当 GPS 信号消失时,地球磁场或将成为我们新的“北极星”。

IEEE AI1个月前原文

知名对冲基金经理、电影《大空头》原型迈克尔·伯里近日公开表示,他认为 SpaceX 和 Anthropic 的估值被严重高估,两家公司都配不上 1 万亿美元的市值。这一言论在科技投资圈引发热议,尤其是在 AI 和航天赛道持续升温的当下。 ### 伯里的核心论点 伯里在社交媒体上直言,市场对这两家明星公司的追捧已经脱离基本面。对于 SpaceX,他指出虽然其在商业航天领域具有先发优势,但太空经济的规模化仍面临技术、监管和需求等多重不确定性。至于 Anthropic,这位以做空次贷闻名的投资者认为,当前 AI 大模型公司的估值逻辑类似于 2021 年的加密货币泡沫——缺乏可持续的盈利模式,且竞争格局尚不明朗。 ### 估值争议背后的行业现实 伯里的质疑并非空穴来风。SpaceX 在 2023 年的一轮融资中估值达到约 1800 亿美元,而 Anthropic 则在 2024 年初估值突破 600 亿美元。这两家公司的估值确实与 1 万亿美元有较大差距,但市场对其未来增长寄予厚望。 - **SpaceX** 的星链业务已实现正向现金流,但太空旅游、火星殖民等长期愿景尚未落地。 - **Anthropic** 的 Claude 模型在安全性和性能上表现突出,但商业化进程仍落后于 OpenAI,且面临谷歌、微软等巨头的竞争。 ### 市场分歧与投资者情绪 伯里的观点代表了一部分价值投资者的谨慎态度。他们认为,当前科技巨头和明星创业公司的估值已经透支了未来数年的增长,尤其是 AI 领域,资本涌入速度远超技术成熟度。然而,成长型投资者则坚信 SpaceX 和 Anthropic 具备颠覆行业的能力,长期来看 1 万亿美元并非不可能。 ### 小结 无论伯里的预测最终是否正确,他的言论提醒市场:在追逐前沿科技的同时,不应忽视基本面风险。对于普通投资者而言,理解这些公司的实际业务进展和财务健康度,比单纯关注估值数字更为重要。

Hacker News1341个月前原文

如果你经常在 macOS 上传输文件,那么 **Transmit** 绝对值得一试。这款售价 **45 美元**(一次性购买,提供 7 天免费试用)的应用,凭借其出色的图形界面和广泛的协议支持,成为专业用户的理想选择。 ### 核心优势:不止于快 Transmit 支持 **SFTP、WebDAV** 以及众多云服务,包括 Amazon S3、Backblaze B2、Box、Dropbox、Google Drive、Azure、OneDrive 等。对于需要频繁与远程服务器或云存储打交道的用户来说,这意味着无需切换多个工具。作者特别提到,通过 SSH 密钥认证连接 SFTP 服务器,既安全又便捷。 ### 值得关注的细节 - **标签式界面**:可同时打开多个连接,无需重复登录,提升工作效率。 - **Google Drive 支持即将终止**:由于 Google 的 API 变更,新用户将无法添加 Google Drive 账户,已有连接可继续使用。这是许多同类应用面临的共同问题。 - **一次性付费**:相比订阅制,45 美元的价格对于重度用户来说性价比很高。 ### 行业背景 在 AI 和云计算时代,文件传输工具的需求日益增长。无论是数据科学家上传模型文件,还是开发者部署代码,高效、可靠的文件传输都是刚需。Transmit 通过集成多种协议和服务,简化了工作流程,尤其适合需要跨平台、跨服务传输的用户。 ### 小结 虽然市面上有免费的 FTP 客户端,但 Transmit 在易用性、稳定性和功能完整性上表现突出。如果你每天都要处理大量文件传输,这笔投资很可能物超所值。

ZDNet AI1个月前原文
特朗普政府在AI监管问题上陷入内斗

特朗普政府在人工智能监管问题上陷入内部混乱。据多位知情人士透露,官员们正试图确定能否重新拾起上月被总统唐纳德·特朗普突然否决的AI监管行政令。过去几周的相关讨论被硅谷关键玩家和政府官员普遍视为混乱不堪。一些AI高管私下告诉《连线》杂志,他们对修订后的行政令可能要求什么感到不确定,甚至不确定最终是否会签署任何命令。 5月21日,特朗普在预定签署仪式前几小时突然取消该行政令。他当时告诉记者,该命令可能扼杀国内竞争,并削弱美国在AI竞赛中相对于中国的优势。被否决的行政令中最具争议的部分是一项自愿框架条款,要求OpenAI、Anthropic和谷歌等AI实验室在公开发布前提前向白宫提供AI模型,以评估其网络安全能力。 推动监管的核心动力来自白宫内部对AI快速成为国家安全问题的认识——尤其是考虑到Anthropic的Mythos和OpenAI的GPT-5.5模型在发现传统软件系统漏洞方面的卓越能力。这一努力表明政府态度有所转变,此前特朗普政府曾回避AI监管尝试。 草案还建议AI实验室可在公开发布前最多90天提交模型,但多位AI高管告诉《连线》杂志,他们的公司可能无法提前这么久共享模型。一些AI领袖和助手希望行政令能以修订形式回归,保留一些争议较小的条款。 据多个参与机构的工作人员称,行政令能否复活现在主要取决于白宫高级官员能否协调各方派系。白宫办公厅主任苏西·威尔斯已牵头一个推动复活行政令的高级官员小组,成员包括财政部长斯科特·贝森特和国家网络总监肖恩·凯恩克罗斯。贝森特已成为该进程中的关键人物。

WIRED AI1个月前原文

我从 1997 年开始使用 Linux。如果你想在 Linux 用户的层级阶梯上不断攀升,那么有些技能是你必须沿途学习的。 ## 命令行:基本功中的基本功 尽管如今 Linux 完全可以脱离命令行使用,但要想真正掌握这款开源操作系统,你不仅需要学习命令行(CLI),更要让它成为你的第二本能。从 **cd、ls、rm、mkdir** 这些基础命令开始,逐步掌握管道、重定向和命令链,你就能释放 GUI 无法企及的强大力量。 ## 文件系统与权限管理 Linux 的文件系统层次结构(FHS)和权限模型是其安全性的基石。你需要深入理解 **读、写、执行** 三种权限对文件和目录的不同含义,以及 **chmod、chown、chgrp** 等命令的用法。掌握这些,你才能安全高效地管理多用户环境。 ## 进程管理 系统运行中,进程无处不在。学会使用 **ps、top、htop、kill、nice** 等工具监控和管理进程,了解前台与后台任务的区别,是系统调优和故障排查的关键。 ## 软件包管理 无论是 Debian 系的 **apt** 还是 Red Hat 系的 **yum/dnf**,熟练使用包管理器来安装、更新、删除软件,并处理依赖关系,是日常运维的必备技能。 ## Shell 脚本编程 将重复性任务自动化是高手与普通用户的显著区别。学习 **Bash 脚本** 的基本语法、变量、循环、条件判断,可以极大提升工作效率。 ## 网络配置与诊断 在服务器领域,网络是生命线。掌握 **ifconfig/ip、ping、traceroute、netstat/ss、nslookup/dig** 等工具,能够快速诊断连接问题,配置网络接口和服务。 ## 安全加固 安全是永恒的主题。了解 **防火墙(iptables/firewalld)、SELinux/AppArmor、SSH 密钥认证、用户权限最小化** 等基础安全实践,能有效防范常见威胁。 ## 系统日志与排错 当系统出现问题时,日志是首要线索。学会查看 **syslog/rsyslog、journalctl、dmesg** 等日志,结合 **strace、lsof** 等调试工具,可以快速定位问题根源。 以上 8 项技能并非一蹴而就,需要持续实践。从简单到复杂,逐步深入,你就能从普通用户成长为真正的 Linux 专家。

ZDNet AI1个月前原文

arXiv:2606.00082v1 Announce Type: new Abstract: Explainability of deep learning algorithms is critical for computer-vision applications with high-stake decisions. Concept bottleneck models (CBM) have recently shown promising performance to provide explainable and accurate predictions for classification problems, based on a bottleneck of high-level concepts. Existing CBM methods rely on a linear aggregation of the concept scores to compute predictions. However, a large number of concepts is often

HuggingFace1个月前原文

强化学习(RL)的成功高度依赖准确的奖励函数,但在机器人等真实场景中,奖励函数往往需要手工设计,甚至难以获得。近年来,研究者尝试利用预训练视觉语言模型(VLM)的零样本推理能力作为奖励模型,然而这类方法在缺乏精心设计的提示(prompt)时,容易产生次优奖励,其中假阳性预测会严重干扰下游策略学习。 针对这一瓶颈,来自多家机构的研究团队提出了 **Demo2Reward**——一种测试时提示优化方法,仅需 **3-10 条专家示范轨迹**,即可自动优化 VLM 奖励模型的语言指令,在减少假阳性奖励的同时保持真阳性识别。该方法无需额外的模型训练或计算资源,直接应用于策略学习之前。 ## 核心思路 Demo2Reward 的核心洞察在于:**测试时对提示进行优化**。传统方法依赖手动编写提示,而 Demo2Reward 利用少量示范数据,通过可微优化调整提示文本的嵌入表示,使奖励模型更准确地匹配示范中的行为模式。具体而言,它通过对比示范轨迹与随机轨迹的奖励差异,反向传播更新提示嵌入,从而抑制错误的高分奖励(假阳性),并保留正确的奖励信号(真阳性)。 ## 实验结果 在多个模拟机器人任务(如推箱、抓取、移动)上,Demo2Reward 一致优于现有的零样本和少样本 VLM 奖励模型。例如,在 MetaWorld 和 D4RL 基准测试中,采用 Demo2Reward 优化后的奖励模型,其下游策略成功率提升 **20-40%**,假阳性率降低 **50% 以上**。更关键的是,该方法成功迁移至真实机器人场景:在一台机械臂的抓取任务中,仅凭 5 条示范轨迹,Demo2Reward 便使机器人学会了稳定抓取,完全无需手动设计奖励函数。 ## 意义与展望 Demo2Reward 为机器人学习提供了一条实用路径:**利用少量示范数据,自动获得高质量奖励信号**。这降低了 RL 在真实世界应用的门槛,尤其适合那些难以定义奖励的复杂任务。未来,该方法可进一步结合在线数据优化提示,或扩展到多模态奖励设计。论文已公开于 arXiv(2606.00083),代码即将开源。 ## 总结 - **问题**:VLM 作为奖励模型易产生假阳性,需手动调提示。 - **方案**:Demo2Reward 用 3-10 条示范在测试时自动优化提示,无需额外训练。 - **效果**:模拟和真实任务中均显著提升奖励准确性和策略成功率。 - **价值**:让机器人能从少量演示中学习,摆脱手工奖励工程。

HuggingFace1个月前原文

## 大模型与大脑的“情绪坐标”对齐,但监督信号已饱和? 一项来自 arXiv 的新研究(arXiv:2606.00129)发现,现代大语言模型(LLM)内部存在一条与人类脑电(EEG)中情绪效价(valence)高度一致的神经表征轴。然而,更令人意外的是,试图利用这种对齐来提升情绪解码性能的尝试几乎全部失败,研究者将其总结为“饱和规律”。 ### 仅用9个句子构建的“V轴” 研究团队仅使用9个情感唤起句子(如“我中奖了”“我失去了亲人”),从多个现代LLM(如GPT、Llama等)的隐藏层中提取出一维的**效价方向(V-axis)**。该方向通过零样本迁移至情感基准数据集得到验证,并在14个不同的LLM中保持跨模型一致性。这说明LLM内部确实编码了一个通用、稳定的情感维度。 ### LLM的V轴映射到人类脑电 在包含123名受试者的公开EEG数据集上(受试者观看情感视频片段),研究者发现**仅用一个线性投影**就能从EEG特征中追踪到每个视频片段的V轴位置。更关键的是,36个独立训练的EEG情绪分类器(未接触V轴信息)在其内部表征中自发地“重新发现”了相同的方向。这表明,无论是语言模型还是人类大脑的电生理活动,都共享一种类似的效价结构。 ### 饱和规律:对齐信号为何失效? 既然LLM与大脑在情绪表征上如此一致,能否利用这种对齐来训练更好的脑机接口(BCI)解码器?研究者测试了25种对齐策略,包括知识蒸馏、表征相似性、对比学习和拓扑损失等。结果令人震惊:**没有一种方法能提升解码准确率,其中16种甚至显著降低了性能**。 他们用“饱和规律”解释这一现象:当任务标签(如情绪类别)已经足够驱动脑解码网络朝向目标方向时,额外的对齐信号主要干扰一个已经“饱和”的优化盆地,而对承载分类性能的“类内残差”几乎没有贡献。换句话说,LLM-EEG的对齐在宏观方向上成立,但精细分类所需的细节信息并不在此对齐轴上。 ### 突破方向:残差集成 基于这一洞察,研究者提出改进不应来自强化对齐,而应**利用监督信号无法触及的残差子空间**。他们通过集成多个具有不同残差特征的解码器,在FACED数据集上将平衡准确率提升了**10.5%**,并在SEED-V上复现了相同效果。 ### 启示与展望 这项研究不仅揭示了LLM与人类大脑在情感处理上的深层联系,也指出了当前脑解码范式的潜在瓶颈。未来,如何有效利用大模型提供的“全局对齐”与“局部残差”之间的互补信息,或将成为提升BCI性能的关键。

HuggingFace1个月前原文

## 微调基础模型的两难困境 大型基础模型(如LLaMA、GPT等)在预训练阶段积累了广泛的能力,但在针对特定下游任务进行微调时,往往会**遗忘**预训练阶段学到的非目标能力。例如,一个擅长数学推理的模型,经过指令微调后可能数学能力下降。现有方法通过特殊初始化或固定约束来缓解遗忘,但无法在训练过程中动态调节**适配与保持**的权衡。 ## FoLoRA:基于广义瑞利商的遗忘感知优化框架 来自德克萨斯大学奥斯汀分校和微软的研究团队提出**FoLoRA(Foundation Preserving LoRA)**,这是一种遗忘感知优化框架,核心创新在于将**广义瑞利商**引入微调过程。FoLoRA通过以下步骤实现适配与保持的平衡: 1. **定义两个关键指标**: - **遗忘惩罚**:基于预训练代理激活(通过从预训练模型采样构建的校准数据计算)衡量更新方向对非目标能力的损害; - **任务效用**:基于下游任务激活衡量更新方向对目标任务的贡献。 2. **广义瑞利商评分**:将每个更新方向的得分定义为“任务效用/遗忘惩罚”,即每单位遗忘惩罚带来的任务效用。得分高的方向表示在遗忘较少的情况下提升目标任务。 3. **谱坐标系统与门控Adam更新**:利用广义瑞利商构建谱坐标系统,对低效用-高惩罚的方向进行衰减(即门控),从而在Adam优化器中动态调整更新强度。 ## 创新校准数据构建 FoLoRA另一个亮点是**预训练代理校准数据的生成**:不依赖单一代理数据集,而是从预训练模型本身采样。这种方法更具通用性,避免了代理数据集偏差,同时降低了对外部数据的依赖。 ## 实验效果 在**数学、代码和指令跟随**三个适配场景下的实验表明,FoLoRA在保持非目标能力(如通用知识、推理)方面显著优于现有基线方法(如LoRA、DARE等),同时目标任务性能也有提升。例如,在数学适配中,FoLoRA在GSM8K上保持高准确率的同时,代码生成能力下降幅度最小。 ## 行业意义 FoLoRA为**基础模型持续学习**和**多能力平衡**提供了新思路。随着模型在垂直领域(如医疗、法律)的广泛应用,如何在不破坏通用能力的前提下进行高效适配,成为关键挑战。FoLoRA的**动态门控机制**和**代理数据采样策略**具有实用价值,可集成到现有LoRA微调流程中,为开发者提供更安全的微调方案。 ## 小结 FoLoRA通过广义瑞利商优化,将遗忘惩罚和任务效用统一到一个数学框架中,实现了微调过程中适配与保持的精细调节。该方法在多个任务上展示了优越性,有望成为基础模型适配的标准工具之一。未来工作可能包括扩展到更大模型和更多模态,以及探索更高效的代理数据构建方式。

HuggingFace1个月前原文

世界模型(World Models)作为学习环境结构与动态的内部模拟器,正成为实现通用人工智能的核心范式。近期一篇由26位学者联合撰写的综述论文(arXiv:2606.00133)系统梳理了这一领域,提出了涵盖**架构、方法论家族、推理策略与应用领域**的四维分类法,填补了长期以来缺乏统一框架的空白。 ## 四维分类法:解构世界模型 论文从四个关键维度组织庞大文献: - **架构维度**:涉及表示格式(隐空间/显式状态)、动态公式化(确定/随机)、输入模态(视觉/触觉/语言)、学习范式(监督/自监督/强化)及下游任务类型。 - **方法论家族**:包括**状态空间与循环方法**(如RSSM)、**Transformer基模型**(如DreamerV3中的序列建模)、**扩散生成器**(用于视频预测)、**物理信息网络**(融入先验物理定律)以及**语言增强多模态系统**(如RT-2)。 - **推理策略**:涵盖**基于想象力的规划**(如PlaNet的在线规划)、**隐策略学习**(Dreamer系列)、**反事实推理**(评估“如果…会怎样”)以及**不确定性下的规划**(如MuZero的蒙特卡洛树搜索)。 - **应用领域**:从机器人、自动驾驶、视频预测到科学建模(气候/分子动力学)、医学影像、教育测量和商业金融,横跨十余个场景。 ## 里程碑系统与最新趋势 论文追溯了从早期认知科学基础到现代标志性系统的演进:**PlaNet**首次在隐空间进行规划;**Dreamer系列**将学习与规划统一于潜在动态;**MuZero**无需环境模型即可学习规划;**Sora**展示了大模型在视频生成中的世界模拟能力;**Cosmos**与**Genie**则分别聚焦于物理交互与可交互虚拟世界。 值得注意的是,**链式思维推理与世界模型想象力的融合**正成为新热点——模型不仅生成未来状态,还能通过多步推理解释其决策逻辑,这对可解释AI与安全对齐至关重要。 ## 挑战与开放问题 尽管进展迅猛,领域仍面临三大核心挑战: 1. **累积预测误差**:长时域推演中误差指数级增长,影响规划可靠性。 2. **仿真到现实迁移**:模型在仿真中学习后难以直接部署到真实环境,需解决域适应与鲁棒性问题。 3. **评价碎片化**:缺少统一基准,不同论文使用不同任务与指标,难以横向对比。 论文呼吁建立标准化评估协议,并指出未来方向包括**多尺度世界模型**(同时处理秒级与小时级动态)、**语言引导的抽象推理**以及**与大型语言模型深度融合**。 ## 小结 世界模型正从单一学术概念演变为AI系统的核心组件。这篇综述不仅为研究者提供了清晰的分类地图,更揭示了**“预测-规划-推理”闭环**如何驱动下一代智能体。随着Sora等生成式模型与MuZero等规划算法的结合,世界模型有望在机器人、自动驾驶和科学发现中释放更大潜力。

HuggingFace1个月前原文

混合专家(MoE)大语言模型通过稀疏专家激活降低了每token的计算量,但部署时所有专家权重需常驻内存,导致内存压力巨大。现有压缩方法在超低位宽下表现不佳:剪枝不可逆地移除模型容量,而粗粒度量化无法根据专家和权重方向的重要性分配位宽。为此,研究者提出 **BitsMoE**——一种基于谱能量引导的位宽分配框架,专为MoE大模型量化设计。 ## 核心思路:SVD分解与谱感知量化 BitsMoE的核心创新在于利用奇异值分解(SVD)将每个MoE层分解为**共享基**和**专家特定谱因子**。共享基不进行量化,以保留跨专家的通用结构;而专家特定因子则作为细粒度量化单元。这种分解将量化误差限制在专家差异部分,避免了共享信息的损失。 ## 混合精度位宽分配:激活感知整数线性规划 为了确定每个量化单元的位宽,BitsMoE将谱级混合精度量化建模为**激活感知重建替代问题**,并通过整数线性规划在固定位预算下最小化估计重建损失。具体而言,该方法利用谱能量(即奇异值)作为重要性指标,能量更高的成分分配更多位宽,从而在压缩比和模型质量间取得最优平衡。 ## 实验结果:2-bit量化下精度提升27.83个百分点 在 **Qwen3-30B-A3B-Base** 模型上的测试显示,2-bit量化下BitsMoE相比GPTQ实现了 **12.3倍量化加速**,平均准确率提升 **27.83个百分点**,解码速度提升 **1.76倍**。在多个MoE大模型(如Mixtral 8x7B、DeepSeek-MoE等)的实验中,BitsMoE在超低位宽(2-3 bit)下均显著优于现有方法,同时保持了高吞吐量。 ## 行业意义与展望 MoE模型因其高效推理而成为大模型部署的主流选择,但内存瓶颈制约了其在边缘设备上的应用。BitsMoE通过**谱能量引导的位宽分配**,首次在超低位宽下实现了可接受的精度损失,为MoE大模型的极致压缩提供了新思路。未来,该方法可进一步结合量化感知训练和硬件协同设计,推动大模型在资源受限场景的落地。 论文代码和模型已开源,详见项目地址。

HuggingFace1个月前原文

## 快讯:DAS事件分类迎来高效新方案 分布式声学传感(DAS)技术利用光纤实现大规模监测,但高维度与复杂的时空模式让事件分类成为难题。现有深度学习方法(如CNN、循环模型及Transformer变体)要么难以捕捉长程依赖,要么处理原始DAS矩阵成本过高。近日,来自IMT Nord Europe的研究团队提出**DAStatFormer**——一种混合多分支Transformer架构,通过紧凑的多域统计特征与门控Transformer网络相结合,在显著降低计算开销的同时实现高达**99.4%** 的分类准确率。 ## 核心创新:从原始信号到统计特征 DAStatFormer的突破在于**避开原始高维信号**,转而从每个通道提取24个经ANOVA筛选的统计属性,覆盖时域、波形和频谱三个域。这一策略将数据规模压缩数个数量级,同时保留关键判别信息。每个域由专用的**逐步注意力分支**和**逐通道注意力分支**处理,最后通过自适应门控机制融合。 ## 性能对比:轻量级下的卓越表现 实验基于公开的Φ-OTDR基准数据集和真实场景DAS数据集。结果显示,DAStatFormer不仅准确率接近完美(真实场景近乎100%),且参数量和推理成本远低于DASFormer、DeepViT等模型。这意味着它更适用于**实时、大规模**的DAS监测部署。 ## 行业意义:边缘智能的潜力 DAS在油气管道监控、地震预警、安防等领域应用广泛,但传统方案依赖昂贵计算设备。DAStatFormer的轻量设计为**边缘端部署**打开了可能——只需提取少量统计特征即可完成精准分类,有望推动DAS从实验室走向工程现场。 研究团队已开源代码(见论文链接),为后续工作提供了坚实基础。

HuggingFace1个月前原文

## 研究背景与核心思路 深度神经网络(DNN)的规模持续膨胀,给部署在资源受限设备上带来了巨大挑战。传统的模型压缩方法,如低秩分解和剪枝,往往在压缩比和精度之间难以兼顾。近期,来自arXiv的一篇论文(arXiv:2606.00130)提出了一种名为**自动可微非线性张量网络(ADNTNs)** 的框架,旨在通过结构化权重生成实现指数级压缩,同时保持甚至提升模型精度。 ADNTNs 的核心思想是:不直接存储庞大的权重矩阵,而是通过一组**小型核心张量**,利用非线性激活函数和层次化连接(类似张量网络中的树结构)来“生成”大权重。这些核心张量通过**反向模式自动微分(AD)** 进行端到端训练,使其能够适应特定任务。 ## 三大架构与关键特性 论文重点研究了三种张量网络架构: - **Tree Tensor Networks (TTNs)**:基础树形结构,通过层级组合构建权重。 - **augmented TTNs (aTTNs)**:在TTN基础上引入**边界纠缠消除单元**,提升表达能力。 - **Multi-scale Entanglement Renormalisation Ansatze (MERA)**:多尺度纠缠重整化,更擅长捕捉长程依赖。 这些架构支持非线性激活、任务感知目标、批处理以及硬件感知的执行调度。作者特别指出,ADNTNs 并非简单地“免费”计算,自动微分并不能消除大中间张量的存储成本或优化收缩顺序的难题。 ## 实验结果与性能亮点 研究在 **AlexNet** 和 **VGG-16** 的多个层上进行了广泛模拟。结果显示,每层压缩比从约 **2000倍到77000倍** 不等,而模型精度通常与稠密基线持平,甚至在VGG-16的若干层中**有所提升**。例如,在VGG-16的某些卷积层上,ADNTN在压缩超过万倍的情况下,分类准确率反而比原始模型高出0.5-1个百分点。 这些结果令人鼓舞,但作者也保持审慎,认为这是“鼓励性而非最终结论”。ADNTNs 的真正潜力需要结合**优化算法、收缩调度和部署内核**的协同设计才能充分发挥。 ## 行业影响与未来展望 ADNTNs 为模型压缩提供了一种**数学结构严谨且硬件友好**的新范式。与低秩适应(LoRA)等仅单步更新的方法相比,ADNTN通过多层非线性层次结构实现了更强的表达能力。未来,该技术有望在移动端AI、边缘计算和大型语言模型(LLM)的部署中发挥重要作用,尤其是在需要极高压缩比且对精度敏感的场景。 不过,目前的工作主要局限于卷积层,将其扩展到Transformer架构(如注意力权重)仍是开放问题。此外,自动微分带来的额外计算开销也需要进一步优化。

HuggingFace1个月前原文

## 概述 在 AI 助手与 MCP(Model Context Protocol)服务器交互的场景中,安全认证是生产环境部署的关键环节。本文介绍如何利用 **Amazon Bedrock AgentCore Gateway** 实现 **OAuth 授权码流程(Authorization Code Flow)**,为 MCP 服务器提供入站身份验证机制。通过本方案,每个 AI 助手请求都将携带来自组织身份提供者(IdP)的有效用户身份令牌,确保请求来源的合法性与可追溯性。 ## 核心架构与实现 ### 1. 为什么选择授权码流程? 授权码流程是 OAuth 2.0 中最安全的授权模式之一,特别适合服务端通信场景。与隐式流程相比,它避免了令牌直接暴露在浏览器端,而是通过后端交换授权码获取访问令牌,从而降低令牌泄露风险。在 AI 助手调用 MCP 服务器的上下文中,这一机制能有效防止未授权访问,确保只有经过身份验证的用户才能触发特定操作。 ### 2. 组件与工作流 - **AgentCore Gateway**:作为反向代理和认证网关,拦截所有传入的 MCP 请求,执行令牌验证与转发。 - **MCP 客户端**:AI 助手或应用程序,发起对 MCP 服务器的请求。 - **身份提供者**:组织内部的 OAuth 2.0 服务器(如 Okta、Auth0 或自建服务),负责签发 ID Token 和 Access Token。 - **MCP 服务器**:提供具体功能的后端服务,例如数据库查询、文件处理等。 **典型流程如下:** 1. MCP 客户端向 AgentCore Gateway 发起请求,携带身份提供者签发的 ID Token。 2. Gateway 验证令牌的签名、颁发者(issuer)和受众(audience),确保令牌有效且未过期。 3. 验证通过后,Gateway 将令牌中的用户身份信息(如用户 ID、角色)传递给下游 MCP 服务器。 4. MCP 服务器根据用户身份执行授权逻辑,返回响应。 ### 3. 配置要点 - **令牌验证规则**:在 AgentCore Gateway 中配置 JWT 验证参数,包括 JWKS URI(用于获取公钥)、期望的 `iss` 和 `aud` 值。 - **令牌缓存与刷新**:为避免每次请求都重复验证,Gateway 可缓存已验证的令牌(基于 JWT ID `jti`),并支持令牌刷新机制。 - **错误处理**:当令牌无效或过期时,Gateway 应返回标准 HTTP 401 状态码,并附带错误描述,方便客户端调试。 ## 场景价值 该方案适用于企业级 AI 应用,例如: - **内部知识库助手**:仅允许特定部门的员工通过认证后查询敏感数据。 - **自动化工作流**:不同用户角色触发不同的 MCP 服务器操作,实现细粒度访问控制。 - **审计与合规**:所有请求都关联到具体用户身份,便于日志审计和问题追踪。 ## 小结 通过 AgentCore Gateway 集成 OAuth 授权码流程,开发者可以为 MCP 服务器快速添加身份验证层,无需修改现有后端代码。这一模式不仅提升了安全性,还保持了与标准 OAuth 生态的兼容性,为 AI 助手的生产级部署提供了可靠的基础设施。

AWS ML1个月前原文

如果你还在为家中Wi-Fi死角烦恼,或者觉得高端Mesh路由器价格高不可攀,那么**Tenda BE5100三件套Mesh Wi-Fi系统**可能会让你眼前一亮。这款仅售**190美元**(约合人民币1300元)的套装,不仅支持最新的**Wi-Fi 7**标准,还能同时处理**12路4K视频流**而毫无卡顿。 ## 性能实测:12路4K视频流无压力 在ZDNET的实测中,这套系统被部署在一个约200平方米的复式住宅内。通过同时播放12路4K超高清视频(包括YouTube、Netflix和本地NAS流媒体),所有节点均未出现缓冲或掉线。测试工具显示,即使在距离主节点最远的角落,信号强度仍保持在-65dBm以上,延迟稳定在10ms以内。 ## Wi-Fi 7加持,性价比突出 BE5100支持Wi-Fi 7(802.11be)的320MHz频宽和4K QAM调制,理论速率可达5.1Gbps。虽然目前Wi-Fi 7终端尚不普及,但向下兼容Wi-Fi 6/6E,且为未来升级预留了空间。相比同类Wi-Fi 7 Mesh系统(如TP-Link Deco BE95售价约600美元),Tenda这套方案价格仅为三分之一,堪称“平民版”入门之选。 ## 设置与功能:App专业,硬件质感一般 配套的**Tenda App**提供了从网络诊断、信号覆盖图到家长控制等专业级功能。用户只需扫描二维码即可完成初始配置,整个过程不到5分钟。不过,路由器外壳采用全塑料材质,手感略显廉价。另外,单独购买扩展节点的价格是100美元,整套购买显然更划算。 ## 行业背景:Mesh Wi-Fi普及加速 随着远程办公、4K/8K流媒体和智能家居设备的爆发,传统单路由器已难以满足全屋覆盖需求。Mesh Wi-Fi系统通过多节点协作实现无缝漫游,成为中大型住宅的刚需。而**Wi-Fi 7**的商用化进一步推动了性能升级——更高的带宽、更低的延迟,使得多设备并发场景(如云游戏、VR)成为可能。Tenda BE5100的出现,意味着Wi-Fi 7 Mesh系统正在从高端市场向主流价位渗透。 ## 小结 如果你预算有限,但又想体验Wi-Fi 7的潜力,Tenda BE5100是一个值得考虑的选择。它用不到200美元的价格,提供了足以覆盖大户型、支撑重度流媒体使用的性能。当然,对质感有要求的用户可能需要权衡其塑料外壳,但在这个价位上,稳定性和速度才是真正的王牌。

ZDNet AI1个月前原文

## 从《神经漫游者》到桌面:我的赛博终端构建之旅 赛博终端(Cyberdeck)这个名词,最早源自威廉·吉布森1984年的科幻小说《神经漫游者》。如今,它已成为DIY社区中最热门的复古未来主义项目之一。我决定亲自动手,用树莓派打造一台属于自己的便携计算机,体验一把赛博朋克的感觉。 ### 为什么选择赛博终端? 赛博终端的魅力在于它的自由度和个性化。不同于市面上千篇一律的笔记本或平板,赛博终端完全由你定义:外壳、键盘、屏幕、电池,甚至是操作系统和软件。它不追求性能极致,而是强调独特的视觉风格和功能定制。对于喜欢动手、热爱复古科技的人来说,建造一台赛博终端本身就是一种乐趣。 ### 我的构建过程 我选择了一台**树莓派4B**作为核心,搭配5英寸HDMI触摸屏和机械键盘模块。外壳则用3D打印制作,参考了经典的“砖头”造型,并加入了LED灯带和复古按钮。电源方面,我集成了18650电池组,确保户外使用时的续航。 关键步骤包括: - **硬件组装**:将树莓派、屏幕、键盘和电池通过定制线缆连接,固定在外壳内。 - **系统配置**:安装Raspberry Pi OS,并优化触控和键盘映射。 - **软件定制**:添加终端模拟器、文本编辑器、以及一些复古游戏模拟器。 整个过程耗时约两周,其中调试驱动和电源管理最费时间。但完成后的成就感无可比拟。 ### 它能做什么? 我的赛博终端并非只是摆设。它实际具备以下能力: - **便携编程**:在户外或咖啡厅里,它是一台全功能的Linux开发机。 - **复古游戏**:通过模拟器运行FC、GB等经典游戏。 - **网络工具**:可作为便携式渗透测试设备(配合Kali Linux)。 - **电子阅读**:用终端阅读纯文本或Markdown文档。 - **展示与社交**:带到黑客马拉松或科技聚会中,绝对是话题中心。 当然,它的性能无法与主流笔记本相比,但**低功耗、可定制性**和**独特外观**是它的核心价值。 ### 赛博终端热潮背后的思考 这股DIY风潮反映了人们对标准化消费电子产品的厌倦。在笔记本、手机几乎同质化的今天,赛博终端提供了一种“反叛”的可能:你可以掌控每一个细节,赋予设备个性。同时,它也是学习硬件和编程的绝佳实践项目。 如果你不想从零开始,市面上已有一些套件或成品可供选择,但真正的乐趣在于亲手打造。正如我在构建过程中感受到的:**过程比结果更重要**。 未来,我计划升级到树莓派5,并加入4G模块,让它成为真正随时在线的“口袋电脑”。赛博终端的可能性,只受限于你的想象力。

ZDNet AI1个月前原文

**家得宝(Home Depot)** 正在推出一项极具吸引力的夏季促销活动:购买 **Ryobi One+ 18V锂电启动套装**(包含一块2.0Ah电池、一块4.0Ah电池和一个充电器,售价99美元),即可 **免费获赠一把指定Ryobi电动工具**,整体节省高达 **129美元**(折扣率57%)。 ## 活动核心信息 - **促销商品**:Ryobi One+ 18V锂电启动套装(型号可能因库存而异) - **售价**:99美元 - **赠品**:从指定列表中任选一把Ryobi电动工具,免费赠送 - **优惠力度**:相比原价节省约129美元 - **活动期限**:截至2026年6月1日(或售完即止) ## 为什么值得入手 对于DIY爱好者和家庭用户来说,Ryobi One+生态系统提供了丰富的工具选择,且电池通用。这套组合包含一大一小两块电池,适合不同工作强度的需求:2.0Ah电池轻便,适合钻孔、拧螺丝等轻量任务;4.0Ah电池续航更长,适合电锯、吹风机等高耗电设备。免费赠送的工具则可以根据实际需要选择,如电钻、圆锯、打磨机等,相当于将总成本摊薄至不到100美元,性价比极高。 ## 编辑点评 ZDNET编辑评价该促销为“编辑之选”,并给出了5/5的评分。主要优势在于:1)电池套装本身是刚需;2)免费工具相当于白送;3)Ryobi品牌在性价比和工具种类方面口碑良好。需要注意的是,免费工具的选择范围可能有限,建议购买前确认可选项。 ## 购买建议 如果你正在筹划夏季庭院维护或家居改造项目,这套组合可以一次性解决动力源和工具需求。建议优先选择平时售价较高的工具作为赠品,以最大化节省金额。

ZDNet AI1个月前原文

MX Linux 近日发布了其最新版本,其中包含针对现代硬件的优化,让老旧 PC 也能焕发新生。作为一名长期关注 Linux 发行版的用户,我第一时间在主力机上安装了 **MX-25.2_Xfce_ahs_x64** 版本,体验令人印象深刻。 ## 版本选择:AHS 专为现代硬件打造 MX Linux 提供了多种版本,包括标准版、KDE 版、Fluxbox 版以及树莓派版。其中,**AHS(Advanced Hardware Support)版本** 集成了 **7.07 内核**、最新显卡驱动和固件,特别适合 1-3 年内的新硬件。它使用 **Liquorix 内核**(针对高性能音视频优化),并预装 **DKMS 包** 确保现代 GPU 和 Wi-Fi 芯片开箱即用。此外,**MX Nvidia 安装程序** 让驱动安装变得异常简单。 ## 实际体验:流畅与稳定兼得 在我的中端 PC 上,MX Linux AHS 的 Xfce 桌面环境响应迅速,**HiDPI 缩放**(125% 和 150%)显示清晰锐利。无论是日常办公、网页浏览还是轻度游戏,系统都表现出色。得益于 Debian Stable 的根基,MX Linux 保持了极高的稳定性,几乎没有遇到崩溃或驱动问题。 ## 与竞品对比:速度与稳定的平衡 相比追求极致速度的 CachyOS,MX Linux 更注重稳定性和易用性。它的 **Xfce 桌面** 轻量高效,资源占用低,非常适合老旧设备升级。如果你正在寻找一个既能利用新硬件特性,又不牺牲稳定性的系统,MX Linux AHS 无疑是明智之选。 ## 小结 MX Linux AHS 版本是 Linux 社区针对现代硬件的一次成功优化。它免费、开源,且安装简便,能让任何 PC 焕然一新。无论你是 Linux 新手还是老手,都值得一试。

ZDNet AI1个月前原文

索尼近日发布了新一代旗舰电视 **Bravia 9 II True RGB**,同时推出的还有 **Bravia 7 II** 及多款更新机型。对于正在考虑升级主电视或添置第二屏幕的用户来说,现在或许是入手的良机——无论你是索尼的忠实粉丝,还是只想淘个好价。 ## Bravia 9 II 的核心升级:True RGB 技术 Bravia 9 II 的最大亮点是采用了 **True RGB** 屏幕技术。与上一代 Bravia 9 的 Mini LED 面板不同,True RGB 通过独立控制红、绿、蓝三原色发光,实现了更广的色域、更精确的色彩还原和更高的亮度。这意味着在观看 HDR 内容时,色彩过渡更加自然,高光细节更加丰富,暗部表现也更纯净。 ## 与 Bravia 9 的对比:值得升级吗? 从参数上看,Bravia 9 II 在色彩覆盖率和峰值亮度上明显领先。上一代 Bravia 9 的 Mini LED 虽然已经表现出色,但在处理复杂光线场景时仍会出现轻微的光晕现象。而 True RGB 技术从根本上解决了这个问题,每个像素都能独立发光,控光精度达到像素级。 对于追求极致画质的影音爱好者,尤其是经常观看 4K HDR 电影或玩高帧率游戏的用户,Bravia 9 II 的升级是显而易见的。不过,如果你的 Bravia 9 仍在良好服役且对当前画质满意,那么升级的必要性可能不大——毕竟新一代机型的价格预计会更高。 ## 其他更新:Bravia 7 II 与系统优化 除了旗舰型号,索尼还更新了 **Bravia 7 II**,同样搭载了改进的面板技术和更智能的画质算法。全系机型预计将搭载更新的 **Google TV** 系统,提供更流畅的界面和更丰富的流媒体集成。 ## 总结 Bravia 9 II 凭借 True RGB 技术,在画质上实现了质的飞跃,堪称目前索尼电视产品线的巅峰。如果你预算充足且对画质有最高要求,它无疑是值得考虑的选择。但对于现有 Bravia 9 用户,除非你对色彩精准度有专业级需求,否则可以再等一代。

ZDNet AI1个月前原文