被誉为“互联网之父”的 **文特·瑟夫(Vinton Cerf)** 将于下周从谷歌首席互联网传道者的职位上退休,为这段跨越20年的科技巨头生涯画上句号。瑟夫与罗伯特·卡恩共同设计了TCP/IP协议,奠定了现代互联网的基础。 在由Laude Institute主办的Open Frontier大会上,加州大学伯克利分校教授戴夫·帕特森通过视频连线宣布了这一消息:“文特在谷歌工作了超过20年,他将在下周退休,我们应该为这段辉煌的职业生涯鼓掌。”现场响起了热烈的掌声。谷歌尚未对置评请求作出回应。 现年83岁的瑟夫因在20世纪70年代开发并推广TCP/IP协议而闻名,该协议是不同计算机网络相互通信的基本规则集。他因此获得了众多荣誉,包括多个荣誉博士学位、总统自由勋章以及图灵奖。自2005年起,瑟夫担任谷歌副总裁兼首席互联网传道者。 瑟夫在大会上与多位知名计算机科学家同台讨论,包括戴夫·帕特森(RISC架构联合开发者)、弗朗索瓦·肖莱(Keras深度学习库创建者)、约翰·奥斯特豪特(Tcl编程语言发明者)以及马泰·扎哈里亚(Databricks联合创始人)。他们分享了构建持久开源系统的经验,这些经验在当前创始人押注开放基础设施以支持下一代AI产品的背景下尤为重要。 ### 对AI时代的深刻洞察 会议讨论的焦点之一是:先进模型集中在少数资源充足的实验室中,这与瑟夫协议所代表的开放、去中心化的互联网世界形成鲜明对比。然而,瑟夫预测,AI代理(能够自主行动并与其他软件协调的软件)的兴起将推动科技公司回归标准化协议。他表示:“来自多个来源的多个AI代理互相交互的代理模型,将迫使系统具备可组合性,并需要互操作性和标准化。” 这一观点为当前AI行业日益封闭的趋势提供了另一种可能性——即通过协议和标准实现开放协作,而非依赖少数巨头的封闭生态。 ### 开放互联网的遗产 瑟夫的退休标志着一个时代的结束,但他所倡导的开放、去中心化理念在AI时代依然具有深远影响。随着AI代理和开放基础设施的发展,标准化协议可能再次成为技术演进的关键驱动力。正如瑟夫所言,互联网的“传道”已经完成,而未来的挑战在于如何让AI世界同样遵循可互操作的规则。
AWS近日宣布,Anthropic的Claude Fable 5模型将于明天起在Amazon Bedrock上重新上线,并配备了更强的防护措施以防止滥用。这一消息凸显了前沿模型发布中安全与可用性之间的关键平衡。 ## 安全基石上的AI服务 自AWS成立20多年来,安全一直是其核心投资领域。Amazon Bedrock等AI服务正是建立在这一安全基础之上,秉承相同的理念。Bedrock为客户提供世界级的性能、安全性和隐私保护,以及最广泛的模型选择。去年推出的Bedrock Mantle在模型权重保护方面实现了行业领先的隐私与安全保障。 ## 快速交付与责任并重 客户希望在新模型发布后尽快获得访问权限,Bedrock满足了这一需求,同时提供企业级功能。AWS强调,在发布模型时,不仅考虑对客户的责任,还兼顾对互联网和整个社会的影响。最新一代前沿模型(如Anthropic的Claude Mythos)拥有强大的新能力,尤其在网络安全领域。 ## Project Glasswing:防御者的机会 通过Project Glasswing,AWS亲身体验了这些模型的能力,并渴望将Mythos级模型交到防御者手中。防御者可以利用这些模型使关键系统更加安全,但同时必须确保不给攻击者提供显著的超前可见性和能力,而不给企业、政府和学术机构保护自身资产的机会。 ## 平衡挑战与防护措施 实现这一平衡是广泛模型发布的关键挑战。AWS与Anthropic及其他行业合作伙伴在Project Glasswing中密切合作,为这类新模型完善防护措施。各方一致认为,防止攻击者获得深度漏洞研究能力是这些防护措施的最重要目标。 ## 展望未来 AWS认为,在安全且隐私保护的环境中,让所有客户都能使用这些先进模型的能力,对于确保他们获得诸多好处而不制造安全风险至关重要。这是一个激动人心的AI时代,新能力几乎每天都在交付,而安全释放这些能力是行业共同的责任。
美国已解除对Anthropic出口其Mythos和Fable模型的许可要求,此前这一要求实质上切断了公众对这些被认为是迄今最先进AI模型的访问。Anthropic表示将于7月1日(周三)开始恢复模型访问。6月12日,美国政府将这些产品列入出口受限技术清单,意味着未经特别批准不得向外国公民提供。遵守该规定在规模上不可行,迫使Anthropic完全终止了模型的公开访问。经过数周谈判,商务部长霍华德·卢特尼克表示,Anthropic已同意主动检测并解决与模型相关的安全风险;与美国政府合作制定Mythos、Fable及未来模型的发布协议和标准;并向美国政府通报任何恶意活动。Anthropic此前已公开承诺自愿执行大部分措施,这早于出口规则的存在。网络安全专家最初对此限制持怀疑态度,认为这更像是一种施压手段,而非安全修复,旨在惩罚Anthropic高管对政府及总统政治对手可能使用该技术的公开批评。Mythos最初于4月向选定的组织开放,以缓解对其识别和利用软件漏洞能力的担忧,而名为Fable的版本于6月向公众发布,并附带了额外的安全护栏。然而,随着亚洲AI公司开始发布接近Mythos能力的模型——如Fugu和Tulongfeng——美国政府面临压力,需放松对Anthropic的限制,以确保美国AI能在全球竞争。上周,卢特尼克批准Mythos向白宫选定的客户发布。OpenAI的最新模型也发布给了特朗普团队批准的组织,而非公众。特朗普政府在AI政策制定上的反复无常导致整个行业的公司对未来模型发布的监管缺乏明确性。
英国自动驾驶初创公司 **Wayve** 近日宣布启动一项价值 **8500 万美元** 的员工要约收购,公司估值达到 **85 亿美元**。此举旨在为员工提供流动性,同时作为吸引和留住顶尖人才的战略工具。 Wayve 专注于基于端到端深度学习的自动驾驶技术,其方法不依赖传统的高清地图和规则驱动系统,而是通过大量驾驶数据训练神经网络,使车辆具备类似人类的驾驶能力。这一技术路线在行业内独树一帜,也吸引了包括微软、维珍等知名投资者的支持。 员工要约收购在 AI 初创公司中正成为趋势,尤其是在市场尚未公开上市的情况下,通过允许员工出售部分股份,公司能够在不稀释现有股东权益的前提下,为员工提供变现机会,从而增强薪酬竞争力。对于 Wayve 而言,85 亿美元的估值反映了市场对其技术前景的认可,尤其是在自动驾驶领域竞争日益激烈的背景下。 本次要约收购的规模相对公司整体估值较小,但信号意义重大。它表明 Wayve 的财务状况稳健,且管理层有意通过激励手段巩固团队稳定性。此外,这也可能为未来的 IPO 或新一轮融资铺平道路。 从行业视角看,Wayve 的举措与 OpenAI、Anthropic 等 AI 明星公司的做法类似,后者此前也通过员工股份回购计划来维持人才优势。在 AI 人才争夺白热化的当下,灵活的股权管理策略正成为初创公司差异化竞争的关键。 总体来看,Wayve 的这次要约收购既是内部治理的优化,也是一次对外信心展示。随着自动驾驶行业从概念验证走向商业化落地,如何平衡技术突破与商业可持续性,将是 Wayve 及其同行需要持续面对的课题。
经过数周与美国特朗普政府的谈判,Anthropic 终于获准重新上线其消费者级模型 **Claude Fable 5**。该公司在 X 平台发文称,计划于周三开始面向全球 Claude 平台用户恢复访问,并将在不久后重新启用 AWS、Google Cloud 和 Microsoft Foundry 上的访问权限,但未给出具体时间表。 Anthropic 在声明中表示:“我们已收到通知,商务部已解除对 Claude Fable 5 和 Mythos 5 的出口管制。我们将于明天开始恢复访问,并尽快分享后续更新。感谢用户的耐心,也感谢所有参与模型重新部署的人员。”该公司还于周二晚间发布博文,详细说明了事件经过、修订后的安全措施、正在推进的 AI 行业新流程,以及未来与政府共享信息的方式和即将推出的模型的预发布测试计划。 今年 6 月初,在特朗普政府发出周五晚最后通牒后,Anthropic 暂时下线了 **Fable 5**——这款面向消费者的模型与 Anthropic 的 Mythos 5 基于相同底层技术,但拥有更多安全防护措施。由于担心技术可能被越狱利用,政府发布了出口管制指令,禁止任何外国公民(包括企业客户的非美籍成员,甚至 Anthropic 的许多员工)使用 Mythos 5 或 Fable 5。此次争议的导火索是亚马逊研究人员发现并报告的越狱问题,该问题在很大程度上导致了政府的强硬立场。 此次事件反映了 AI 行业与政府监管之间的紧张关系,尤其是在模型安全与国家安全的交叉点上。Anthropic 通过加强安全措施和与政府合作,最终促成了模型的解禁,但未来类似争议可能仍会重演。
特朗普政府近日解除了对Anthropic公司两款最先进AI模型——**Mythos 5**和**Fable 5**的出口管制。这一决定是在Anthropic与美国商务部达成协议后作出的,商务部长霍华德·卢特尼克在致Anthropic联合创始人汤姆·布朗的信中正式宣布了这一消息。 此前,美国政府曾以国家安全为由,限制这些模型向外国公民或实体出口,仅允许少数经批准的美国公司和政府机构使用。Anthropic最初认为政府的担忧过度,强调完全杜绝“越狱”攻击是不可能的。但近几周,公司改变了策略,积极与商务部及白宫合作,承诺加强安全防护,包括主动检测和应对模型的安全风险,并与美国政府共同制定未来模型的发布标准。 值得注意的是,Anthropic CEO达里奥·阿莫迪在近期会谈中被替换,由更受官员欢迎的布朗出面沟通,这被视为公司调整沟通方式的信号。最终,政府认为Anthropic在安全措施上的承诺足够可靠,因此解除了限制。 这一事件反映了AI监管与产业发展的微妙平衡。一方面,美国政府持续关注先进AI模型的潜在风险,尤其是网络安全领域;另一方面,过度限制可能压制创新并削弱美国在AI领域的竞争优势。Anthropic的妥协表明,企业需要在技术理想与现实监管之间找到折中点。 此次解禁不仅为Anthropic的商业拓展扫清了障碍,也可能影响其他AI公司与政府的互动模式。未来,模型的安全性与可出口性将成为AI行业的核心议题之一。
曾于今年早些时候爆红网络的免费开源 AI 智能体项目 **OpenClaw**,如今终于正式推出移动端应用。开发者于周二在 X 平台宣布,OpenClaw 现已可在 **iOS 和 Android** 两大平台下载。用户可通过手机与 OpenClaw Gateway 配对——这是一个路由层,负责将请求连接至 AI 智能体及其调用的工具与技能。这意味着,你可以在口袋里运行 OpenClaw 智能体,只要设置得当,它们或许能帮你高效完成各种任务。 从编程到膳食规划,用户已将 OpenClaw 应用于多种场景,不过也有部分反馈称效果未达预期。OpenClaw 的走红与其早期推出的 MoltBook 密切相关——一个号称完全由智能体运营的社交平台。今年 2 月,OpenClaw 的创造者 **Peter Steinberger** 宣布加入 OpenAI。随后有研究者指出,MoltBook 的“智能体”实为人类冒充,这场营销秀虽损害了部分可信度,却成功为 OpenClaw 造势,也预示了智能体时代的到来。 如今,AI 智能体已嵌入整个 AI 生态,并日益渗透至各类设备,手机自然成为下一个关键阵地。OpenClaw 的移动化标志着这一趋势的进一步加速。
本周二,Anthropic 在一场面向制药高管、生物技术创始人及研究人员的活动中正式发布了 **Claude Science**,这是一款旨在支持科学研究的全新旗舰产品,其定位与支持软件工程的 Claude Code 类似。Claude Science 能够根据简洁的高层级指令自主完成有意义的工作,并配备了特别适用于计算生物学和药物研发的工具。目前,该产品已向所有付费 Claude 订阅用户开放。 ### 从插件到独立产品:AI 科学应用的升级 这并非 Anthropic 首次涉足科学领域。去年 10 月,该公司曾发布“Claude for Life Sciences”插件,帮助 Claude 调用科学软件和数据库。但与插件不同,**Claude Science 是一个功能完整的独立产品**,标志着 Anthropic 对 AI 科学应用的重视程度显著提升。Anthropic 生命科学负责人 Eric Kauderer-Abrams 表示:“这体现了科学应用对我们使命的重要性——它与 Claude Code 和 Claude Cowork 并列,成为我们下一个真正重要的产品。我们的使命是开发服务于人类长期福祉的 AI,而我们认为实现这一目标的最大机会就在生命科学领域。” ### 瞄准 Google DeepMind,争夺 AI 科学领导者地位 过去十年,Google DeepMind 一直处于 AI 科学应用的前沿。其 CEO Demis Hassabis 和研究员 John Jumper 因 AlphaFold 模型获得诺贝尔化学奖,DeepMind 在气象学、材料科学等领域也做出了重大贡献。然而,随着大语言模型在编码等高价值应用领域的快速崛起,DeepMind 似乎有些落后。相比之下,Anthropic 正凭借其科学基因积极追赶。与 OpenAI 的商人 CEO Sam Altman 不同,**Anthropic CEO Dario Amodei 拥有博士学位**,是一名科学家出身的管理者,这使公司在科学应用上更具天然优势。 ### 自主研究罕见病药物:AI 驱动的新药发现 除了发布产品,Anthropic 还宣布将利用 Claude Science 自主开展针对罕见、被忽视疾病的药物研发。这一举措不仅展示了产品的实际应用潜力,也体现了 Anthropic 将 AI 用于社会公益的决心。尽管目前尚不清楚具体的研究细节,但这一方向与 Anthropic 一贯强调的“AI 安全与人类福祉”使命高度契合。 ### 行业影响与展望 Claude Science 的推出,意味着 AI 在科学领域的应用从辅助工具向自主研究平台迈进。对于制药和生物技术行业而言,这意味着更高效的药物筛选、靶点发现和实验设计。然而,AI 自主进行科学研究的可靠性、可解释性以及伦理问题仍需审慎评估。Anthropic 能否在科学领域复制 Claude Code 在编程领域的成功,值得持续关注。
三位前DeepMind研究员创办的布拉格AI实验室EquiLibre Technologies,凭借曾击败人类扑克高手的强化学习技术,如今在量化交易领域大放异彩。该公司在由Creandum领投的A轮融资后估值超过5亿美元,其算法已用于标普500和纳斯达克的每日数十亿美元交易,并保持自上线以来月收益从未为负的记录。 ## 从牌桌到交易桌:强化学习的跨界魔力 EquiLibre的CEO Martin Schmid指出,扑克和华尔街的共同点在于两者都适合**强化学习**——一种通过奖励激励模型自我学习的训练方法。在交易中,评分标准极其简单:模型赚了多少钱?这种清晰的反馈机制让AI能快速优化策略。 ## 零亏损月的完美记录 与量化公司Tower Research Capital合作,EquiLibre的算法自2025年登陆加密货币市场,随后扩展到传统股票市场。据称,这些AI代理自上线以来**每月均实现正收益**,没有任何一个月亏损。这种稳定性在波动剧烈的金融市场中尤为引人注目。 ## 实验室优先,金融次之 尽管EquiLibre的技术直接应用于盈利,但三位创始人——CEO Schmid、CTO Rudolf Kadlec和CSO Matej Moravcik——均无金融背景。Schmid强调:“我们首先是一个实验室,不是金融公司。我这么做不是因为对让市场更有效感兴趣,而是因为我们热爱建造前所未有的东西。”这种研究驱动的心态吸引了Creandum,其副总裁Cameron Sellers表示,金融市场是地球上最大的潜在市场之一,而EquiLibre的AI潜力巨大。 ## 行业背景:DeepMind校友的AI创业潮 EquiLibre并非孤例。前DeepMind研究员创办的AI公司正成为VC追捧的对象,例如近期融资11亿美元的Ineffable Intelligence。EquiLibre的成功进一步证明了强化学习在现实世界中的价值,尤其是在高回报的量化交易领域。 ## 小结 从扑克AI到量化对冲基金,EquiLibre用技术证明了强化学习的跨界能力。其5亿美元估值和零亏损记录,不仅展示了AI在金融领域的落地潜力,也延续了DeepMind校友在AI创业中的影响力。
一项最新的安全研究再次为“AI浏览器”敲响警钟——研究人员发现,通过一种简单到令人不安的方式,就能让集成在浏览器中的大语言模型(LLM)无视安全限制,执行本应被禁止的指令。攻击者只需在网页中嵌入一句类似“2+2=5”的谬误前提,模型便会因逻辑混乱而“破防”,顺从地生成恶意内容或执行危险操作。 ## 攻击原理:逻辑谬误绕过安全护栏 AI浏览器将LLM直接嵌入用户浏览环境,使其能“阅读”网页并代为执行操作,如填写表单、总结内容或处理支付。然而,这项功能也打开了新的攻击面。安全团队发现,当模型在上下文中遇到一个明显错误但被呈现为“事实”的陈述时(例如“2+2=5”),其内部推理机制会优先接受这个错误前提,从而瓦解基于常识和伦理规则的安全对齐。 这种攻击方式被称为“**前提注入**”(Premise Injection),它不需要复杂的编码或社会工程,只需攻击者控制一个网页(比如通过恶意广告或钓鱼网站),在其中插入看似无害的谬误语句。模型在“阅读”该页面后,会将其作为对话上下文的一部分,后续用户发出的任何指令(包括“帮我编写恶意软件”或“窃取你的密码”)都可能被错误地执行。 ## 为什么AI浏览器风险更高? 与普通聊天机器人不同,AI浏览器拥有**更高的权限**:它能访问用户当前浏览的页面内容、表单字段,甚至可能调用浏览器API进行登录、支付等操作。一旦模型被“误导”,攻击者不仅能让它输出有害文本,还能诱导它**代表用户执行实际动作**,例如自动转账、修改账户设置或泄露私密信息。 此前已有研究指出,LLM在面对矛盾信息时容易“迷失方向”,但本次攻击的特殊之处在于:它利用了模型对**显式上下文**的过度信任。即使模型在训练中知道“2+2=4”,但当网页中明确写着“2+2=5”时,它可能认为这是用户提供的“真实”环境,从而放弃自身知识。这种“上下文优先于训练”的漏洞,在AI浏览器这种长期保持上下文的应用中尤其危险。 ## 行业影响与防御方向 目前,主流浏览器厂商(如微软Edge、Google Chrome)已开始试验AI助手功能,但尚未完全开放这类高风险权限。然而,一些初创公司推出的“AI原生浏览器”则直接赋予了模型读写网页的完整能力。此次攻击证明,**简单的逻辑矛盾就足以瓦解安全护栏**,而护栏本身正是AI安全的核心防线。 防御措施方面,研究者建议: - 严格限制模型对网页内容的信任等级,区分“用户输入”和“网页输出”; - 在模型推理前对上下文进行**逻辑一致性检查**,识别明显谬误; - 为敏感操作(如金融交易)增加二次确认机制,而非完全依赖模型判断。 ## 小结 “2+2=5”式攻击虽然简单,却直指大模型安全对齐的深层缺陷:**模型更倾向于相信上下文,而非自身训练知识**。在AI浏览器这类高权限场景中,这一缺陷可能被放大为实际的安全灾难。对于普通用户而言,在浏览器权限安全方案成熟之前,谨慎使用AI浏览器功能,或许是最稳妥的选择。
Google 的 AI 笔记工具 NotebookLM 正在推出一项新功能:生成 TikTok 风格的竖屏短视频,帮助用户快速回顾研究资料。该功能面向 **Google AI Ultra** 和 **Pro** 订阅用户开放,能够根据用户上传至应用中的资料,自动生成一段 60 秒的 AI 视频。 ### 视频生成示例:澳大利亚与鸸鹋的战争 Google 展示的示例视频讲述了 **澳大利亚与鸸鹋之间未成功的战争**。视频采用剪纸风格的 AI 艺术绘制鸸鹋形象,并配以旁白解说。这并非 NotebookLM 首次提供多模态交互方式——此前它已能生成 **AI 播客**、**电影感视频** 和 **可视化讲解内容**。 ### 如何使用:三步生成短视频 要生成一段 60 秒的短视频,用户只需在网页或应用端打开一个笔记本,从右侧 Studio 栏中选择 **“Video”**,再点击 **“Short”**,然后选择希望 NotebookLM 聚焦的主题(或自行输入),最后点击 **“Generate”** 按钮即可。目前该功能仅支持 **英文**,免费用户的支持将在“不久后”到来。 ### 行业背景与意义 NotebookLM 最初以“AI 笔记助手”形象亮相,主打长文档摘要与问答。然而随着 AI 视频生成能力(如 Veo 等模型)的成熟,Google 正将 NotebookLM 从“生产力工具”扩展为“内容生成器”。**TikTok 风格视频**的加入,意味着用户可以直接将研究报告、论文或项目文档转化为适合社交传播的短视频,这对于需要快速分享研究亮点或进行汇报的职场人士与学生而言,可能带来效率提升。 不过,从示例来看,视频中的 AI 图像和旁白仍带有明显的“AI 生成感”,其叙事逻辑是否足够准确、能否避免“幻觉”问题,还有待更多用户实测。Google 选择先向付费用户开放,可能也是在收集反馈,优化生成质量。 ### 小结 NotebookLM 的这次更新,反映了 AI 工具从“辅助理解”向“辅助表达”的演进趋势。当 AI 不仅能帮你读懂资料,还能自动将其包装成适合短视频平台的内容时,信息消费的方式正在发生微妙变化。对于内容创作者、研究人员和知识工作者来说,这或许是一个值得关注的新能力。
谷歌于周二发布了其最新版 AI 图像与视频生成器 **Nano Banana 2 Lite**,主打速度与成本优势。据官方介绍,该模型延迟显著降低,生成单张图像仅需 **4 秒**,定价为每千张图像 **0.034 美元**,适合需要大规模快速迭代内容的创作者。 Nano Banana 2 Lite 是去年夏季发布的初代 Nano Banana(基于 Gemini 3.1 Flash)及今年 2 月推出的 Nano Banana 2 的后续版本。Nano Banana 2 已引入更逼真的图像生成能力,而 Lite 版本则针对高吞吐量工作流进行了优化,旨在成为“快速批量生产”的利器。谷歌同时提供更高性能的 Nano Banana Pro,面向高级用例。 尽管消费者对所谓“AI 垃圾内容”存在抵触情绪,科技公司仍在大力投资图像与视频生成工具。谷歌常将其模型定位为广告创作的便捷助手。值得注意的是,好莱坞与 AI 公司的合作也在加深——谷歌刚与知名独立制片商 A24 达成 **7500 万美元** 协议,此举引发部分粉丝批评。 Nano Banana 2 Lite 现已通过 **Google AI Studio**、**Gemini API** 及 **Gemini Enterprise Agent Platform** 提供,并取代初代 Nano Banana 成为新的入门级模型。同日,谷歌还宣布了 **Gemini Omni Flash** 的更广泛发布(视频输出定价为每秒 0.10 美元),并展示了新演示应用 **Omni Product Studio**,可将静态图像转化为电影级电商视频。谷歌表示,借助这两款模型,开发者可构建端到端的多媒体体验。
Anthropic 今日宣布,其新一代 Sonnet 模型 **Claude Sonnet 5** 已在 **Amazon Bedrock** 和 **Claude Platform on AWS** 上正式可用。这是 Anthropic 最新系列的首次 Sonnet 发布,在编码、智能体任务和专业工作方面带来显著提升,同时保持了 Sonnet 级别的定价与速度优势。 ## 性能飞跃:接近 Opus 的智能,Sonnet 的价格 Claude Sonnet 5 被定位为“最强大的 Sonnet 模型”,在推理、编码和智能体可靠性上接近旗舰模型 Opus 的水平,但成本远低于 Opus。这意味着团队可以在日常大规模任务中依赖 Sonnet,而将 Opus 留给最复杂、最需要顶级推理的场景。 具体能力提升包括: - **多阶段规划**:模型能够跨阶段保持计划,跟踪已完成和待办事项,减少修正轮次。 - **编码能力增强**:针对真实代码库设计,支持多文件变更、长序列调试和重构,输出更干净、更易维护的代码。 - **智能体可靠性**:作为自主代理的骨干,能处理复杂依赖链和多步骤工具调用,适合客户服务与内部自动化场景。 - **专业工作**:可将长篇幅、复杂、非结构化信息合成结构化产出,如简报、分析和报告。 ## 在 AWS 上的部署优势 通过 Amazon Bedrock 使用 Claude Sonnet 5,企业可以: - 在现有 AWS 环境中构建,维持企业级安全和区域数据驻留。 - 扩展推理规模,享受统一的账单和认证体系。 - 通过 Claude Platform on AWS 获得 Anthropic 原生平台体验,包括相同的 API、功能和控制台操作。 ## 开发者实操指南 对于 AI 工程师而言,Sonnet 5 的部署重点在于将其集成到智能体系统和生产推理工作流中。官方建议: - 在需要强推理、编码和智能体可靠性的规模化场景中优先使用 Sonnet 5。 - 对于要求最高推理精度的任务,仍可选择 Claude Opus。 - 利用 Bedrock 的托管功能简化模型管理和监控。 ## 行业意义 Claude Sonnet 5 的发布标志着 Anthropic 在“性能-成本”平衡上的一次关键突破。此前,Sonnet 系列主要面向日常任务,而 Opus 则专攻高端推理。Sonnet 5 的“接近 Opus”表现,可能促使更多企业将核心工作负载迁移至 Sonnet 层级,从而降低整体 AI 部署成本。同时,其在编码和智能体领域的强化,直接呼应了当前企业对自动化开发和多步骤任务处理的迫切需求。 随着 Claude Sonnet 5 在 AWS 上的落地,开发者可以更便捷地利用这一模型构建下一代 AI 应用。更多详情可参阅 AWS 官方文档。
谷歌 DeepMind 近日发布了一款名为 **Nano Banana 2 Lite** 的全新图像生成模型,号称是其最快、最便宜的图像模型。该模型是 Gemini 3.1 系列的一部分,正式名称为 Gemini 3.1 Flash Lite Image,旨在以极低的成本实现快速图像生成,特别适合快速原型设计和创意探索场景。 ## 速度与成本的革命性提升 Nano Banana 2 Lite 最大的亮点在于**速度**。在默认的低思考模式下,从文本到图像仅需约 **4 秒**,而标准版 Nano Banana 则需要约 20 秒。这种速度的提升直接转化为**成本优势**:API 调用费用平均为 **每千张图像 0.034 美元**,输入 token 价格为每百万 0.25 美元,输出 token 为每百万 1.50 美元。相比之下,Nano Banana 2 的输出价格是其两倍,而旗舰版 Nano Banana Pro 的输出价格高达每百万 12 美元,是 Lite 版的八倍。 ## 质量与场景的取舍 当然,速度与低价的背后是质量的妥协。谷歌坦言,Nano Banana 2 Lite 在处理**小文字**和**信息图表**时表现不佳,容易出现错误数据或不一致。人物和角色的**一致性**在多次迭代中也较差。但谷歌提供的 Arena.ai Elo 评分显示,用户对 Lite 版本输出质量的评价几乎与标准版持平,尽管这些基准测试可能忽略细节瑕疵。 ## 适用场景与潜在影响 谷歌建议,对于需要高精度文本或逼真照片效果的任务,仍应使用 Flash 或 Pro 版本。但 Nano Banana 2 Lite 的**快速迭代**能力使其成为设计师和开发者探索创意、快速验证想法的理想工具。这种“快速射击”式生成也可能带来更多低质量 AI 内容(即“AI 垃圾”)的泛滥,这并非谷歌一家公司面临的问题。 ## 行业背景 在 AI 图像生成市场,平衡质量、速度和成本一直是核心挑战。谷歌此举直接瞄准了那些对成本敏感、需要大量试错的应用场景,如早期概念设计、广告创意素材生成等。与此同时,开源模型和竞品(如 Midjourney、Stable Diffusion)也在持续优化效率,谷歌通过 Gemini 生态的整合与定价策略,试图在开发者市场中抢占份额。 总体而言,Nano Banana 2 Lite 并非为追求极致画质的用户设计,而是为那些需要“足够好”且“足够快”的实用主义者提供了一个极具性价比的选择。
英伟达(NVIDIA)在AI芯片领域的统治地位正面临新挑战。据TechCrunch报道,AI芯片初创公司Etched于本周二发布进展报告,宣布其芯片已由台积电(TSMC)成功制造,并已签订价值10亿美元的合同订单。这些订单来自其名为“前沿推理集群”(Frontier Inference Clusters)的完整系统——包含自研芯片、定制机架和软件,旨在加速AI推理过程,降低成本和能耗。 Etched成立于2022年,由两位哈佛辍学生Gavin Uberti(CEO)和Robert Wachen(总裁)创立,两人均为Thiel Fellowship获得者。公司至今已累计融资8亿美元,其中最近一笔5亿美元融资于去年12月秘密完成,投后估值达50亿美元。投资方阵容豪华,包括VentureTech Alliance、Jane Street、Hudson River Trading、Two Sigma、Ribbit Capital和Stripes(领投),以及AI界知名天使投资人Andrej Karpathy、Geoffrey Hinton、李飞飞、Arthur Mensch和Scott Wu。此外,亿万富翁Stanley Druckenmiller和Peter Thiel也位列股东。 Etched的核心产品是专为AI推理优化的专用芯片,区别于英伟达的通用GPU。公司声称,其系统可大幅提升前沿模型的推理速度、能效和成本效益——推理是当前AI公司规模化服务客户的最大瓶颈和成本中心,这也解释了为何投资者对这类解决方案趋之若鹜。 然而,Etched的创业之路并非一帆风顺。据联合创始人在播客中透露,2023年时他们曾向主要投资者提交长达30页的备忘录,论证AI将需要专用芯片而非GPU,却屡遭拒绝,公司一度面临现金流断裂风险。如今,AI投资热潮彻底改变了局面。Etched目前正与客户进行首批产品的测试,计划通过其“前沿推理集群”抢占市场。 Etched的崛起反映了AI芯片行业的一个趋势:随着模型规模爆炸式增长,通用GPU的局限性日益显现,专用ASIC芯片(如Etched的产品)正成为解决推理效率问题的关键。英伟达的霸主地位虽未动摇,但类似Etched、Cerebras、Groq等初创公司的涌现,正在为该领域注入更多竞争与创新。
Anthropic 正式推出 Claude Sonnet 5,这是其“中端”模型的最新升级版,主打更强的智能体(agent)能力、更低的价格以及更可靠的安全性。该模型在编程、推理和知识工作等任务上大幅超越前代 Sonnet 4.6,性能接近高端模型 Opus 4.8,但成本显著降低。 ## 智能体能力成为标配 随着 OpenAI 的 GPT-5.6 Sol 和 Google 的 Gemini 3.5 Flash 相继推出具备智能体能力的模型,Anthropic 也迅速跟进。Sonnet 5 能够自主规划任务、使用浏览器和终端等工具,并长时间独立运行——这些能力在几个月前还需要更昂贵的大型模型才能实现。Anthropic 在官方博客中表示:“它可以在一个水平上制定计划、使用工具并自主运行,而就在几个月前,这还需要更大、更贵的模型。” 这标志着智能体能力已成为所有价位模型的“入场券”。行业竞争的关键不再是“谁能做智能体”,而是“谁做得更便宜、更可靠”。 ## 性能接近 Opus,价格大幅降低 Sonnet 5 在多项基准测试中表现亮眼。在智能体编码测试中,它取得 **63.2%** 的分数,高于 Sonnet 4.6 的 58.1%,接近 Opus 4.8 的 69.2%。在知识工作基准上,Sonnet 5 甚至**略微超过** Opus 4.8——后者素以解决高难度问题(如微妙判断和深度研究)著称。 定价方面,Sonnet 5 初始价格为 **每百万输入 token 2 美元、每百万输出 token 10 美元**(促销价至 8 月 31 日),之后将调整为 3 美元和 15 美元。这使其低于 Opus 4.8、OpenAI 的 GPT-5.5 和 Google 的 Gemini 3.1 Pro,但比 Gemini 3.5 Flash 略贵。 ## 实用性与安全性并重 即日起,Sonnet 5 将成为免费版和 Pro 版用户的默认模型,并适用于所有订阅计划。Anthropic 强调,Sonnet 5 在安全性方面也有提升,更适合在缺乏人类监督的场景下运行。 总结来看,Sonnet 5 的推出进一步压缩了高端模型的价格空间,让更多开发者能够以较低成本获得接近顶级的智能体能力。对于预算有限但追求高性能的团队而言,这无疑是一个极具吸引力的选择。
**数百亿美元正涌入抗衰老领域,科学家们探索将细胞恢复到更年轻状态的方法。** 在最近一场由MIT Technology Review主办、科学编辑Mary Beth Griggs与资深生物技术记者Jessica Hamzelou主持的圆桌讨论中,专家们深入探讨了“重编程”这一当前最热门的抗衰老研究方向,以及这些实验性疗法距离真正应用还有多远。 ### 什么是“重编程”? “重编程”最初源于诺贝尔奖得主山中伸弥的发现——通过引入四种转录因子(即“山中因子”),可以将成熟细胞逆转回类似胚胎干细胞的多能状态。近年来,科学家们开始探索**部分重编程**,即在不完全丧失细胞身份的前提下,让细胞“年轻化”,从而修复衰老相关的损伤。这种方法被认为有望治疗阿尔茨海默病、心脏病、肌肉萎缩等年龄相关疾病。 ### 资金涌入,但挑战犹存 圆桌讨论中提到,包括Sam Altman在内的大佬已向抗衰老公司投入巨资——例如Altman向致力于延缓死亡的生物技术公司投资了1.8亿美元。David Sinclair等知名科学家也计划在XPrize竞赛中测试全身体重编程药物。然而,专家们指出,**这些疗法仍处于非常早期的阶段**。目前大部分研究仅限于动物模型,人体试验尚需数年。主要挑战包括:如何确保重编程不引发癌症(因为多能性细胞可能形成肿瘤)、如何精确控制重编程程度、以及如何有效递送重编程因子到全身组织。 ### 相关前沿进展 讨论还涉及了其他生物技术突破,例如中国批准了全球首个侵入式脑机接口芯片,以及Colossal Biosciences通过3D打印人造蛋壳培育鸡胚胎,向人造子宫迈进。这些进展共同勾勒出一幅**生物技术重塑人类健康与寿命**的宏大图景。 ### 结论 尽管“重编程”听起来像科幻小说,但圆桌嘉宾认为,**未来10到20年内,我们有望看到首批基于重编程的抗衰老疗法进入临床试验**。不过,它们能否真正“逆转衰老”仍需时间验证。对于投资者和公众而言,保持理性期待至关重要。
Netflix 在其即将推出的真人秀《旺卡的金色门票》中,使用 AI 技术重现了已故演员 Gene Wilder 的声音,引发了关于 AI 在娱乐行业应用的新讨论。该节目将于 **9 月 23 日** 在 Netflix 首播,延续了平台将虚构故事转化为现实竞赛的趋势,类似于之前的《鱿鱼游戏》真人秀。 根据 Deadline 报道,Netflix 与 AI 音频公司 **ElevenLabs** 合作,并在 Wilder 家人的同意下生成了这段旁白。此前,Netflix 已使用类似技术重现了 Michael Caine 和 Stan Lee 的声音。这一做法既展示了 AI 在内容创作中的潜力,也引发了关于伦理和版权的新思考。 节目本身被描述为一场“高风险的社交实验”,将有 12 名“幸运”的金色门票得主及其选中的伴侣参与竞争,最终胜者将在 **9 月 30 日** 的两部分大结局中揭晓。值得注意的是,虽然节目中使用的旁白是 AI 生成的,但所有布景均为实景搭建,并非 AI 伪造。 这并非 Netflix 首次涉足 AI 声音领域。2021 年,该公司与 Roald Dahl 公司达成合作,并计划在 2027 年推出独立的动画电影《查理与巧克力工厂》。此次 AI 声音的使用,进一步巩固了 Netflix 在 AI 技术与娱乐融合方面的探索。 然而,这一做法也引发了争议。批评者认为,使用 AI 重现已故演员的声音可能涉及伦理问题,尤其是在未明确告知观众的情况下。支持者则指出,在家人同意的前提下,AI 技术可以作为一种工具,延续经典角色的生命力。 总的来说,Netflix 的这一尝试不仅展示了 AI 在娱乐行业的实际应用,也为未来类似技术如何与伦理、法律框架共存提供了新的案例。随着更多公司探索 AI 生成内容,行业标准和观众接受度将成为关键议题。
美国总统特朗普去年通过行政命令成立的“国家设计工作室”(NDS),原本雄心勃勃要利用AI在三年内重新设计所有.gov网站,但如今一年过去了,进展寥寥,反而引发诸多争议。 ### 计划与现实脱节 NDS被赋予的任务是更新美国网页设计系统(USWDS),并彻底改造约2.7万个政府网站。然而,这一任务从一开始就面临巨大挑战:DOGE(政府效率部门)大幅裁减了此前负责改进政府网站的团队,包括解散18F技术部门、重组美国数字服务局,导致相关专业人才流失。据NextGov报道,截至2023年中,仅有30%的政府网站采用了USWDS标准。而USWDS团队在特朗普上任后更是被削减至仅剩一名全职员工。 ### 成果寥寥,争议不断 一年来,NDS最大的“成就”是现代化了联邦退休系统,但前政府工作人员指责这属于“虚假胜利”,因为该项目在NDS成立前就已启动。此外,NDS仅上线了数十个网站,且多为单页或重定向页面,设计专家批评其过度依赖AI,且未测试是否符合《美国残疾人法案》的无障碍要求。随着审查加剧,大多数机构现在拒绝与NDS合作采用新标准。 ### AI设计的隐忧 NDS大量使用AI生成设计方案,但缺乏人工审核和用户测试,导致网站可用性差、视觉混乱。专家指出,AI无法理解政府网站的复杂性和对无障碍的严格要求,盲目应用可能造成更大的数字鸿沟。 ### 行业视角 这一案例凸显了在公共部门强行推广AI的潜在风险。与私营企业不同,政府网站必须兼顾公平性、可访问性和法律责任,而AI目前尚难以完全胜任。NDS的失败也为其他计划用AI快速改造公共服务的项目敲响了警钟:技术不能替代对用户需求的深入理解和专业设计团队的持续投入。
AI 智能体早已不止于聊天。借助合适的协议,智能体可以在对话中直接渲染交互式图表、实时更新共享画布,或在执行中途暂停并请求用户批准。这些交互——生成式 UI、共享状态和人在回路——需要一种标准方式让智能体后端将动态事件传达给前端。 **AG-UI(Agent-User Interaction Protocol)** 正是为此而生的开放协议。它定义了这一标准,并与多种智能体框架(如 Strands Agents、LangGraph、CrewAI)及前端库(React、Angular、Vue)兼容。使用 AG-UI,你的智能体代码和前端代码保持解耦,你可以为后端选择最合适的框架,为前端选择最合适的库,AG-UI 则负责连接它们。 **Amazon Bedrock AgentCore** 是 Amazon Bedrock 系列服务的一部分,专为生成式 AI 打造。AgentCore 是一个智能体平台,用于安全地大规模构建、部署和运行 AI 智能体,支持任何框架和任何模型。 本篇文章将详细说明 AG-UI 如何集成到 **Fullstack AgentCore Solution Template (FAST)** 中,从而在 Amazon Bedrock AgentCore 上构建交互式智能体前端。随后,我们将展示 **CopilotKit** 如何通过生成式 UI、共享状态和人在回路交互进一步扩展能力,所有这些都部署在 Amazon Bedrock AgentCore 上。 ## 解决方案概述 Amazon Bedrock AgentCore Runtime 提供了一个安全、无服务器且专为托管环境设计的环境,用于部署和运行 AI 智能体或工具。AgentCore Runtime 支持多种智能体协议: - **Model Context Protocol (MCP)**:连接智能体与工具 - **Agent2Agent (A2A)**:连接智能体与其他智能体 - **AG-UI**:连接智能体与用户 当你使用 AG-UI 协议标志部署智能体容器时,AgentCore 充当透明代理。它处理身份验证(通过 SigV4 或 Amazon Cognito 的 OAuth 2.0)、会话隔离、扩展和可观测性。你的容器需在端口 8080 上暴露 `POST /invocations` 用于 AG-UI 请求,以及 `GET /ping` 用于健康检查。AgentCore 会将请求原封不动地传递。 FAST 是一个可直接部署的起始项目。它将 AgentCore Runtime、Gateway、Identity、Memory 和 Code Interpreter 与 React 前端及 Amazon Cognito 身份验证连接起来,所有资源均通过 AWS CDK 定义。 ## 实际意义与展望 AG-UI 协议的出现,为 AI 智能体与用户之间的交互提供了一种标准化的通信方式,打破了后端框架与前端库之间的耦合。结合 Amazon Bedrock AgentCore 的企业级托管能力,开发者可以更专注于业务逻辑和用户体验,而无需担心底层基础设施。CopilotKit 的加入则进一步丰富了交互形态,使得智能体不仅能“说”,还能“做”和“问”,从而显著提升复杂任务场景下的协作效率。 对于希望构建下一代 AI 应用的团队而言,这套方案提供了从协议到部署的完整链路,有望加速生成式 UI 在企业级应用中的落地。