🔥 HN 热议

AI模型会消失吗?Pirate Face想用分散保存留下它们

约3分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
磁力链接(cí lì liàn jiē)

用来找到共享文件的链接。

web-seed

放在共享文件里的普通下载地址。

SHA-256

用来比较文件是否相同的指纹值。

发生了什么

Pirate Face(一个想让开放AI模型更不容易消失的服务)提出了一种保存方法。它把符合条件的模型做成torrent,并生成磁力链接。Hugging Face是一个存放AI模型文件的网站。每个torrent还可以包含一个web-seed,也就是指向Hugging Face原文件的普通下载地址。只要原地址还能使用,用户就能从Hugging Face下载。如果原模型被删除,Pirate Face说,下载可以转向仍然保存文件的其他参与者。服务还会把文件和Hugging Face提供的SHA-256进行比较。Pirate Face

背景是什么

这个项目关注的是一个简单问题:开放模型可能只依靠一个网站。Pirate Face在任务说明中称,模型可能因为设置访问门槛、改变许可证、停止维护或被下架而消失。文件消失后,过去的实验可能难以重新进行,比较结果、微调模型和使用这些文件的产品也可能受到影响。Pirate Face并不把自己描述成Hugging Face的替代品,而是想在原网站下面增加一层安全网。项目说明

为什么重要

它保存的不是一个网址,而是尽量保存同一个文件。SHA-256可以像文件指纹一样,帮助用户比较下载的文件是否和记录中的文件一致。它不能说明模型是否聪明、安全或有用,只能说明文件是否相同。这一点很重要,因为一个镜像可以保存文件,却不能自动回答模型质量和使用风险的问题。

Pirate Face还提供作者身份确认。用户可以把公开名称和对应的Hugging Face账号联系起来。官方账号通过确认后,名称才会有验证标记。这不能让模型变得更好,却能让用户更容易知道谁声称拥有这个模型,并减少冒用名称的情况。

已经能确认的事

官方页面表示,用户不登录也可以浏览、下载和做种。目前,提交模型时,模型必须已经存在于Hugging Face。提交者还需要提供来源证据、固定版本、文件校验信息和许可证证据。页面列出的主要范围是MIT和Apache-2.0模型,并列出Kimi-K3例外。

有些功能还没有正式上线。直接在Pirate Face发布模型、让现有程序通过一个简单API接入,以及为做种提供奖励,都被写成未来计划。页面还特别说明,积分不是钱,也不是算力额度。

这条消息在Hacker News上获得了很大关注。关注度说明很多人对这个问题感兴趣,但不等于Pirate Face已经被证明可靠,也不等于官方说明都经过独立测试。Hacker News讨论

仍然不知道什么

官方页面说明了设计目标,但还不能单独证明长期效果。真正从Hugging Face消失的模型,是否能顺利切换到其他参与者?每个模型会有多少人长期做种?模型更新后,旧版本和新版本怎样区分?存储和带宽由谁承担?遇到许可证争议或下架要求时怎样处理?这些问题都会影响长期可用性。

目前,Pirate Face仍然依靠Hugging Face作为模型来源。只有等直接发布功能上线,它才能减少对原网站的依赖。

接下来观察什么

最清楚的测试,是一个模型从Hugging Face消失后,原来的磁力链接仍然可以下载。第三方还可以比较文件内容、下载稳定性和长期做种情况。接下来应关注直接发布和API是否真的上线,也要继续看许可证检查和作者验证是否有效。只有这些功能从计划变成可重复的实际结果,Pirate Face才更容易被当作保存基础设施来评估。

💬 Pirate Face:用种子网络保存 LLM 的期待与疑问

评论区整体认可分散保存模型的想法,但也指出了持久性、实现、安全、注册方式和模型改写副作用等问题。

  • 支持者认为,用 BitTorrent 分发大型 LLM 权重,可以减少对 Hugging Face 这类单一主机的依赖,并让参与者分担带宽;这只是评论者的判断,不等于永久可用已经得到证明。
  • 持久性并不会自动出现:文件一更新,就可能形成新的 torrent,种子和下载者也会被分散。一位评论者还报告称,虽然可以从本地文件建立 torrent,但当时无法把 Hugging Face 指定为 web seed 或 backstop,因此本地 torrent 与 HF 文件的精确匹配和回退机制没有按宣称工作。
  • 有人质疑“模型只是因为被消除拒答而从 Hugging Face 下架”的简单说法,认为至少有一次下架与上传者设置可疑访问条件和骚扰式推广有关。评论者也担心恶意微调模型窃取凭据;同一评论后来指出 Pirate Face 会核对 Hugging Face 哈希,但这不等于完整的安全审计。
  • 要求用户发 Hacker News 或 X 帖子才能注册,被批评为诱导垃圾信息。即使有人认可保存模型的目标,也可能因此不信任服务入口。
  • 技术上有人提议不修改原始权重,而是在运行时对激活做正交化,去掉“拒答”方向。提议者称每层只需分发几千个浮点数,计算开销很小,还能避免修改 QAT 后的权重再量化所造成的精度损失,以及拒答行为重新出现。
  • 反方指出,完整的 abliterated 权重仍有兼容性优势:托管推理服务通常只接受模型 URI,不一定支持运行时 steering。因此,预先改好的权重在某些环境中更容易使用。
  • 性能方面,一位用户自报:消除拒答后的 Qwen 27B 在其内部基准上比原始权重差30%。评论没有提供测试方法,不能据此推断所有模型。

这是评论数为120时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Pirate Face怎样让AI模型不容易消失

📰 完整报道: AI模型会消失吗?Pirate Face想用分散保存留下它们

它想让AI模型不只依靠一个网站保存。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Hugging Face

存放AI模型文件的网站。

校验值(jiào yàn zhí)

帮助检查文件有没有改变的值。

点对点(diǎn duì diǎn)

让使用者之间直接分享文件的方式。

💡 一句话总结

  • Pirate Face想让AI模型不容易消失。
  • 文件先从Hugging Face下载。
  • 原网站消失后,其他人可以继续分享。

Pirate Face(帮助保存AI模型的服务)把一些模型做成特殊的磁力链接。Hugging Face(存放AI模型的网站)仍然是最初的下载来源。官方说明

只要Hugging Face还能提供文件,用户就从那里下载。链接里还记录了另一个办法。如果原文件以后消失,网络中保存过它的人可以继续提供文件。这是一种点对点分享方式,文件不只放在一个地方。

服务还会给文件配上SHA-256校验值。校验值像文件的小指纹。下载后把两个指纹放在一起比较,就能发现文件是否改变。它不能告诉我们模型回答得好不好,也不能证明模型一定安全。它主要帮助用户确认文件没有被换成另一个版本。

目前,提交模型需要它已经在Hugging Face上。提交者还要说明文件来源和许可证,也就是文件可以怎样使用。官方页面说,不登录也可以浏览、下载和做种。做种就是继续保存文件,让别人也能下载。

直接发布模型的功能、连接现有程序的API,以及做种奖励,目前都只是计划。页面还说,积分不是钱。

这件事在Hacker News上受到关注。关注说明大家对保存AI模型感兴趣,不说明服务已经长期可靠。真正需要观察的是,原网站删除模型后,其他人是否仍会保存并提供它。

来源:Pirate Face、Hacker News

💬 Pirate Face:保存 AI 模型的好主意与弱点

用 torrent 分享模型可能很方便,但评论者也发现了保存、技术、安全和注册方面的问题。

  • torrent可以让大型AI模型不只依靠一个网站来分发。但如果大家不再分享,或者模型更新了,原来的分享网络就会分开。
  • 一位评论者说,本地文件可以做成 torrent,但当时不能把 Hugging Face 接成备用来源,所以文件完全一致和自动回退的功能没有按预期工作。
  • 评论者不同意“模型因为消除拒答而被删除”的单一解释;有人认为某次删除和可疑的访问条件、垃圾信息有关。他们也担心恶意模型偷走登录凭据,并认为哈希检查很重要。要求注册者在 HN 或 X 发帖,也被批评为像在制造垃圾信息。
  • 另一种方法是不改动大模型文件,而是在运行时去掉一个小小的“拒绝回答”信号。这样可以少存一些数据,也能避免重新量化带来的问题。
  • 不过,一些云端推理服务只接受模型网址,不支持这种运行时方法,所以仍然需要完整的改动版模型。一位用户自报,改动后的 Qwen 27B 在内部测试中差了30%;这只是一个人的结果,不代表所有模型。

这是评论数为120时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Pirate Face想把AI文件留下来

📰 完整报道: AI模型会消失吗?Pirate Face想用分散保存留下它们

它想让AI文件不只放在一个地方。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Pirate Face

帮助保存AI文件的服务。

Hugging Face

放AI文件的网站。

小指纹(xiǎo zhǐ wén)

用来比较文件有没有变化的小标记。

Pirate Face(帮助保存AI文件的服务)做了分享链接。

Hugging Face(放AI文件的网站)先给出文件。

如果那里没有了,其他人可以分享文件。

文件上有一个小指纹。

小指纹能帮忙检查文件有没有变。

但是,人们要一直分享文件。

没人分享时会怎样,还不知道。

这个消息在Hacker News上很受关注。

看的人多,不等于它一定正确。

有些新功能还没有做好。

来源:Pirate Face、Hacker News

💬 Pirate Face 是什么?

它想让很多人一起保存大大的 AI 文件。

  • 很多人保存同一个文件,就不怕一个网站突然没有了。但如果大家不再分享,或者出现新版本,大家就会分成小组。
  • 有人说,Pirate Face 的 Hugging Face 备用功能在一次本地测试中没有正常工作。大家也没有完全同意模型为什么会被删除,并提醒要检查哈希。要求发 HN 或 X 帖子才能注册,也让人觉得像垃圾信息。
  • 还有一种办法是不改大文件,只在 AI 工作时拿走一个小小的“我不能回答”信号。但有些云服务不会这个办法,只能使用改好的完整文件。
  • 一位用户说,改动后的 Qwen 27B 在自己的测试里差了30%。这是一个人的报告,不是所有模型都会这样。

这是评论数为120时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

来源