见闻文章网 手机版
热门文章
  • 甘井子区举办“赋能争先 聚力攻坚”知行学堂第二期培训
    为强化春季火灾防控工作,全面提升干部群众消防安全管理能力和安全意识,3月21日,区委组织部举办“赋能争先 聚力攻坚”知行学堂第二期“消防应急”专题培训。 按照“大力支持业务骨干走上讲台”的工作要求,本次培训邀请区应急管理局党委书记、局长和区消防救援大队大队长分别以《防救结合强化基层应急管理工作》《基
  • 续航灭霸来了!7300mAh大电池+90W快充,月底发!
    近日,vivo Y300 Pro+ 配置被曝光了。此前 Y300 系列凭借出色续航与亲民价格已积累不少好口碑。Y300 Pro+的配置从处理器性能提升到影像优化,可以说是亮点十足。小雷先带大家看看外观。Y300 Pro+ 延续了前代 Y300 Pro 的全等深微四曲屏,配备 6.77 英寸屏幕,具备
  • 《落子未来》!大连新势力崛起
    今晚8点大连新闻综合频道,锁定系列纪录片《落子未来》第三集《引智聚企》,带您走进具有强大创新能力的全球独角兽企业和极具创新发展潜质的瞪羚企业,了解大连创新矩阵的重要力量,解码科技创新和产业创新深度融合。看这片科创热土如何以科技为笔以产业为卷绘就一幅中国式现代化的创新蓝图全球独角兽——不同“钒”响位于
  • 今日开票!2025 中超大连英博主场首战在即,燃爆梭鱼湾!
    来源:大连英博足球俱乐部、甘井子文旅▼▼
最新文章
  • 富阳队力克永康队,收获浙BA城市争霸赛主场首胜!
    当“杭州王”遇上“金华王”,谁能笑到最后?8月29日晚,在浙BA城市争霸赛B组第三轮的比赛中,坐镇主场的富阳队以79-71战胜永康队,获得争霸赛主场首胜的同时,也取得了小组赛两连胜。在之前的比赛中,富阳队首轮以65-59战胜绍兴队,成为城市争霸赛第一支客场取胜的区县队。由于第二轮轮空,富阳队有了更多
  • 武汉学院学生宿舍暑期全面提档升级
    荆楚网(湖北日报网)讯(记者唐天琪 通讯员叶同春)今年暑期,武汉学院聚焦学生住宿需求,启动宿舍提档升级专项行动,从硬件改造、隐患排查到住宿调整多维度发力,为全校1.1万余名老生和0.4万余名新生打造安全、舒适、统一的居住环境,以崭新面貌迎接学子秋季返校。此次升级首抓硬件标准化建设,系统性推进五大改造
  • 济南这场超燃的反诈宣传本周收官!边听歌边学防骗知识,周末最后打卡机会!
    8月29日晚,警邮媒联动反诈宣传活动继续在泉城广场精彩上演。济南本土歌手和乐队带来风格各异的音乐作品,让市民感受济南秋夜的惬意。活动现场特别设置的四大主题互动区让市民们在游戏中学会了识别诈骗陷阱,让安全知识潜移默化深入人心。 此次活动将于31日晚正式结束,喜欢音乐的市民朋友千万不要错过。记者: 郭尧
  • "0反式脂肪酸"宣传遭质疑,喜茶等网红奶茶陷舆论风暴
    8月28日,网易财经发布文章“五问喜茶的‘严正声明’”,再度质疑喜茶对产品反式脂肪酸超标的回应。双方多轮的舆论交锋,反映了现制茶饮安全标准缺位、消费者知情权难保障等行业问题。事件回顾:各自立场下的真相溯源奶茶安全问题一波三折 8月25日,网易财经送检8大奶茶品牌产品,并发布了检测报告。结果显示,同批
您的位置: 首页 > 实时讯息 >

刷新世界记录,40B模型+20万亿token,散户组团挑战算力霸权

0次浏览     发布时间:2025-05-27 09:45:00    

全球网友用闲置显卡组团训练大模型。40B大模型、20万亿token,创下了互联网上最大规模的预训练新纪录!去中心化AI的反攻,正式开始。OpenAI等巨头的算力霸权,这次真要凉了?

互联网上最大规模的预训练来了!

Nous Research宣布正式推出Psyche网络(Psyche Network),通过去中心化方式革新人工智能(AI)训练。

Psyche网络利用区块链技术,汇聚全球计算资源,成功启动了40B参数大语言模型Consilience的预训练任务,总计20万亿token,创下了迄今为止互联网上最大规模的预训练纪录。

大语言模型Consilience采用DeepSeek V3的多头潜在注意力(MLA)架构,相较于Llama使用的GQA架构更具表达力,同时通过优化QKV投影矩阵减少计算开销。

三种注意力的对比

Psyche利用全球闲置的计算资源(如4090、A100和H100等消费级GPU),大幅降低训练成本。

通过并行实验,Psyche鼓励开源社区提出新的模型架构和训练方法,未来可能催生更多创新。

Psyche网络技术原理图,核心在于DisTrO优化器与Solana区块链

过去,人们总觉得「AI模型的去中心化训练」不过是一种幻想,尤其在那些超越了爱好者规模的语言模型面前更是如此。

但几项关键技术突破——尤其是并行化和强化学习——正在逐渐打破这种局限,让除了OpenAI、Anthropic这类大公司之外的小型团队也开始进入这个赛道。

现在看来,聪明的算法可以弥补基础设施的不足,而像Nous Research这样的去中心化参与者正希望抓住这个机会。

砸碎算力墙

近年来,AI模型的训练逐渐被大型科技公司垄断。

训练一个前沿模型需要数千个高性能GPU和超高带宽的集群,这使得普通研究者或小型团队几乎无法参与。

这种集中化趋势不仅限制了创新,还可能导致少数科技去投垄断甚至控制AI模型。

集中式AI,可能会少数科技巨头「比你更了解你自己」。

Hermes系列中规模最大的模型——Hermes 3 405B,是在基础的Llama 3.1模型上进行微调完成的。

整个训练过程动用了128块H100 GPU,耗时约16小时(总计约2,086GPU小时)。

从成本上看其实并不离谱——目前租用8块H100的计算节点每小时大约在16到24美元之间,因此一次完整训练的开销大约在5,000美元左右

作为Nous Research Hermes系列的最新迭代Hermes 3 405BLlama-3.1 405B的全参数微调模型

但如果我们想更进一步,想得更大呢?

毕竟,Hermes目前还是依赖Llama作为基础模型。

如果我们不再依赖已有的模型,而是从零开始构建自己的基础模型,那我们就需要更庞大的“船”了。

要以更大规模、低成本地实现类似的训练成果,确实面临不少挑战,尤其是当训练从集中化的GPU集群转向基于互联网的去中心化网络时。

Nous Research提出了Psyche网络的解决方案:通过去中心化的方式,让全球的计算资源参与AI模型训练,降低进入门槛,推动AI发展的民主化。

Nous Research的Psyche网络成功实现了去中心化的AI训练,开创了一个全新的模式。

Psyche不仅降低了AI开发的门槛,还推动了全球协作和创新。

Consilience模型的预训练只是起点,未来Psyche网络有望成为AI民主化的重要基石,为开源社区和小型团队提供与科技巨头抗衡的机会。

用DisTrO解决带宽瓶颈

在去中心化训练中,网络带宽一直是最令人担忧的问题之一。

在传统的数据中心里,GPU之间通过极高带宽的连接(如NVLink或InfiniBand)相连,带宽可达每秒几百Gb(千兆位)。

而相比之下,互联网上的志愿者节点,往往只有几十甚至几百Mb(兆位)每秒的带宽。

质疑者认为,这种高达100倍甚至1,000倍的带宽差距,会让跨互联网的AI训练变得无比缓慢、几乎不可能。

毕竟,传统的训练方式需要GPU之间持续地交换更新信息,而如果试图用普通家用网络来完成这些通信,很可能会陷入「灾难级」的训练体验。

在此前对DeMo(Decoupled Momentum Optimization)的研究基础上,Nous推出的DisTrO技术,能够让所有训练节点保持高度同步,同时将所需带宽降低1,000到10,000倍

2024年12月,Nous与多位合作伙伴一起,在封闭测试网中,训练了一个150亿参数的基础模型,并成功验证了多项理论设想:

首次将DisTrO优化器系列大规模应用于训练任务

验证了节点中途掉线和新增节点时的容错能力

证明了增加训练节点确实能提升整体训练速度

这次实验标志着分布式、去中心化训练迈出了从理论走向现实的关键一步。

区块链+AI

在硅谷的一些圈子里,「加密」这个词几乎成了贬义词,而Nous一直努力保持与AI开发者之间的开放交流桥梁不被切断。

也正因如此,他们这次将Psyche搭建在区块链上,是一个值得关注的重要转变

Psyche将成为Nous用于预训练、微调和部署下一代模型的平台。

通过将技术栈迁移到Solana区块链,Nous希望释放区块链的以下三大优势:

无需许可:任何人都可以贡献计算资源

弹性与高可用性:不再依赖中心化基础设施

激励机制:协调并奖励为网络作出贡献的参与者

将这一协议向整个市场开放,意味着任何人都能拥有其中的一部分。而其潜在的扩展性之大,显然已经让不少极客兴奋不已。

计划概览

Nous的初期目标是先上线一个封闭测试网(Phase 0),验证是否能在Solana上运行一个更大规模、分布式、具备容错能力的DisTrO系统。后续阶段会逐步引入更高级的功能。

在Phase 0阶段,贡献者可以携带自己的GPU加入进来(明确提到支持4090、A100和H100等型号),并开始获得奖励。此阶段会对参与者进行筛选,以防止恶意行为者加入。

一旦系统稳定运行,权限将逐步开放,允许不同类型的计算资源(无论是专业的还是消费级的)自由接入网络,协助训练Llama、Diffusion等不同类型的模型架构。

强化学习后训练阶段

强化学习(Reinforcement Learning,RL)不依赖于预先准备好的数据集,而是通过模型与环境直接互动来学习。

每个节点如果做出有助于模型进化的行为,就会获得正反馈,反之则获得负反馈。

由于这些节点可以异步运行,分布式训练在强化学习框架下反而运行良好。

每个节点可以独立行动,收集经验,并定期与其他节点分享进展。

这极大缓解了传统训练中常见的「同步难题」,特别是在硬件能力和网络延迟差异大的情况下。

通过RL,Psyche上的预训练模型可以进一步学会推理能力和领域知识。

而每个Psyche节点在训练过程中的表现都将影响它的奖励:计算能力更强或使用了更先进训练方法的节点,可能会获得更多代币激励。

区块链:回归初心

在常常被斥为「过度炒作又频频令人失望」的区块链生态中,能看到真正的创新成果,确实令人欣慰——简直让人「冷漠的灵魂也重新燃起了热情」。

这一切,真的令人感到振奋。

Nous并不是一开始就拥抱区块链技术的,相反,他们几乎是被「拖着、踢着、喊着」走上了这条路——

但原因很简单:区块链确实是解决他们问题最合适的工具

他们需要一种方式,不论对方来自哪里,都能吸引计算资源与人才并进行公平支付;区块链,在这一点上表现得无比出色。

他们需要一种手段,能够协调并扩展大规模训练任务;而协调与扩展,正是区块链技术的「第二天性」。

他们还需要一种不受停电、封禁、宕机等影响的托管机制,能让项目「打不死」、无法被关闭;在这方面,区块链(这次不再是讽刺)也的确提供了最可靠的保障。

而最值得欣慰的是:这一次,人们选择区块链,不是出于投机炒作,而是出于对实际问题的认真思考与真实需求的回应。

如果Psyche成功了,它不仅将证明去中心化训练是切实可行的,更是回归初心:为取代的集中化计算,提供了强有力的工具

参考资料:

https://x.com/NousResearch/status/1922744483571171605

https://nousresearch.com/nous-psyche/

https://x.com/563defi/status/1909976170990313594

本文来自微信公众号“新智元”,作者:新智元,36氪经授权发布。

相关文章
  • 市场监管总局:督促全面取消“仅退款” 查办“三只羊”“东北雨姐”等案件
    发布日期: 2025-08-22 11:20:00
    国务院新闻办今天(22日)上午举行“高质量完成‘十四五’规划”系列主题新闻发布会,市场监管总局相关负责人介绍,我国平台经济正处于转型发展的关键时期,过去五年中,数字技术与各行业加速融合,新业态新模式不断涌现,虽带来了新的增长点,但流量优先、算法滥用、竞争失序等潜在风险也影响了平台经济健康发展。市场监
  • 免费体验!通州体育场冰上运动中心开启试营业
    发布日期: 2025-08-21 15:35:00
    通州体育场冰上运动中心(冰球馆)已开启试营业为通州乃至全市冰雪运动爱好者带来专业级冰上体验~免费冰上运动亲子体验券怎么领取?冰上运动中心(冰球馆)位于通州体育场地下二层,占地面积4600余平方米,包含1800平方米赛事标准冰场,可满足花样滑冰、冰球、速滑三个项目的训练与比赛需求,配套更衣室、卫生间等
  • 一医院发严正声明:立即停止网暴
    发布日期: 2025-08-18 10:53:00
    近日,河南荥阳市人民医院宣教科发布严正声明与澄清:近期,某短视频平台用户“王某某”、“简某”发布涉及我院的不实信息视频,引发网络关注。上述视频内容存在严重歪曲事实、虚构情节、误导公众、煽动对立、水军炒作等情况,对我院声誉及医护人员身心健康造成极大困扰,特别是近期“某地某院妇产科主任坠亡以自证清白”事
  • 运博会+苏超+荷花生日,苏州周末超强活动攻略来了
    发布日期: 2025-08-14 12:48:00
    即将到来的这个周末苏州实在太“热”了运博会、“苏超”、荷花生日……各类精彩活动轮番上演不知道去玩哪个?精彩抢先看白天逛“运博”第七届大运河文化旅游博览会将于8月15日至17日在苏州国际博览中心举办(免门票,无需预约)本届运博会延续“融合•创新•共享”主题,采取政府市场结合、线下线上融合、馆内馆外联动
  • 合肥这里,200个车位免费开放!
    发布日期: 2025-08-13 11:28:00
    8月11日,记者从合肥高新区城管大队获悉,该区通过盘活企业闲置停车资源,解决市民出行停车难问题,首批响应企业拿出200个共享车位向市民开放。欧普康视地面“共享停车位”。今年以来,合肥高新区积极探索“共享车位”新路径。“企业能腾出多少资源?市民需要多少停车位?”带着问题,合肥高新区城管大队联合蜀麓中心