从概念到应用,清华团队开发DeepTFBU工具包助力基因表达精准调控

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

编辑 | 萝卜皮

增强子通过与转录因子 (TF) 相互作用,在各种生物过程中充当基因表达的关键调节器。虽然转录因子结合位点 (TFBS) 被广泛认为是 TF 结合和增强子活性的关键决定因素,但其周围背景序列的重要作用仍有待定量表征。

清华大学的研究团队提出了转录因子结合单元(transcription factor binding unit,TFBU)概念,通过使用深度学习模型量化 TFBS 周围上下文序列的影响,模块化地建模增强子。

基于这一概念,研究人员开发了 DeepTFBU,这是一个用于增强子设计的综合工具包。

该团队证明设计 TFBS 上下文序列可以显著调节增强子活性并产生细胞类型特异性反应。DeepTFBU 在从头设计包含多个 TFBS 的增强子方面也非常高效。此外,DeepTFBU 可以灵活地解耦和优化广义增强子。

该研究以「Modeling and designing enhancers by introducing and harnessing transcription factor binding units」为题,于 2025 年 2 月 8 日发布在《Nature Communications》。

图片

相关背景

精确调控基因表达在发育和分化等复杂生物过程中至关重要。这种调控的核心是转录因子 (TF) 与增强子的结合。解读增强子的活性有助于深入了解基因调控的基本原理,并有助于设计合成增强子以在基因工程和基因治疗应用中操纵基因表达。

传统上,转录因子结合位点(TFBS),特别是通常为 5 至 20 个碱基对的 TF 结合基序,被认为是 TF 与增强子结合的关键决定因素。研究表明,在 DNA 序列中排列多个 TFBS 可以提高其作为增强子的功能。TFBS 的方向和序列顺序也会显著影响增强子活性。利用这些特性,操纵 DNA 序列上的 TFBS 排列和组合被广泛用于设计合成增强子。

TFBU 概念

在最新的研究中,研究人员提出了转录因子结合单元(TFBU)的概念,用于模块化增强子建模和设计。TFBU 概念整合了核心 TFBS 及其周围上下文序列(TFBS-context)的作用。

这种整合使得定量评估长 DNA 序列结合目标 TF 和驱动特定细胞类型中的转录(增强子活性)的潜力成为可能。利用深度学习模型,研究人员从染色质免疫沉淀测序 (ChIP-seq) 数据中确定了影响 TF 结合的 TFBS 环境中的关键模式。这些模型有助于合理设计具有所需功能的合成增强子,将特定 TF 的设计范围从核心 TFBS 扩展到整个增强子序列。

DeepTFBU 工具包

图片

图示:基于 TFBU 构建 TFBS-上下文模型及下游任务的过程。(来源:论文)

基于 TFBS 上下文模型,该团队开发了一系列增强子设计方法,并将它们集成到名为 DeepTFBU 的工具包中。

该研究中,基于大规模并行报告基因检测 (MPRA) 实验的限制和模型性能,TFBU 的典型长度被设置为 168 个碱基对。每个 TFBU 由两部分组成:核心 TFBS 及其上下文序列(表示为 TFBS-context)。

为了评估 TFBU 的绑定效果,研究人员分别量化了特定 TF 的两个部分的匹配分数。核心 TFBS 的匹配分数是使用位置概率矩阵直接计算的。与核心 TFBS 不同,TFBS 上下文包含无法直接量化的复杂和隐式特征。为了解决这个问题,我研究人员采用深度学习模型来提取人类基因组中 TFBS 上下文的 TF 特定偏好,从而获得 TFBS 上下文匹配分数。

测试与应用

研究人员测量了 DeepTFBU 设计的超过 36,000 个序列的增强子活性,用于验证在各种情况下的增强子建模和设计策略。结果表明,功能性 TFBS 上下文的序列模式可以特定于 TF 和细胞类型。

设计 TFBU 内的上下文序列可以显著调节大多数 TFs(82.9%,97/117)的增强子活性。对于单个 TFBU,这样的设计可以在不引入其他明显 TFBS 的情况下实现平均 20 倍以上的增强子活性增加。

图片

图示:MPRA 实验表明 TFBS 环境显著影响增强子活性。(来源:论文)

它还可以产生高达 60 倍的细胞类型特异性增强子活性。此外,基于 TFBU 的策略可以扩展到包含多个 TFBS 的增强子的从头设计。并且,设计上下文序列可以将包含串联重复 TFBS 的典型合成增强子的活性提高 30 倍以上。

研究人员还提出了一个灵活且通用的增强子优化框架,将增强子效应分解到各个 TFBU 中。利用这个框架,他们仅用少量突变就将巨细胞病毒 (CMV) 增强子的活性提高了 60%。

图片
图示:将增强子效应分解为单个 TFBU 效应的组合,并用基于 TFBU 的框架优化现有的强增强子。(来源:论文)

这表明增强子序列可以模块化为 TFBU,并以直观易懂和模块化自下而上的方式使用 TFBU 进行重新设计。所有这些结果证明 TFBU 是增强子建模和设计的关键概念,而 DeepTFBU 是合理设计增强子的强大工具包。

结语

该团队之前的工作中,研究人员利用深度学习模型 DeepSEED 提取的天然增强子的共同特征,通过在 TFBS 之间设计序列成功地提升了增强子的活性。该方法适用于提供靶基因调控元件一般模式信息的序列数据。

在这项工作中,研究人员强调了 TF 特异性和细胞类型特异性偏好对核心 TFBS 周围上下文序列的影响。

这使得对核心 TFBS 之外的序列进行详细而精确的建模成为可能,并且可以在大量公开数据的支持下作为增强子的通用基本特征。该方法还可以精确设计针对特定 TF 和细胞类型的基因调控元件。

在未来的研究中,通过利用更多有关 TFs 和 TFBU 特性的信息,研究人员可以构建更详细、更全面的 TFBU 系统,从而促进基于 TFBU 的更精确的 DNA 序列建模和调控元件设计。

论文链接:https://www.nature.com/articles/s41467-025-56749-2 

以上就是从概念到应用,清华团队开发DeepTFBU工具包助力基因表达精准调控的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/175003.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
蝴蝶号如何设置直播带货 蝴蝶号电商转化的流程设计
上一篇 2025年11月1日 04:34:12
Node.js究竟是什么样的运行环境?
下一篇 2025年11月1日 04:34:15

相关推荐

  • composer require-dev和require有什么不同_Composer Require与Require-Dev区别解析

    require用于声明项目运行必需的依赖,如框架、数据库组件和第三方SDK,这些包会随项目部署到生产环境;2. require-dev用于声明仅在开发和测试阶段需要的工具,如PHPUnit、PHPStan、Faker等,不会默认部署到生产环境;3. 安装时composer install根据环境决定…

    2026年5月10日
    1000
  • 利用海象运算符简化条件赋值:Python教程与最佳实践

    本文旨在探讨Python中海象运算符(:=)在条件赋值场景下的应用。通过对比传统if/else语句与海象运算符,以及条件表达式,分析海象运算符在简化代码、提高可读性方面的优势与局限性。并通过具体示例,展示如何在列表推导式等场景下合理使用海象运算符,同时强调其潜在的复杂性及替代方案,帮助开发者更好地掌…

    2026年5月10日
    100
  • Debian syslog性能优化技巧有哪些

    提升Debian系统syslog (通常基于rsyslog)性能,关键在于精简配置和高效处理日志。以下策略能有效优化日志管理,提升系统整体性能: 精简配置,高效加载: 在rsyslog配置文件中,仅加载必要的输入、输出和解析模块。 使用全局指令设置日志级别和格式,避免不必要的处理。 自定义模板: 创…

    2026年5月10日
    000
  • c++中的SFINAE技术是什么_c++模板编程中的SFINAE原理与应用

    SFINAE 是“替换失败不是错误”的原则,指模板实例化时若参数替换导致错误,只要存在其他合法候选,编译器不报错而是继续重载决议。它用于条件启用模板、类型检测等场景,如通过 decltype 或 enable_if 控制函数重载,实现类型特征判断。尽管 C++20 引入 Concepts 简化了部分…

    2026年5月10日
    000
  • Golang goroutine与channel调试技巧

    使用go run -race检测数据竞争,结合runtime.NumGoroutine监控协程数量,通过pprof分析阻塞调用栈,利用select超时避免永久阻塞,有效排查goroutine泄漏、死锁和数据竞争问题。 Go语言的goroutine和channel是并发编程的核心,但它们也带来了调试上…

    2026年5月10日
    000
  • 松下案例入选《2025企业社会责任竞争力指数报告》

    松下案例入选《2025企业社会责任竞争力指数报告》松下案例入选《2025企业社会责任竞争力指数报告》松下案例入选《2025企业社会责任竞争力指数报告》松下案例入选《2025企业社会责任竞争力指数报告》

    11月14日,中国新闻社《中国新闻周刊》在北京成功举办了第二十一届企业社会责任系列活动·2025责任之星特别节目。活动以“致明天:焕新责任竞争力”为主题,汇聚了来自政府、企业及学术界的多位代表,共同探讨新时代下企业如何通过责任创新打造核心竞争力。松下电器(中国)有限公司总裁赵炳弟作为企业界代表受邀出…

    2026年5月10日 用户投稿
    000
  • 使用 Jupyter Notebook 进行探索性数据分析

    Jupyter Notebook通过单元格实现代码与Markdown结合,支持数据导入(pandas)、清洗(fillna)、探索(matplotlib/seaborn可视化)、统计分析(describe/corr)和特征工程,便于记录与分享分析过程。 Jupyter Notebook 是进行探索性…

    2026年5月10日
    000
  • 网站标题关键词更新后,搜索引擎为何仍显示旧标题?

    网站标题更新后,搜索引擎为何显示旧标题? 网站SEO优化中,站长常修改网站标题关键词,期望搜索结果显示自定义标题。然而,即使更新标签、meta keywords、meta description和结构化数据中的name属性后,搜索结果仍显示旧标题,这令人费解。本文将对此进行解释。 问题:站长修改了网…

    2026年5月10日
    100
  • Python命令怎样使用profile分析脚本性能 Python命令性能分析的基础教程

    使用Python的cProfile模块分析脚本性能最直接的方式是通过命令行执行python -m cProfile your_script.py,它会输出每个函数的调用次数、总耗时、累积耗时等关键指标,帮助定位性能瓶颈;为进一步分析,可将结果保存为文件python -m cProfile -o ou…

    2026年5月10日
    000
  • 如何插入查询结果数据_SQL插入Select查询结果方法

    如何插入查询结果数据_SQL插入Select查询结果方法如何插入查询结果数据_SQL插入Select查询结果方法如何插入查询结果数据_SQL插入Select查询结果方法如何插入查询结果数据_SQL插入Select查询结果方法

    使用INSERT INTO…SELECT语句可高效插入数据,通过NOT EXISTS、LEFT JOIN、MERGE语句或唯一约束避免重复;表结构不一致时可通过别名、类型转换、默认值或计算字段处理;结合存储过程可提升可维护性,支持参数化与动态SQL。 将查询结果数据插入到另一个表中,可以…

    2026年5月10日 用户投稿
    000
  • python中zip函数详解 python多序列压缩zip函数应用场景

    zip函数的应用场景包括:1) 同时遍历多个序列,2) 合并多个列表的数据,3) 数据分析和科学计算中的元素运算,4) 处理csv文件,5) 性能优化。zip函数是一个强大的工具,能够简化代码并提高处理多个序列时的效率。 在Python中,zip函数是一个非常有用的工具,它能够将多个可迭代对象打包成…

    2026年5月10日
    000
  • 谷歌浏览器如何截图 谷歌浏览器页面截图技巧

    谷歌浏览器如何截图 谷歌浏览器页面截图技巧谷歌浏览器如何截图 谷歌浏览器页面截图技巧谷歌浏览器如何截图 谷歌浏览器页面截图技巧谷歌浏览器如何截图 谷歌浏览器页面截图技巧

    使用谷歌浏览器的开发者工具截图步骤:1. 按ctrl+shift+i(windows/linux)或cmd+option+i(mac)打开开发者工具。2. 点击右上角三个点,选择”更多工具”,再选择”截图”。3. 选择截取整个页面。推荐的谷歌浏览器扩展…

    2026年5月10日 用户投稿
    100
  • Python中怎样使用pymongo?

    在python中使用pymongo可以轻松地与mongodb数据库进行交互。1)安装pymongo:pip install pymongo。2)连接到mongodb:from pymongo import mongoclient; client = mongoclient(‘mongod…

    2026年5月10日
    000
  • JS如何实现迭代器?迭代器协议

    JavaScript中实现迭代器需遵循可迭代协议和迭代器协议,通过定义[Symbol.iterator]方法返回具备next()方法的迭代器对象,从而支持for…of和展开运算符;该机制统一了数据结构的遍历接口,实现惰性求值,适用于自定义对象、树、图及无限序列等复杂场景,提升代码通用性与…

    2026年5月10日
    000
  • JavaScript函数中插入加载动画(Spinner)的正确方法

    本文旨在解决在JavaScript函数中插入加载动画(Spinner)时遇到的异步问题。通过引入async/await和Promise.all,确保在数据处理完成前后正确显示和隐藏加载动画,提升用户体验。我们将提供两种实现方案,并详细解释其原理和优势。 在Web开发中,当执行耗时操作时,显示加载动画…

    2026年5月10日
    000
  • Golang空接口如何应用在项目中

    空接口可用于接收任意类型值,常见于日志函数、通用数据结构、JSON动态解析及配置驱动逻辑,提升代码灵活性,但需配合类型断言确保安全,避免滥用以降低维护成本。 空接口 interface{} 在 Go 语言中是一个非常灵活的类型,它可以存储任何类型的值。虽然它牺牲了一部分类型安全,但在实际项目中合理使…

    2026年5月10日
    100
  • Golang使用Protobuf定义接口与消息格式

    Protobuf通过字段编号实现兼容性,新增字段可忽略、删除字段可保留编号,确保新旧版本互操作,支持服务独立演进。 在Golang项目中,利用Protobuf定义接口和消息格式,本质上是为服务间通信构建了一套高效、类型安全且跨语言的契约。它让数据结构清晰可见,RPC调用标准化,极大地简化了分布式系统…

    2026年5月10日
    000
  • PHP多维数组到复杂XML结构的SOAP序列化实践

    本文旨在解决php多维数组向复杂soap xml结构序列化时遇到的“无法序列化结果”问题。通过深入理解soap xml的结构要求,包括命名空间和类型属性,文章将指导您如何构建符合特定xml schema的php关联数组。我们将利用`spatie/array-to-xml`库,详细演示其安装与使用方法…

    2026年5月10日
    000
  • 使用 Ajax 和 FormData 实现文件上传及文本数据提交的完整教程

    本文旨在解决在使用 Ajax 和 FormData 进行文件上传时,遇到的 $_POST 和 $_FILES 为空的问题。通过详细的代码示例和解释,我们将展示如何正确地构建 FormData 对象,并通过 Ajax 将文件和文本数据发送到服务器端,同时避免常见的错误配置,确保数据能够成功地被 PHP…

    2026年5月10日
    000
  • pycharm解析器怎么添加 解析器添加详细流程

    在pycharm中添加解析器的步骤包括:1) 打开pycharm并进入设置,2) 选择project interpreter,3) 点击齿轮图标并选择add,4) 选择解析器类型并配置路径,5) 点击ok完成添加。添加解析器后,选择合适的类型和版本,配置环境变量,并利用解析器的功能提高开发效率。 在…

    2026年5月10日
    000

发表回复

登录后才能评论
关注微信