自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(540)
  • 资源 (15)
  • 收藏
  • 关注

原创 Qwen-AgentWorld:用于AGI的语言世界模型

Qwen-AgentWorld:用于AGI的语言世界模型

2026-07-01 00:48:59 363

原创 DSpark:半自回归生成与置信度调度的投机解码/推测解码

DSpark:半自回归生成与置信度调度的投机解码

2026-06-30 19:27:54 418

原创 OPD中的几何解释

OPD引发的几何解释

2026-06-17 22:38:22 368

原创 Agent-World:LLM与环境的协同进化

Agent-World:LLM与环境的协同进化

2026-05-31 19:51:49 462

原创 ELF:连续扩散语言模型

连续扩散语言模型

2026-05-31 18:13:29 395

原创 RLDF:从去噪反馈中进行强化学习

RLDF

2026-05-31 13:50:59 359

原创 ESMFold2:语言建模构建蛋白世界模型

Candido 等人的这篇论文向世界宣告:蛋白质语言模型已经跨越了“统计拟合”的阶段,它在硅基世界里真正物质化(Materialize)了蛋白质生物学的基本物理和演化规律。这种通用、原子级精准且具备生命尺度演化视野的“世界模型”,不仅将虚拟数字实验的效率提升了数万倍,更深刻地证明了 AI 在没有人类先验知识的干预下,能够完全独立地重构并拓展人类数百年建立起来的经验生物学大厦。

2026-05-28 13:51:38 619

原创 Tuna-2:直接像素embedding打败视觉编码器

Tuna-2:直接像素embedding打败视觉编码器

2026-05-27 13:46:52 458 1

原创 Nature | MouseMapper全身细胞级扰动分析

全身细胞级扰动分析

2026-05-24 20:51:27 420

原创 LLaDA2.0-Uni:基于扩散语言模型的统一多模态理解和生成

LLaDA2.0-Uni:基于扩散语言模型的统一多模态理解和生成

2026-05-21 23:49:42 488

原创 Latent-Y:经实验室验证的从头药物设计自主智能体

Agent for AIDD

2026-05-17 21:29:58 444

原创 AnisoAlign:各向异性模态对齐

各向异性模态对齐

2026-05-15 21:58:11 427

原创 LLaDA2.0:块扩散语言模型

块扩散语言模型

2026-05-15 17:28:15 481

原创 LLaDA:扩散语言模型

扩散语言模型

2026-05-14 22:36:15 598

原创 是否能从元学习中启发大模型预训练

本博客为一些简单的个人想法,关于元学习方法(如MAML、Reptile、元梯度优化等)如何启发大规模语言模型(LLM)预训练新范式,以提升基础模型的泛化和适应能力。

2026-05-04 19:43:53 383

原创 Anthropic在Nature发表研究:大模型的潜意识学习

潜意识学习

2026-04-28 13:57:02 500

原创 RandOpt:神经丛林

作者怀疑,随着大语言模型规模的增长,预训练已经把模型带到了一个极其富饶的“风水宝地”。在这里,传统观念中“大海捞针”的困境已经不存在了。为了验证这个猜想,他们决定用最原始、最被学术界鄙视的。

2026-03-16 16:40:16 443

原创 AI驱动的抗体生成全流程指南

过去数月,AI技术实现了抗体设计领域的颠覆性突破:科研人员首次可通过计算机完成全新抗体的从头设计,而仅在一年前,尚无工具能通过计算方式可靠完成这一工作。目前,Nabla Bio、Chai Discovery、Isomorphic Labs(DeepMind衍生企业)等商业公司,以及BoltzGen、Germinal等开源工具,均已实现抗体设计的高成功率。抗体作为生物学领域最具通用性的工具之一,是修美乐(阿达木单抗)等重磅药物的核心,也是新冠抗原检测等低成本诊断试剂的关键组分。

2026-03-13 16:54:23 879

原创 VideoWorld1-2:纯视频学习获取世界知识

VideoWorld 放弃了传统强化学习中的“状态-奖励-动作”范式,而是让模型“看视频。

2026-03-10 13:41:17 811

原创 AReaL:面向语言推理大模型(LRMs)的异步大规模强化学习(RL)训练系统

异步强化学习

2026-03-06 14:58:50 523

原创 UniMedVL:统一的医疗多模态理解和生成模型

这篇论文(UniMedVL: Unifying Medical Multimodal Understanding and Generation through Observation-Knowledge-Analysis)提出了一种名为的统一医疗多模态大模型,旨在解决当前医疗AI系统中理解(如诊断报告)与生成(如图像合成)能力割裂的问题。以下是关于该论文中和。

2026-03-05 20:47:59 464

原创 关于潜在视觉推理的研究

作者通过因果分析证明,目前流行的“潜在空间视觉推理”(即在模型隐层状态中进行视觉想象)大多是无效的,这些潜在 Token 并没有真正承载推理信息;相反,作者提出了一种显式的文本想象方法(CapImagine),证明直接用文字描述视觉变化比在潜在空间“冥想”更有效、更符合因果逻辑。图 1. 基于工具的视觉推理与通过想象进行的视觉推理的比较。a) 基于工具的推理通过诸如放大或绘图等函数调用来感知视觉内容。b) 潜在空间想象利用多模态大语言模型(MLLM)的隐层状态来进行视觉推理。

2026-03-05 14:10:19 464

原创 HealthGPT:可统一理解和生成的医疗视觉语言模型

HealthGPT 旨在解决医学领域中视觉理解(Comprehension)与生成(Generation)任务之间的冲突,通过构建高质量的数据集和引入创新的架构,实现了在单一自回归框架下的多模态统一。

2026-03-05 11:44:42 483

原创 用于解析复杂疾病细胞动态与计算机药物发现的深度生成模型UNAGI

UNAGI:解析细胞动态并进行药物发现

2026-03-04 22:40:23 393

原创 AlphaFast相比AlphaFold3加速的原因分析

AlphaFast 相比 AlphaFold 3 (AF3) 的核心改进在于,并优化了数据处理流程。

2026-03-04 20:18:08 368

原创 GLM-5 技术核心:在线跨阶段蒸馏与Agentic工程

GLM-5,在线跨阶段蒸馏与Agentic工程

2026-03-04 15:55:26 592

原创 Mercury2:全球最快的推理型大语言模型,基于扩散技术架构打造,专为生产级AI实现瞬时响应而生

Mercury2:全球最快的推理型大语言模型,基于扩散技术架构打造,专为生产级AI实现瞬时响应而生

2026-03-04 10:38:27 467

原创 深度范式转移:漂移模型(Drifting Models)解析

Drifting Models 标志着生成模型从“推理时迭代”向“训练时演进”的范式转变。通过结合漂移场动力学与 SimSiam 式的非对称优化技巧,它解决了生成模型在质量与速度之间的长期博弈。这一研究不仅为一步生成提供了坚实的理论支撑,也为后续自监督学习与生成模型的融合指明了方向。

2026-02-18 14:26:52 1040

原创 大语言模型SFT后训练:SFT,DFT,ASFT,ProFit,BFT,RAFT

大语言模型(LLMs)在预训练之后,往往需要通过进行对齐与能力塑形。,它在梯度结构、泛化行为和表达学习方面存在缺陷。本文将从等角度,系统梳理它们之间的关系。

2026-02-17 23:11:55 1236

原创 在临床语境中扩展医疗AI

在临床语境中扩展医疗AI

2026-02-10 20:27:04 839

原创 LLM后训练,SFT最新研究

LLM后训练,SFT最新研究

2026-02-10 13:33:10 1237

原创 TTT-Discover:用于解难题的测试时强化学习

TTT-Discover 证明了 AI 的潜力不应仅仅局限于“预训练知识的提取”,更在于其作为“研究助手”进行自我演化的能力。通过在测试阶段针对特定问题进行强化学习,AI 已经展现出在数学、编程优化和科学计算等领域超越人类顶级水平的潜力。正如论文引言所说,人类解决难题需要“试错、学习、再尝试”,TTT-Discover 正是赋予了 AI 这种从失败中内化新思路的能力。

2026-01-29 21:33:02 941

原创 Emu3:统一的多模态next token prediction

这篇发表在《Nature》上的论文介绍了一种名为的新一代多模态模型。

2026-01-29 20:55:02 984

原创 IEEE TPAMI 2026 | ConsistID:多模态高保真肖像生成

ConsistentID 的成功在于“精细化”和“定位化”。以往的方法像是让画师“看一眼,凭感觉画”,而 ConsistentID 则是让画师“盯着细节画,并根据详细的说明书来画”。亮点总结:无需微调:推理时不需要像 DreamBooth 那样进行长时间的训练,属于“即插即用”的直接推理。多模态融合:不仅利用图像,还利用了文本描述的语义力量。开源贡献:提供了代码和预训练权重,,极大推动了开源社区在数字人、个性化写真领域的发展。

2026-01-28 21:22:13 677

原创 Thoth:生物实验方案生成

生物实验方案生成

2026-01-27 14:38:02 635

原创 多模态慢思考,原子步骤推理

原子推理

2026-01-13 22:30:32 817

原创 Information Fusion | 多模态单细胞,以及分子(gene与peak)整合

多模态细胞,分子整合

2025-11-24 11:35:14 1009

原创 CellNavi实验结果

CellNavi实验结果

2025-11-12 21:26:53 816

原创 CellNavi方法细节:预测指导细胞状态转移的基因

CellNavi方法细节:预测指导细胞状态转移的基因

2025-11-09 20:23:02 984

原创 LLM-based Agent

一文遍历常用AI Agent

2025-10-30 20:12:41 804

红楼梦人物图谱csv文件

红楼梦人物图谱csv文件

2023-08-30

nltk_data.rar

nltk的分词工具,将其解压,放置到当前虚拟环境(假设环境名为TORCH),则目录结构为"TORCH/nltk_data/tokenizers/punkt"

2021-01-22

随机森林评估特征重要性wine.rar

基于 UCI 葡萄酒数据,使用随机森林进行特征重要性分析,这些数据是对意大利同一地区种植的三种不同品种葡萄酒的化学分析结果,分析确定了三种葡萄酒中13种成分的含量,数据的第一列是葡萄酒的类别

2021-02-02

fasterRCNN口罩检测

使用fasterrcnn实现口罩检测,fasterrcnn基于keras搭建,训练需要口罩数据集,数据集必须是VOC格式,预测需要权重文件,权重文件已经存在

2020-05-26

基于朴素贝叶斯的垃圾邮件过滤data.rar

邮件数据包括训练集train(正常邮件normal,垃圾邮件spam),测试集test,中文停用词文件cn_stopwords.txt

2021-01-31

机器翻译nmt.zip

轻量级机器翻译数据集,en-cn为英文与中文,en-fr为英文与法文

2021-01-22

LR预测CTR数据集data.zip

数据集是电商领域数据集,共计200万的样本记录。原始特征均为ID类特征; 字段说明: userid 用户ID itemid 商品ID categoryid 商品类目ID action 用户行为类型 timestamp 时间戳

2021-01-25

glove.6B.100d.txt.zip

glove.6B是斯坦福大学训练的词向量包(862MB),glove.6B.100d是100维词向量,TEXT.build_vocab可以根据我自己的词汇表内的词匹配到glove内的词,组建成为需要的词向量;后面如果想使用这个新词向量,可以通过TEXT.vocab.vectors返回

2020-11-29

决策树预测用户流失data.csv

基于某信息公司的用户数据,使用决策树预测用户是否会流失,字段Churn代表客户是否流失,取值:['Yes', 'No'],其余字段为特征

2021-02-01

MNIST与FashionMNIST数据集

数据集包括了MNIST和FashionMNIST,有原始数据集raw和经过torchvision.datasets处理过的processed目录

2020-11-29

hymenoptera_data.zip

hymenoptera_data数据集,这个数据集包括两类图片, bees 和 ants, 这些数据都被处理成了可以使用"torchvision.datasets.ImageFolder"来读取的格式。

2020-12-02

google.csv

机器学习第六课,使用线性回归预测未来30天 Google 股票的收盘价走势,表格中的列代表每天的股票指数,如:Open 开盘价、High 最高价、Low 最低价、Volume 成交量。Adj. Open、Adj. High、Adj. Low、Adj. Close、Adj. Volume 代表调整后的数据

2021-01-15

mackey_glass_t17.npy

Mackey-Glass (MG)序列的部分内容,shape为(10000,),这个时间序列是混乱的,没有明确的周期。 级数不收敛也不发散,轨迹对初始条件高度敏感。 这个基准问题用于神经网络和模糊建模研究。

2021-07-12

olivetti_py3.pkz

人脸图像数据集 olivetti_py3.pkz,该数据集一共有 400 张人脸图片,每张图片的大小是:64x64,每张图片作为一个样本,一共有 400 个样本,每个样本的特征维度是:64x64 = 4096;400 张图片一共包含 40 个不同的人,每个人有 10 张人脸图片

2021-02-13

Kaggle交易预测.rar

基于 Kaggle 竞赛数据,原始数据文件较大,故本数据集只选用了 train.csv 中的 5 万条样本作为模型训练集(train.csv.gzip),1 万条样本作为模型测试集(test.csv.gzip)

2021-02-17

TextSet.zip

该文件用于词向量训练,Skip-Gram训练,主要是texttrain.txt文件,训练细节见白景屹的Pytorch笔记本-第四课.词向量:https://blog.csdn.net/qq_40943760/category_10532835.html

2020-11-09

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除