自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(59)
  • 收藏
  • 关注

原创 XNovel 世界配置实战:上传一本小说,AI 还原整个故事世界

XNovel世界配置功能详解:四步将小说变为可互动的虚拟世界 核心功能: 通过AI自动解析TXT小说,提取人物关系、关键事件和时间线 四步操作流程:上传→AI分析→选择世界→开启角色扮演 特色功能: 可视化时间线管理剧情节点 支持自定义模型接入和参数调整 多世界管理,可随时切换不同小说世界 使用优势: 匿名用户每日25次体验 登录用户每日500次交互 支持平行世界剧情改写和角色深度访谈 体验地址:http://xiaothink.top/xnovel/index.html

2026-08-16 13:37:04 297

原创 0.6B 前端生成模型本地部署实战:消费级显卡跑通 WanlyFrontend 全流程

中文提示词 → 模型生成 WF 代码 → 编译器编译为 HTML装库 → 下权重 → 生成 WF → 编译 HTML。

2026-08-15 16:17:48 361

原创 WanlyFrontend 中文声明式前端语言完全指南:让 0.6B 模型写出漂亮网页

Frontend 前端生成模型。

2026-08-15 16:16:29 258

原创 0.6B 前端生成模型逆袭 8B:RWKV-v5+MLA 架构下的语言+编译器新范式

Frontend(前端生成专项)

2026-08-15 16:13:55 225

原创 0.6B 模型的边界感:小模型教会我的三件事

如果你也在犹豫要不要折腾一台本地小模型,我的建议是:试试。不是为了打败大模型,而是为了拥有一个属于自己的、够用的助手。把容量花在刀刃上,把小模型放在对的位置上——这是 Instruct-Pro 教我的三件事,也是它存在的意义。

2026-08-13 11:24:08 190

原创 中文小模型怎么选?一份不吹不黑的 0.6B~20B 选型清单

先定场景,再选模型;能本地,就本地。

2026-08-13 11:15:53 186

原创 我把 0.6B 的 AI 装进了那台吃灰的旧笔记本

让五年前的旧笔记本重获新生,通过安装小型中文AI模型Xiaothink-T17,实现了免费、离线、数据私密的智能助手功能。该模型仅0.6B参数,支持CPU运行,能完成写诗、周报草拟等任务,特色是"先思考再回答"的深度对话模式。虽然复杂任务处理有限,但完全本地的运行方式(无需联网/付费/上传数据)使其成为旧设备的理想AI伴侣,满足日常文字处理需求的同时保障了隐私安全。

2026-08-13 11:02:13 186

原创 一次“偏科”的微调实验:Xiaothink-T17-RWKV5-MLA-Instruct-Pro 为何中文更强、前端变弱?

Instruct-Pro 是一次刻意偏科:把容量从 WF 前端语法转向中文自然语言;盲测数据验证了取舍——指令遵循 90.7 全场第一、总体反超同尺寸 Qwen3-0.6B,代价是前端 25.0 明显下滑;选型大于调参:做前端用 frontend 版,做中文用 instruct_pro 版,各司其职。数据全部来自真实盲测,欢迎交流讨论!

2026-08-11 19:46:14 343

原创 0.6B 硬刚 8B/20B!Xiaothink-T17-RWKV5-MLA-Instruct-Pro 六领域盲测实录:指令遵循 90.7 全场第一

在 6 领域盲测中总体 65.3,超过同尺寸 Qwen3-0.6B;指令遵循 90.7 全场第一、通用知识 85.0 越过 8B、古诗生成 74.0 断档领先同尺寸;前端生成 25.0 是微调取舍的代价,选型时按任务场景二选一。数据来自真实的 DeepSeek-V4-Flash 对照盲测。欢迎交流讨论!

2026-08-11 19:41:21 1327 3

原创 0.6B 也能“先想再答”?Xiaothink-T17-RWKV5-MLA-Instruct-Pro 深度思考实战

是 ≈0.6B 的端侧指令模型,延续 RWKV-v5 + MLA 纯历史检索架构;深度思考有开启(强制<think>)和自动(模型自行决定)两个模式,无单独的关闭模式,需 xiaothink ≥ 1.5.0;帮你控制历史里思考内容的去留,多轮对话更干净。本地小模型也能“先想再答”,欢迎交流讨论!

2026-08-11 19:34:58 197

原创 10 分钟实战:用 0.6B 本地模型生成中文网页(WanlyFrontend + 编译器全流程)

10 分钟,一张显卡,0.6B 参数——你已经拥有一个"说中文、出网页"的本地前端生成器。相比云端大模型,它免费、私有、可商用,尤其适合快速原型和本地自动化。快去 ModelScope 下载模型,写一个属于你的"想要……"试试吧!

2026-08-09 12:04:31 224

原创 深度拆解:RWKV-v5+MLA 架构凭什么让 0.6B 模型写好前端?WanlyFrontend 声明式语言的降维打击

小模型路线可以"换赛道"而非"堆参数":把困难下放给确定性编译器,模型只做自己擅长的结构化描述;长序列架构是前端生成的地基:RWKV-v5 + MLA 的稀疏快照让 0.6B 也能背下整个页面结构;专项训练价值巨大:同样 0.6B,前端专项版比通用版强出 128%(52.6 vs 23.0)。欢迎交流讨论!

2026-08-09 11:53:48 185

原创 0.6B 小模型逆袭 8B!Xiaothink-T17-RWKV5-MLA-Frontend——中文前端页面生成新物种

小思框架推出仅0.6B参数的本地模型Xiaothink-T17-RWKV5-MLA-Frontend,专攻中文前端页面生成。该模型通过生成自研的WanlyFrontend声明式语言而非直接生成HTML,再由编译器编译成完整页面,解决了小模型生成HTML的难题。盲测结果显示,该模型在页面设计感、功能完整性等方面全面超越同级0.6B模型,甚至逼近20B大模型表现,尤其在静态页面生成上优势显著。模型采用RWKV-v5+MLA架构,支持消费级显卡本地运行,已上线ModelScope供体验。

2026-08-09 11:37:27 530

原创 本地AI也能写出“人味“文案?Xiaothink-T17-RWKV5-MLA-Instruct 实战:对话、创作、情感分析一把梭

别再为云端API排队付费了!一个566.9M参数、能离线运行的本地模型,搞定拟人化对话、诗词创作、情感分析三大场景。实测数据:拟人化语言81.7分,仅比GLM4.7低3.3分。

2026-08-07 15:10:06 240

原创 0.6B对战云端百亿旗舰?Xiaothink-T17-RWKV5-MLA-Instruct 盲测实录:拟人化语言仅差3.3分!

小模型的使命不是取代旗舰,而是在"够用"与"便宜"之间找到最优解。0.6B就能在拟人化语言上逼近GLM4.7,这意味着AI的民主化正在加速——人人都能在自己电脑上跑起一个"会说人话"的模型。下一次,当你为一个简单对话任务支付云端API费用时,不妨想想:也许0.6B就够了。Xiaothink-T17-RWKV5-MLA-Instruct证明了:参数可以小,表达的诚意不能少。

2026-08-07 15:06:04 183

原创 仅0.6B参数如何锁住超长记忆?Xiaothink-T17-RWKV5-MLA 架构深度解析:RWKV-v5 × MLA 的“降维打击“

当Hugging Face的256MB模型超越80B巨头,当0.6B的本地模型在中文风格任务上逼近云端旗舰——AI的价值标准正在从"参数规模"转向"记忆效率"。RWKV-v5与MLA的融合,证明了"小而美"不再是妥协,而是一种更聪明的工程选择。Xiaothink-T17-RWKV5-MLA证明了:记忆不在参数多少,而在架构匠心。模型主页:https://www.modelscope.cn/models/ericsjq/Xiaothink-T17-RWKV5-MLA-0.6B。

2026-08-07 14:58:23 424

原创 将独热码应用到我们的模型

本文将展示如何使用TensorFlow将独热编码应用到一个简单的密集神经网络中,以实现从一段随机文本到另一段随机文本的转换。虽然上述代码没有包括实际的训练过程,但它展示了如何使用TensorFlow将独热编码应用到文本数据上,并通过一个简单的神经网络模型进行处理。但是,在这个示例中,我们将简化过程,仅展示模型的构建。现在,让我们定义一个简单的密集神经网络模型,它将接受独热编码的文本并尝试预测下一个字符的独热编码。最后,我们可以使用训练好的模型来预测输入文本的输出,并将其从独热编码转换回字符。

2026-06-14 11:00:49 183

原创 Xiaothink-T17-Tiny 模型深度解析:轻量级RNN架构的创新与实战评测

Xiaothink-T17-Tiny 是一款创新的轻量级中文语言模型,采用GRU3+历史检索架构,参数量仅0.15B(96.9M)。核心创新包括历史感知序列建模、固定张量历史缓存、平方ReLU前馈网络等,在保持RNN线性复杂度的同时增强长距离依赖建模能力。测试显示其性能优于同规模Transformer(测试损失4.895 vs 5.424),峰值显存降低23%(5936MB vs 7726MB)。模型特别适合移动端/嵌入式部署,内置TinySkill工具箱提供8种即用型文本处理功能。需通过xiaothink

2026-06-13 21:19:56 210

原创 零成本中文情感分类实战:Xiaothink-T7.5-0.1B 免费API直通教程

本文介绍了一种基于Xiaothink-T7.5-0.1B模型的简易情感分类方案。通过调用免费无限制API,只需几行Python代码即可实现文本情感分析。方案采用prompt工程+关键词匹配的方法,将待分类文本拼接到固定prompt中,调用API后检测返回结果是否包含"正""积极"等关键词来判断情感倾向。文章提供了完整可运行的代码示例,展示了测试效果,并提出了批量处理、增加中性类别等扩展思路。该方案无需本地部署、不消耗算力资源,适合新手入门和小型项目快速实现情感分析功能

2026-02-27 11:46:31 499

原创 低配置cpu也能跑的轻量中文LM:Xiaothink-T7.5-0.1B 上手实操

如果在使用过程中遇到问题,官方提供了多个沟通渠道:邮箱xiaothink@foxmail.com、官网、模型卡片页面,能找到详细的文档和技术支持。从整个轻量模型的发展趋势来看,像Xiaothink-T7.5-0.1B这样适配低配置、做本土化优化的SLM,会成为很多中小场景AI落地的重要选择——毕竟不是所有需求都需要大模型,「小而精、小而快」的轻量模型,才能让AI真正落地到更多普通场景中。

2026-02-27 10:27:37 991

原创 Xiaothink-T7-ART:消费级硬件也能玩转的古诗生成AI,盲测接近SOTA水平

摘要:Xiaothink-T7-ART是一款轻量级古诗生成AI模型,仅需消费级CPU即可运行。该模型采用创新的多专家协同架构,通过7000万参数和400MB训练数据实现接近SOTA的创作水平,支持风格仿写、诗句续写等多种创作模式。其特点包括:硬件要求低(Intel Core i7即可)、生成可控性强、文学性突出,适用于文学创作辅助、教育应用等场景。模型已开源,无需GPU支持,让古诗创作AI技术真正实现平民化应用。

2026-01-10 15:47:31 909

原创 手把手教你使用xiaothink库实现文本AI率精准检测 ✅ 适配Xiaothink-T6系列官方模型

本文介绍了如何使用xiaothink库实现文本AI生成率检测,适配Xiaothink-T6系列官方模型。主要内容包括:1)推荐使用ModelScope社区的Xiaothink-T6模型;2)环境准备和模型加载步骤;3)提供完整的检测代码示例;4)详细解析检测结果字段含义;5)分享批量检测、设备自适应等进阶技巧。该方案具有检测精度高、推理速度快、部署简单等特点,适用于内容审核、学术查重等场景,能实现字符级AI生成概率分析。

2025-12-31 22:39:56 1235

原创 基于XiaothinkT6语言模型的文本相似度计算:轻量方案实现文本匹配与去重

本文介绍了一种基于Xiaothink框架的轻量级文本相似度计算方案,主要特点包括:1)使用预训练的Xiaothink-T6-0.15B-ST模型,无需额外训练;2)适配普通电脑,8GB内存即可运行;3)提供完整代码实现。方案通过4个核心步骤实现:安装依赖、下载模型、构建嵌入提取器、计算余弦相似度(0-1范围,值越大越相似)。该方案特别适合问答系统、内容去重等需要快速判断文本语义关联的场景,具有低门槛、高效率的优势。

2025-08-26 17:07:17 1141

原创 教程:用XiaothinkT6语言模型快速实现文本情感分类,附轻量模型推荐

基于Xiaothink-T6-0.15B-ST模型实现低算力高效文本情感分类。该工具优势包括:零额外模型负担、适配轻量模型、即插即用API。通过pip安装后,只需3步即可实现情感分析:导入模块、初始化模型、调用分类接口。该方案采用指令微调技术,支持零样本迁移,无需额外训练数据。使用时需注意路径正确性和版本兼容性,适合资源有限的端侧应用场景。模型可通过ModelScope下载。

2025-08-19 13:40:01 754

原创 Xiaothink-T6-0.15B混合架构模型深度解析

Xiaothink-T6-0.15B模型突破性地采用MoF混合架构,融合Transformer与RNN优势,在仅0.15B参数和2.5GB训练数据条件下实现接近chatGLM-6B的性能。其核心创新包括:1)双专家协同系统(窄深Transformer处理复杂短上下文+宽浅RNN处理知识型长上下文);2)思维空间模块增强语义理解;3)智能路由动态分配计算资源。该模型支持移动端部署,在基础问答任务中展现出色表现,为边缘计算场景提供高效解决方案。模型已开源并推出多轮对话优化版本,显著降低AI应用门槛。

2025-08-16 14:37:42 1160

原创 论80M参数如何以小博大:用小模型生成媲美GPT-4o的古典诗词

千言2(Xiaothink-T6-0.08B-Poem)是一款仅8000万参数的轻量级AI作诗模型,在单颗Intel Core i7上完成全流程训练。该模型通过150MB诗歌专项数据微调,在诗词创作效果上超越大100倍的ChatGLM-6B模型。用户可通过简单三步安装使用:1)安装专用库;2)下载模型文件;3)调用API生成诗词。模型支持风格仿写、诗句续写等功能,提供温度参数调节创作自由度,并能离线运行于树莓派等设备。其出色的文化传承性和硬件兼容性,为边缘计算设备上的AI创作提供了新可能。

2025-08-04 20:17:24 443

原创 芥象(Img-ZIP)图像超压缩模型

芥象(Img-ZIP)是一种基于深度学习的图像超压缩模型,通过智能分块(80×80区块)将图像压缩为整数序列(-40~40范围),实现1%的超高压缩率(7z二次压缩可达0.41%)。提供16-100维不同版本,16维版压缩率达0.15%但色彩还原弱,100维版(pro2.2_all)支持真实场景。使用时需通过xiaothink库调用,支持图像/视频压缩,并能赋能文本LLM实现多模态扩展。典型应用包括边缘传输(1MB→15KB)、文档存档等,在同等PSNR下体积仅为JPEG的10-15%。

2025-08-01 10:04:47 1042

原创 小模型颠覆大模型:0.08B如何战胜670B?技术路径与未来风口全解析

【AI革命新范式:小模型时代来临】256MB模型性能超越80B巨兽,9美元训练成本颠覆行业。核心突破在于:1)算法革新(强化学习优化/慢思考机制);2)架构革命(模块化组装/稀疏激活);3)工具增强(自验证链/具身接口);4)数据优化(精准配比/难度采样);5)场景压缩(垂直领域特化)。未来四大风口:具身智能、边缘计算、AI民主化、绿色AI。产业格局正从"参数竞赛"转向"智能密度"竞争,开源工具链推动轻量化AI普及。这场静默革命宣告大模型时代的终结,智能效率成为新王道

2025-07-17 15:53:13 718

原创 【真·CPU训模型!】单颗i7家用本,4天0成本跑通中文小模型训练!Xiaothink-T6-0.08B-Instruct-Preview 技术预览版开源发布!

《突破GPU限制:基于CPU的低资源中文模型训练实践》在单颗i7-1165G7移动CPU上通过4天训练实现0.08B参数中文模型。核心创新包括:1)混合专家架构MoF,结合RNN的长文本处理与Transformer的高效推理;2)思维空间机制增强全局理解;3)线性注意力优化降低计算复杂度。实验证明该方案在32GB内存下达成基础NLP任务能力,为技术民主化提供可行路径。研究开源了完整代码与模型,展示了在民用设备上实现AI训练的可能性,为低资源环境下的模型开发树立了新范式。

2025-07-17 11:00:14 1471

原创 星尘:打造你的专属AI伙伴,引爆你的创意无限

星尘”不仅仅是一个平台,它更像是一场关于创意、科技和人性交汇的盛宴。在这里,你可以找到或创建各种各样的智能体——它们是根据特定人物或角色精心设计的AI模型。无论是古代诗人、现代医生,还是虚拟的胖猫,每一个智能体都有其独特的性格和背景故事。你可以与它们对话,获取灵感,甚至让它们帮助你续写自己的小说。而这一切,都只需要通过简单的点击就能实现。

2024-12-06 23:10:16 857 1

原创 清韵千言APP:一款基于RNN架构并深度优化的语言模型应用

清韵千言APP以其独特的GRU架构和单字token化技术,为用户提供了高效、智能的语言处理能力。它不仅支持在消费级CPU上进行高效训练与微调,还在消费级CPU上甚至能够超过25tps的处理速度,确保了对话的流畅性和实时性,同时还支持根据URL页面内容进行微调,从而快速实现基于某本小说进行微调的小说风格续写、基于微调的新闻续写等。此外,该应用所使用的模型省略了预训练步骤,所有官方模型的所有训练数据均由人工编写,无任何无不良信息,为用户营造了一个安全、健康的交流环境。

2024-10-06 11:12:09 896

原创 补充:关于GRU的详细运作原理以及特殊的优化思路

在GRU中引入一个内部的循环机制,这个机制可以进一步处理候选隐藏状态,以便更好地控制信息流。这种内部循环可以用来模拟更复杂的逻辑处理过程,类似于大脑中的多层次处理。

2024-08-05 13:12:23 1376

原创 利用清韵千言-小思构建AI生成模拟新闻应用

通过精心设计prompt,我们可以利用清韵千言-小思接口生成各种类型的新闻内容。这种方法不仅可以帮助我们快速生成大量高质量的新闻稿件,还可以作为自动化新闻生成的基础。随着技术的进步,未来我们甚至可以看到更加复杂和精细的新闻生成应用。今天,我们将介绍如何利用清韵千言-小思这个强大的AI大语言模型接口,创建一个简单的AI生成模拟新闻应用。我们将重点讨论如何设计有效的prompt以生成高质量且具有新闻价值的内容。为了从清韵千言-小思中获取高质量的新闻内容,我们需要精心设计prompt。

2024-08-05 12:34:35 469 1

原创 清韵千言-小思——一个强大的AI大语言模型接口

清韵千言-小思 是一款由我们的团队自主研发的大规模语言模型接口。该模型不仅能够处理各种自然语言任务,而且它的大部分能力已经超越了GPT-3.5等模型。尽管如此,小思也有一些特定的限制条件,比如不支持上下文记忆、不支持并发请求等。下面将详细介绍这些特点以及如何使用它。

2024-08-05 11:41:57 1112 1

原创 【基础模型】开始构建我们自己的大语言模型3:训练我们的模型(内附免费完整训练资源)

在本篇博文中,我们介绍了如何设置训练循环来训练一个语言模型,包括监控训练进度、保存模型检查点、以及进行中间测试。这些步骤对于训练任何深度学习模型都是非常重要的,希望这篇博文能帮助你更好地理解和实践模型训练的过程。

2024-08-03 15:59:37 1038

原创 【基础模型】开始构建我们自己的大语言模型2:模型构建部分

首先,我们需要一个函数来定义并构建我们的模型。这个函数将接收多个参数,如词汇表大小(vocab_size)、嵌入维度()、RNN单元数(rnn_units)、批量大小(batch_size)以及模型版本(mt)和窗口大小(window,目前他没用但以后我们优化模型的时候会用到)。这是GRU的简单流程图:fill:#333;color:#333;color:#333;fill:none;输入层: 接收当前时间步的输入数据重置门: 即sigmoid函数 决定新输入与旧记忆的结合。

2024-07-26 15:45:44 692

原创 如何使用Python调用颜值评分接口

我们可以轻松地从Python中调用颜值评分接口,获取任何图片的颜值评分。这不仅可以用于娱乐目的,还可以作为面部识别系统的一部分,或者在社交媒体应用中评估用户上传的图片。在当今社会,人工智能技术被应用于各个领域,包括图像识别和分析。今天,我们将利用Python来调用小思框架颜值评分接口,该接口可以接收一张人脸图片,并返回一个表示颜值水平的分数。请确保在实际应用中遵守所有相关的隐私法规和道德准则,尊重个人隐私权。本文只是示例,实际应处理更多异常情况,例如网络错误、超时等。

2024-07-18 23:01:04 569

原创 开始构建我们自己的大语言模型:数据处理部分

接上集,本章我们将深入说一下大语言模型数据处理部分的细节,并直接提供本部分的完整代码以及免费公开的的配套资源。

2024-07-18 22:08:04 1873

原创 将独热码应用到神经网络中

接上回,本文继续说如何用TensorFlow将独热编码应用到一个简单的神经网络中,以实现从一段随机文本到另一段随机文本的转换。

2024-07-12 23:13:44 705

原创 回归主题:语言模型——独热码(One-Hot Encoding)在TensorFlow中的应用

独热编码是一种数据预处理技术,用于将类别型特征转换为数值型特征。它的工作原理是为每一种可能的类别创建一个新列(或特征),当原始类别出现时,对应的新列值为1,其余均为0。

2024-07-05 13:43:09 1166

COCO 2017 高质量中文描述数据集

COCO 2017 高质量中文描述数据集,含图片文件名和对应文本描述,共约11万对

2026-09-05

SKchat小说续写模型

SKchat-v1续写模型(4个epochs) 使用英文小说数据训练的微型续写模型(代码框架),不包含新的模型的核心 语言为英文,输入一句话(末尾不带'.'),模型预测下一句话,输入最长为90,超过自动截断。 run.py是基础的训练代码,train.txt是英文小说数据,model文件夹内存放模型,每套模型有三个hdf5文件,a.hdf5 a_en.hdf5 a_de.hdf5,testchat.txt是训练时自动测试的文本。自带的模型效果不好,建议自己训练。

2023-06-25

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除