自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(555)
  • 收藏
  • 关注

原创 本地模型不只要跑起来:用 CSGLite 与 CSGClaw 搭一个可协作的 AI 工作台

比如 Manager 负责拆解流程,资料 Worker 负责整理信息,写作 Worker 负责生成初稿,检查 Worker 负责校对逻辑和事实风险。模型确实可以生成初稿,但资料收集要自己做,卖点提炼要自己判断,标题要反复筛选,事实要重新核对,最终版本还要人工整理。模型只是底层能力,真正影响效率的是:任务是否有清晰边界,流程是否能复用,多个步骤是否能被分配给不同角色,结果是否有检查机制。谁负责拆解,谁负责执行,谁负责检查,谁负责汇总,这些角色变清楚之后,AI 才更容易进入真实生产流程。

2026-07-31 10:00:00 78

原创 OpenCSG 最新研究成果入选 ACL 2026:DoGraph 探索大模型数据混合新范式

OpenCSG研究团队提出了一种基于梯度动态感知的数据混合框架DoGraph,突破传统依赖人工定义数据域的方法。研究发现,模型训练过程中感知的数据域会随梯度方向变化而动态演化,与静态的人工分类存在本质差异。DoGraph通过实时聚类梯度向量识别潜在数据域,并基于域内梯度不确定性优化权重分配,实现了训练数据的自适应调度。实验表明,该方法在GPT-2到LLaMA等多种模型规模上均能提升泛化性能,为大规模语言模型训练提供了更高效的数据利用方案。

2026-07-31 09:15:00 202

原创 CSGClaw 是什么?我用它做了一个B2C电商系统,才发现 AI 开发可以像组建一支小队

本文探讨了AI编程从单点任务到复杂系统开发的演进,重点介绍了开源平台CSGClaw如何通过多智能体协作解决项目级开发的挑战。传统AI编程助手局限于单次问答式交互,难以处理电商系统等复杂项目的模块关联、接口一致性等系统性问题。CSGClaw创新性地采用"Manager-Worker"架构:Manager负责任务拆解与协调,前端、后端、测试等专项Worker各司其职,配合codex模板、Instructions角色指令和本地Skill技能库,形成类人类开发团队的协作机制。以B2C电商系统开发为例,该方案有效解决

2026-07-31 09:00:00 562

原创 OpenCSG协办|交大联合主办,智极松全球AI大赛开放报名,邀AI创新者参与

赛事奖金,提供百万算力券等支持参赛项目研发落地,打造集AI技能竞技、创业项目选拔、产业需求对接、投资孵化落地于一体的全球性创新赛事,构建“赛事-项目-产业”引才闭环。赛事以人工智能技能实践和创新项目孵化为核心,通过项目征集、线上训练营、Demo开发、项目评审及线下决赛等环节,帮助参赛团队完成从创意构想到项目展示。本次赛事面向全球开放报名,不限制年龄、人数、单位及专业背景,无论是高校团队、企业团队、创业团队,还是个人开发者,都可以参与AI创新实践。上海交通大学、湖南省科学技术厅、湖南湘江新区管理委员会。

2026-07-31 08:26:04 324

原创 不卷参数,微软这次卷“全栈”:4B Mage-Flow 如何跑进原生高清时代

近日,微软 Mage 团队发布了新一代图像生成与编辑模型 Mage-Flow,相关模型权重和代码也已同步开放。这个模型家族以 4B 参数规模覆盖文生图与指令式图像编辑,既有完整步数版本,也提供四步完成生成或编辑的 Turbo 版本。如果只看这些标签,Mage-Flow 很像又一次常规的模型上新。它的特别之处,要放进行业背景里看:Qwen-Image 做到 20B,FLUX.2-dev 来到 32B,HunyuanImage 3.0 更是推到 80B。

2026-07-31 08:21:23 318

原创 Kimi-K3 正式开源:前端代码榜第一,只是它最先被看见的能力

总参数接近三万亿,原生支持视觉,并拥有百万级上下文。它的目标——面向长周期编程、知识工作和复杂推理。K3 已经登陆 Kimi、Kimi Work、Kimi Code 和官方 API。完整模型权重、模型卡与技术报告已公开。发布前后,K3 一度登上 Frontend Code Arena 榜首;美联社、Axios 等媒体迅速跟进,海外开发者也开始追问:一个开放模型,怎么突然把前端代码做到了人类用户更愿意选择的位置?开发者可以直接研究模型、部署服务并继续改造它。

2026-07-31 08:19:11 305

原创 CSGClaw v0.4.2-v0.4.3 版本更新

是一个面向独立开发者与小微团队的多智能体协作平台,其核心采用“管理者-工作者”分层架构:管理者智能体负责任务拆解与编排,并将具体开发、测试、文档撰写等子任务分发给不同角色的工作者智能体;CSGClaw提供一键安装、开箱即用的本地环境,并可无缝集成CSGLite作为私有化模型服务底座,支持兼容OpenAI API的本地模型部署。本周更新让 Agent 的工作过程更可见、更可控,丰富了技能交互,并提升了 SkillHub、模板、连接器、跨平台安装及 Web UI 的可靠性。OpenCSG推出的。

2026-07-31 08:17:42 200

原创 AgenticHub v0.6.5 版本更新

是OpenCSG(开放传神)平台专为智能体(Agent)设计的一站式AI智能体开发平台,旨在构建、开发、自学习和持续进化智能体。它独特地融合了自然语言接入、可视化设计、大模型自适应、数据自提高及智能体间工作流编排等核心能力,提供了从自然语言交互到无代码和代码的完整智能体构建体验。这一版把日常对话和智能体管理做得更省心。

2026-07-31 08:15:48 219

原创 MOSS-Transcribe-Diarize 开源:一次输出“谁在何时说了什么”

一场会议结束后,真正麻烦的往往不是把声音变成文字,而是把多人对话重新整理清楚:谁说了什么、这句话发生在什么时候、相隔半小时再次出现的声音是不是同一个人。传统方案通常需要、说话人分离和时间对齐等多个环节串联;MOSS-Transcribe-Diarize想做的,是让一个模型在一次推理中把这些信息一起交付。

2026-07-26 11:51:28 293

原创 Hugging Face遭遇AI Agent攻击:AI资产管理正在进入新阶段

这次事件值得关注的地方,并不仅仅在于一次安全问题,而在于它发生在 AI 基础设施内部。随着大模型和 Agent 快速发展,AI系统已经不再只是一个模型文件。模型、数据集、代码、工具以及执行任务的智能体,共同组成了一个更加复杂的运行体系。在处理此次事件过程中,Hugging Face还采用了自有环境运行开源模型 GLM-5.2,对安全相关信息进行分析。这一做法体现出一个越来越明显的趋势:当AI开始处理安全日志、内部代码和业务数据时,企业对于AI运行环境的控制能力变得越来越重要。

2026-07-25 17:15:11 30

原创 CSGLite 开源版本更新

CSGLite 发布多次更新,从 v0.9.21 连续迭代至 v0.9.29。

2026-07-25 17:09:27 63

原创 CSGClaw v0.4.0-v0.4.1 版本更新

本周更新重点为 Manager 增加文件上传和图片识别,增强聊天交互与会话可观测性,并提升 OpenCSG 集成、Manager 重建、应用内升级和 Web UI 工作流的可靠性。

2026-07-25 17:07:57 100

原创 OpenCSG亮相WAIC 2026|签约市北高新、共话OPC未来

在他看来,单一创意和技术工具很容易被复制,真正能够形成长期竞争力的,仍然是对行业和场景的理解、持续的数据沉淀,以及在实践中形成的专业经验和方法积累。OPC需要找到自己与其他产品的差异,并在产品快速进入市场之后,进一步建立稳定的用户价值与商业路径。陈冉也提到,OPC并不一定意味着所有工作都由一个人独立完成。随着围绕工具、内容、开发、运营和交付的服务体系逐渐形成,个人OPC将与其他开发者、服务商及平台开展更紧密的协作,并逐步走向。

2026-07-25 17:06:09 76

原创 MOSS-Transcribe-Diarize 开源:一次输出“谁在何时说了什么”

一场会议结束后,真正麻烦的往往不是把声音变成文字,而是把多人对话重新整理清楚:谁说了什么、这句话发生在什么时候、相隔半小时再次出现的声音是不是同一个人。传统方案通常需要语音识别、说话人分离和时间对齐等多个环节串联;MOSS-Transcribe-Diarize想做的,是让一个模型在一次推理中把这些信息一起交付。

2026-07-25 17:03:01 294

原创 CSGHub v2.3.0 开源版本更新

平台支持与 Hugging Face 工作流无缝兼容,并提供多源同步、私有镜像、全离线运行等特性,帮助企业在安全可控的环境中实现 AI 研发与部署的全生命周期管理。本次更新聚焦 AI Gateway、资源调度、仓库管理与安全可靠性,全面增强多模态生成、异步任务及 TPU 支持,带来更高效、更稳定的企业级 AI 资产管理体验。(开放传神)推出的企业级模型与数据资产管理平台,旨在为组织提供 Hugging Face 式的高效协作体验,同时满足本地化部署、数据安全与法规合规。更强大、更稳定、更安全。

2026-07-25 16:55:17 274

原创 CSGClaw v0.3.17-v0.3.18版本更新

协作平台,其核心采用“管理者-工作者”分层架构:管理者智能体负责任务拆解与编排,并将具体开发、测试、文档撰写等子任务分发给不同角色的工作者智能体;各工作者在独立沙箱环境中隔离执行,保证上下文安全与并行效率。系统支持Web UI及飞书等渠道的实时监督与“”干预,实现从需求理解到交付产出的端到端自动化。CSGClaw提供一键安装、开箱即用的本地环境,并可。CSGLite作为私有化模型服务底座,支持兼容OpenAI API的本地模型部署。推出的CSGClaw是一个面向独立。

2026-07-25 14:00:00 144

原创 AgenticHub v0.6.4 + CSGClaw双更新,智能体开发体验再升级

AgenticHub v0.6.4 主要优化模型交互体验、移动端适配以及沙盒运行稳定性;CSGClaw 则重点增强多 Agent 协作、技能扩展、任务执行和日常使用体验。豆包“专家模式”全新上线,借助长文本提炼与逻辑梳理,提供答辩、年终总结等场景PPT模板,马上挑选心仪模板!编排等核心能力,提供了从自然语言交互到无代码和代码的完整智能体构建体验。,旨在构建、开发、自学习和持续进化智能体。(开放传神)平台专为智能体(Agent)设计的一站式AI智能体。设计、大模型自适应、数据自提高及智能体间。

2026-07-25 11:00:00 218

原创 GPT-5.6 深夜正式上线:下一代模型能力升级,AI Agent 进入深度协作时代

OpenAI推出GPT-5.6系列模型,包含Sol、Terra和Luna三款产品,分别针对复杂任务、日常开发和高频调用场景。此次升级重点强化了代码开发、工具调用和多Agent协作能力,推动AI从生成答案向任务执行转变。Code

2026-07-25 10:00:00 274 1

原创 私有模型别散落在个人电脑里:为什么团队需要 CSGHub 配合 CSGLite

合同条款摘要、研发文档问答、技术资料提炼,也适合私有模型验证。它们通常涉及内部资料,不能随意外发,也需要模型具备较好的摘要、归纳和格式遵守能力。团队可以先用 CSGLite 测试模型在真实文档上的表现,比如是否遗漏关键条款,是否能按固定结构输出,是否会编造不存在的信息。测试结果再记录到 CSGHub 中,方便后续团队判断是否继续推进。这些场景共同特点是:数据边界明确,业务价值清楚,结果可以人工检查,适合先做受控验证。私有模型进入企业之后,最重要的不是“谁先跑起来”,而是能不能在可控前提下持续使用。

2026-07-25 09:15:00 218

原创 Ornith-1.0来了:代码模型不只会写代码,还开始学会“自己干活”

代码AI正从代码生成迈向完整工程任务执行。DeepReinforce发布的Ornith-1.0开源模型系列(9B/35B/397B)创新性地采用Self-Scaffolding技术,使模型能自主规划开发流程、调用工具并持续修正,实现从"写代码"到"完成项目"的跨越。其35B版本在终端操作、仓库理解等真实场景评测中表现突出,标志着AI编程助手正转型为能理解项目、定位问题、运行测试的工程协作者。该模型通过OpenCSG等平台提供多样化部署方案,推动代码Agent能力从实验室走向实际应用,预示未来AI编程竞争将聚

2026-07-10 08:30:00 175

原创 Qwen-AgentWorld:大模型不只会回答问题,开始学习“世界会怎么变化”

Qwen-AgentWorld-35B-A3B是大模型Agent领域的重要进展,它从“语言生成器”升级为“环境预测器”,能根据Agent动作预测环境变化。该模型覆盖工具调用、搜索引擎、命令行终端等七大交互场景,采用MoE架构支持长上下文,通过CPT、SFT、RL三阶段训练提升模拟真实性。其价值在于为Agent提供低成本、可控的虚拟训练环境,助力多步任务能力提升。该模型标志着大模型从“回答问题”向“理解交互”的演进,推动AI从聊天助手向行动助手的转型。模型已在OpenCSG和Hugging Face社区开源发

2026-07-09 16:02:25 325

原创 百万年薪、创始股权,OpenCSG招聘最懂AI的应届生

OpenCSG启动"百万年薪原生AI计划",面向2026-2028届学生招募AI创业合伙人。该计划突破传统校招模式,不设学历、成绩等硬性门槛,重点关注候选人的实际AI项目经验(如开源贡献、模型训练、产品开发等)。入选者将参与下一代AI产品创造,享有20-60K月薪(优秀者可达百万年薪),并有机会获得股权、创业支持和全球化平台。公司强调寻找具备创业者心态的"原生AI人才"——既懂技术又懂产品,能在不确定环境中主动创造价值。工作地点不限,应聘需提交实际项目证明而非标准简历。

2026-06-30 20:07:29 399

原创 全球最多下载的中文开源高质量数据集更新了!OpenCSG发布Fineweb-Edu-Chinese-V2.3

这是一份面向中文大模型训练、NLP 任务构建与多语言研究的高质量中文教育语料数据集,聚焦中文文本中的教育价值、内容质量与训练可用性,为中文大模型预训练、继续预训练和数据研究提供更可靠的数据基础。v2.3 加强了对长段回答重复句式、循环表达、异常中英文混入、乱码、网页模板、广告导航、弱证据样本和缺少来源约束回答的控制,让最终保留的数据更适合在后训练阶段提升模型回答质量。BERT 打分模型;方便社区用户和产业团队直接接入常见训练框架,用于中文教育助手、知识服务、企业培训、垂直问答和文本生成模型建设。

2026-06-30 08:56:41 875

原创 CSGLite v0.9.3版本更新

推出的轻量化本地大模型运行底座,以单二进制文件集成了模型下载、本地推理、交互对话与标准API服务,支持一键自动完成模型加载与推理启动,并提供包含资源监控、模型市场、数据集管理、聊天室及AI应用管理等七大模块的统一Web工作台。同时可通过launch命令一键配置主流编程Agent(如Claude Code、Codex等)直接调用本地模型,或一键拉起OpenClaw、Dify等AI应用,从而为开发者和企业提供从模型管理到本地推理、再到应用生态接入的全流程基础设施能力。CSGLite 本周迭代到 v0.9.3。

2026-06-30 08:54:41 203

原创 CSGClaw 版本更新

推出的CSGClaw是一个面向独立开发者与小微团队的多智能体协作平台,其核心采用“管理者-工作者”分层架构:管理者智能体负责任务拆解与编排,并将具体开发、测试、文档撰写等子任务分发给不同角色的工作者智能体;CSGClaw提供一键安装、开箱即用的本地环境,并可无缝集成CSGLite作为私有化模型服务底座,支持兼容OpenAI API的本地模型部署。CSGClaw本周更新重点是把技能与模板分发、账号与模型管理、以及本地运行时稳定性一起补齐,Web UI 和飞书相关流程也继续细化。

2026-06-30 08:52:59 341

原创 CSGLite 与本地 AI 工作流:从单次聊天走向模型、应用与 Agent 连接

官方 GitHub README 将其描述为一个轻量本地 LLM runner,具备模型下载、本地推理、交互式聊天、OpenAI-compatible API、Web UI、可恢复下载、Marketplace 浏览,以及 AI App 和 Coding Agent 一键配置等能力。CSGLite 提供的是本地模型运行和连接能力,但它并不能自动保证模型效果。因此,更合理的使用方式是:用 CSGLite 降低本地模型运行和接入门槛,用应用工具或 Agent 工具组织任务流程,最后由用户进行判断和复核。

2026-06-29 16:16:23 67

原创 用 CSGLite 在本地运行大模型:从模型下载到 API 调用的轻量流程

本地大模型的使用,很多时候并不是卡在“模型有没有能力”,而是卡在“如何把模型稳定运行起来”。本地模型可以帮助用户完成原型验证、辅助写作、代码分析和文档处理,但如果涉及企业生产环境,还需要考虑权限控制、安全审计、服务稳定性、模型评估和数据治理等问题。它把模型下载、本地推理、交互式聊天和 API 服务整合在一起,让用户能够以更轻量的方式开始本地大模型实践。模型下载是否可以续传?CSGLite 的核心价值,是把本地大模型使用流程变得更清晰:用户可以通过较轻量的方式完成模型下载、运行、聊天和 API 调用。

2026-06-29 16:15:42 191

原创 CSGClaw 与 CSGLite 如何配合:从本地模型到多智能体协作

比如在代码分析场景中,本地模型可以帮助理解项目结构,CSGClaw 可以将任务拆分为代码阅读、问题归纳、测试建议和文档整理。再比如在内部文档场景中,本地模型可以处理资料内容,CSGClaw 可以帮助组织摘要、分类、问答和结果汇总。用户可以让模型回答问题、生成内容或分析代码,但如果希望模型参与更复杂的任务,还需要一个能够组织任务、拆解目标和协调多个角色的协作层。在代码、文档和内部资料处理场景中,很多用户会关注数据安全、调用成本、网络依赖和模型可控性。因此,本地模型成为不少开发者和团队关注的方向。

2026-06-29 16:14:26 166

原创 小团队如何用 CSGClaw 梳理研发流程?

Manager 负责理解目标和拆解任务,需求 Worker 可以整理功能边界,开发 Worker 可以辅助梳理实现思路,测试 Worker 可以补充测试点,文档 Worker 可以整理接口说明和更新记录。对于小团队来说,合理使用多智能体协作工具,可以让研发流程更清晰,但关键判断和最终责任仍然需要由团队成员承担。假设团队要新增“用户权限管理”功能,过去可能是产品简单说明需求,开发直接实现,测试上线前检查,文档最后补充。它可以帮助团队提前发现需求模糊点,补充测试思路,整理文档初稿,并为版本复盘提供参考。

2026-06-29 16:13:45 178

原创 独立开发者如何使用 CSGClaw 管理复杂开发任务

对于独立开发者来说,建议先从低风险任务开始使用,例如需求整理、文档初稿、测试点补充和版本计划,而不是一开始就把核心代码完全交给 AI 处理。需求没有及时整理,测试没有补充,文档没有更新,用户反馈也没有形成下一轮计划,项目推进就容易变慢。独立开发者在推进项目时,常常需要同时处理需求、开发、测试、文档、发布和迭代等多个环节。当一个项目涉及多个环节时,多智能体协作可以帮助用户更清楚地拆分任务、整理过程和检查结果,从而降低长期维护中的混乱感。因此,独立开发者需要的不只是代码生成能力,还需要更清晰的任务组织方式。

2026-06-29 16:12:59 234

原创 用 CSGClaw 辅助 Web 原型开发:需求、开发、测试如何分工

需求 Worker 可以整理功能范围,确认任务创建、编辑、状态切换、列表展示等核心功能。后端 Worker 可以规划接口和数据字段,例如任务 ID、标题、状态、创建时间和更新时间。Web 原型开发通常不是单纯写代码,而是一个包含需求、页面、接口、测试和文档的连续过程。CSGClaw 的多智能体协作模式,可以用于辅助梳理这类开发任务,让原型开发从单点代码生成,转向更清晰的流程协作。用 CSGClaw 辅助 Web 原型开发,重点不在于“自动完成开发”,而在于帮助用户把需求、开发、测试和文档拆成更清楚的流程。

2026-06-29 16:12:23 231

原创 CSGClaw 是什么?从多智能体协作理解它的使用方式

例如,当用户提出“整理一个产品原型方案”时,Manager 可以先把任务拆成需求分析、功能结构、交互说明、测试点和文档输出几个部分,再由不同 Worker 处理。多智能体协作的思路,是把复杂任务拆分成多个相对明确的子任务,再由不同角色分别处理。对于独立开发者和小团队来说,如果一个任务同时涉及多个环节,可以借助多智能体协作方式,把原本混在一起的任务拆得更清楚,从而减少后续返工。CSGClaw 更适合处理多步骤任务,例如产品原型开发、代码检查、测试补充、技术文档整理、需求拆解、小团队研发协作等场景。

2026-06-29 16:09:15 213

原创 AgenticHub v0.6.3 版本更新

是OpenCSG(开放传神)平台专为智能体(Agent)设计的一站式AI智能体开发平台,旨在构建、开发、自学习和持续进化智能体。它独特地融合了自然语言接入、可视化设计、大模型自适应、数据自提高及智能体间工作流编排等核心能力,提供了从自然语言交互到无代码和代码的完整智能体构建体验。

2026-06-27 10:57:18 189

原创 别再一页一页翻了,Baidu Unlimited-OCR 正把 OCR 带进“整本读取”时代

它不再把一份文档天然拆成很多彼此孤立的小任务,而是希望像人读材料一样,保持连续状态,把多页内容放进同一次处理流程里。这类能力对真实场景非常关键。单页 OCR 做得再好,遇到几十页报告时仍然会被页间顺序、上下文衔接、表格跨页、图片说明和段落连续性拖住。

2026-06-27 10:56:22 212

原创 VibeThinker-3B,为什么敢和前沿推理模型同场比拼

今天大家聊模型,常常默认“更大才更强”,而 VibeThinker-3B则试图给出另一条路线——有些能力也许不是靠一味堆参数,而是靠更精准的训练,把推理这件事压缩进一个更小、更紧凑的核心里。最近LeetCode周赛和双周赛 96.1% 的总体通过率就说明,它不是只会“刷 benchmark”,而是在新题、实战、执行可验证的问题上也能打。如果你关注AI模型的新趋势,VibeThinker-3B 值得看,因为它讲的不是“更大”,而是“更准”,也许下一轮真正有意思的竞争,不只发生在万亿参数之间。

2026-06-27 10:55:15 187

原创 CSGLite 把本地模型、云端模型与 AI 应用连接成一个轻量入口

CSGLite 支持集成 OpenAI、DeepSeek、MiMo、Kimi、BigModel、Qianfan、MiniMax、OpenRouter 以及任意 OpenAI-compatible API,并可以在 Settings 中配置 Provider,使它们的模型和本地模型、OpenCSG 模型一起出现在聊天中。对开发者来说,本地模型、云端模型、第三方模型Provider、AI 编程工具、知识库应用和团队环境管理,本来是多个相互割裂的问题。每多一个组件,就多一层版本兼容、路径配置和运行状态管理。

2026-06-27 10:53:56 344

原创 微软 FastContext-1.0-4B-SFT 把“找代码”变成专职能力

是全球领先的开源大模型社区平台,致力于打造开放、协同、可持续生态,AgenticOps是人工智能领域的一种AI原生方法论,由OpenCSG(开放传神)提出。核心产品 CSGHub提供模型、数据集、代码与 AI 应用的 一站式托管、协作与共享服务,具备业界领先的模型资产管理能力,支持多角色协同和高效复用。它的意义不在于取代更强的主模型,而在于用更小的模型承担仓库探索这种可拆分任务。在Mini-SWE-Agent的实验中,读取文件和搜索代码占据了大量工具调用轮次,也消耗了相当高比例的主模型 token。

2026-06-27 10:51:44 220

原创 企业AI转型的痛点是什么?揭秘AgenticOps方法论落地场景

微调后的模型会沉淀为可复用的模型服务资产,不仅能在 AgenticHub 中使用,还可被 CSGLite、CSGClaw 等 OpenCSG 生态应用调用,让一次训练成果服务更多 Agent、应用与业务场景。

2026-06-27 10:49:59 206

原创 GLM-5.2 冲上榜单第 2!AI 编码模型开始接近真实工程现场

项目盘点、技术债梳理、接口迁移、中等规模重构、测试补齐、文档整理,这些过去很容易被切碎的工作,开始变得适合交给模型连续推进。这些评测看的不是“回答像不像正确答案”,而是模型能不能完成一条完整链路:理解任务,拆步骤,调用工具,修改文件,看反馈,再继续验证。回头看GLM-5.2,它最值得关注的地方不是某一个单点能力,而是几个能力开始合在一起:前端榜单冲到第2,1M上下文能装下更完整的项目背景,长程任务评测开始看重流程闭环,IndexShare和 MTP又把成本问题往下压了一层。否则它改得越多,风险越大。

2026-06-21 21:55:20 220

原创 MiniCPM5-1B 核心数据公开背后:OpenCSG Chinese FineWeb 的中文数据价值

Ultra-FineWeb 技术报告显示,在英文与中文多个基准任务上,Ultra-FineWeb 相比 FineWeb、FineWeb-edu 等数据集取得了更好的平均表现,并且随着训练推进,高质量数据的优势持续显现。当OpenBMB 开源社区发布 Ultra-FineWeb-L3 与 UltraData-SFT-2605,两份面向 MiniCPM5-1B 训练链路的核心数据集时,一个更值得中文 AI 社区关注的问题浮出水面:高质量模型能力的背后,正在形成怎样的数据基础设施?

2026-06-21 21:54:43 212

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除