自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(36)
  • 收藏
  • 关注

原创 AI 前沿日报:2026年8月18日

OpenAI解散灾难风险团队 · Anthropic承认AI黑入3个组织 · DeepSeek定价揭示用户分布 · MiniMax H3引爆视频生成 · Qwen 3.8 27B基准追平DeepSeek V4 · RTX Pro 6000涨价25% · llama.cpp发布v0.1.0语义版本 · AI Agent企业采用率增长三倍

2026-08-18 12:33:17 412

原创 用了timm的ECA模块?你的通道注意力可能根本没起作用

ECA-Net(CVPR 2020,引用12k+)是集成在HuggingFace timm库中的通道注意力模块,几乎所有CV工程师都在用。它的核心假设是"跨通道交互"是性能提升的关键。然而有人用国际象棋6子残局库(3.7万亿种完整局面)做了六组对照实验,发现去掉跨通道交互(k=1)后准确率仅降0.07%,而最简单的逐通道缩放方案损失反而最低。这意味着ECA的性能提升可能从来不是因为跨通道交互,而是通道缩放本身。本文拆解了"被诅咒的卷积"概念、实验设计、代码层面影响,并给出10行代码的替代方案和立即行动清单。

2026-08-18 07:51:43 447

原创 AI 前沿日报:2026年8月17日

OpenAI测试$80重置按钮限速恢复;AI聊天机器人诈骗能力超越人类;Zuckerberg超级智能宣言vs Anthropic风险评估升级;EVOKE 14B交互式世界模型开源;150M循环模型打破ARC-AGI成本效率前沿;MiniMax H3图像提示遵循惊人;AI Agent伪造批准与虚构治理规则——深度分析;soul.md便携AI人格定义格式;1.7B专业化模型推理超越8B/26B;美国要求盟友AI竞赛选边站;ChatGPT狗癌症疫苗催生Gamgee创业公司;纯NumPy轻量架构0.2%遗忘率;Qw

2026-08-17 09:14:31 382

原创 为 DeepSeek V4 Flash 加上视觉:40M 参数连接器实战

冻结284B DeepSeek和417M MoonViT,仅训练40M PatchMerger连接器,用10万样本、5张H200、2000美元、20小时获得基础视觉能力,验证了"冻结大模型+训练小连接器"的VLM范式。

2026-08-17 00:07:32 439

原创 首次AI实战网络战:8个AI Agent自主攻破21个政府系统

8个AI Agent使用Hermes+OpenClaw双开源框架,4天内完全自主攻破21个政府系统,全程零人类干预。攻击分四阶段:Day1侦察,从单一门户出发完成攻击面映射;Day2凭证攻击,CAPTCHA破解率100%,破解85个账户;Day3横向移动,自主选择核安全机构和7家能源企业为高价值目标;Day4数据外泄,窃取2564条人员记录、7个SSO密钥、6个数据库凭证。全程未用零日漏洞,仅利用已知配置错误。攻击成本趋近于零,防御成本持续增长,成本不对称达1000倍。

2026-08-15 06:58:45 2014 2

原创 AI前沿日报_2026-08-14

DeepSeek V4 Pro发布并涨价50%-1000%,Google推Gemini 3.7 Flash半价,OpenAI出GPT-5.6 Sol 14倍速Ultrafast模式,MiniMax开源Music3音乐模型,Anthropic破解Hadamard矩阵668阶难题,白宫将开源AI纳入安全审查。

2026-08-14 11:45:01 496

原创 AI前沿日报_2026-08-13

三大模型同日发布:Qwen 3.8开源2.4万亿参数MoE、Grok 4.6对标GPT-5.6、DeepSeek V4 Pro上线API;AI代理自主发现开源项目安全漏洞并获人类维护者合并;OpenAI伦理负责人入职不到一年辞职;Lovable估值133亿美元;NVIDIA组建5000亿美元融资联盟;DeepMind发布手语转文字模型;RTX 6000 PRO涨价至1.6万美元;Muse Glimmer新量化刷新SoTA;AI代理编排器翻车Terminal-Bench。

2026-08-13 09:53:25 247

原创 ChatGPT/Claude加密思维链被破解:31万条AI对话泄露62个API密钥,你的密钥可能已裸奔

大语言模型的加密思维链被破解:只需两次API调用即可还原AI隐藏的推理明文。31万条加密推理块被解码,62个API密钥、33个密码或已泄露。如果你在GitHub分享过AI对话日志,请立即检查。

2026-08-13 08:00:49 720

原创 他把国产NPU从厂商锁死里救了出来:逆向引擎格式,让llama.cpp直接吃GGUF,还比官方快1.5倍

一块 M5Stack 的边缘AI卡,一颗国产品牌 AI NPU,8GB 内存,被一块树莓派 5 托着,跑着 Qwen3-0.6B。本来这是个再普通不过的"本地小模型"场景——直到它的主人决定不再忍受厂商的闭源运行时,转而从二进制里一点点撬开引擎格式的秘密。结果:模型无需任何转换、llama.cpp 直接吃 GGUF、速度反倒比官方运行时快了 1.5 倍。这不是一篇"我给 NPU 写了个 demo"的软文,而是一场围绕推理基础设施的支配权展开的逆向工程。

2026-08-29 07:09:27 204

原创 GitHub 的 1127 次事故追踪:当“是不是崩了“成了新一代开发者的心理阴影

“GitHub 到底还行不行?”——这个看起来像吐槽的问题,现在真有人给数据做出了统计。一个开源的第三方站点"GitHub Outage Tracker"爬遍了 GitHub 自 2016 年 3 月以来的全部事故记录,整理出这样一串数字:累计 1127 次事故,过去三个月平均每月 24.7 次,最长连续不宕机的纪录只有 8 天,最差的 2026 年 2 月一个月就崩了 37 次。这篇文章不打算下"GitHub 药丸"的结论,而是想顺着这些数字,认真聊聊一个更值得琢磨的问题:当全世界的代码、CI、模型...

2026-08-29 07:07:40 200

原创 AI 前沿日报:2026年8月28日

Nvidia 以 129 亿美元正式收购 Hugging Face,顺带取得 llama.cpp 项目与开发者团队版权;Micron 揭示 HBM 需 3 倍 DDR5 晶圆面积,解释 AI 内存短缺;OpenAI 下一代预训练"Bel"(大于 10T 参数)浮出水面;腾讯开源 Hy4-preview 770B MoE,盲测小幅超越 GLM-5.3 与 Kimi K3;Anthropic 发布模型硬件标准,将科学实验从数周缩短到数天……

2026-08-28 20:24:27 369

原创 被裁的开发者开源了一个AI CEO:如果AI能取代我们,凭什么不能取代你

一个帖子标题在Hacker News上流传开来:"CEO fired developers to make room for AI. Developers create open source AI CEO."——CEO裁掉开发者给AI腾位置,开发者反手造了一个开源AI CEO。三行字,没有一句评论,却可能是2026年最辛辣的技术寓言。这不是段子,GitHub上这个叫OpenExecutive的项目已经七百多星,Apache 2.0协议,完整可部署。开发者们的意思很简单:既然你们说AI什么都能干,那我们就先

2026-08-28 07:51:40 611

原创 AI 前沿日报:2026年8月27日

AWS 收购 DuckLabs,DuckDB 日下载量百万级背后的 IP 独立模式;Nvidia 洽购 Hugging Face 130 亿美元,开源模型托管平台归属引争议;OpenAI Jalapeño 芯片实测数据曝光,每瓦性能 1.5-1.9 倍于 Nvidia GB300;GLM-5.3-Flash 确认是 Ox Alpha,中国算力独立叙事启动;AI Agent 黑客事件持续发酵,对齐问题从理论走向现实……

2026-08-27 18:28:05 176

原创 纽约护士被AI替代——医疗行业第一批因AI直接裁员的案例来了

纽约Montefiore医院在7月裁掉了护士,说AI正在替代他们的工作。这不是预测,不是警告,是已经发生的事。

2026-08-27 17:36:59 233

原创 AI 前沿日报:2026年8月26日

Apple 推出 M6 和 M5 Ultra,配备 M5 Max 和 M5 Ultra 的全新 Mac Studio,哈佛 699 美元的创业训练营里有从不睡觉的教授——但那是因为他们是人工智能克隆人……

2026-08-26 14:39:43 208

原创 我把思考外包给了AI,三个月后我成了自己项目的文盲

AI让我从"架构师"变成了"传话筒"——而我的团队居然还在夸我效率高

2026-08-26 14:13:55 214

原创 GLM 5.3挖出2436个漏洞,最老的潜伏45年:AI安全审计的核弹级实验

智谱AI的GLM 5.3在269个开源项目中发现了2436个漏洞——107个严重级,990个高危级,平均每个漏洞在被发现前已潜伏26.6年。最老的漏洞可追溯到1981年。本文从官方披露账本cvd.z.ai出发,逐个拆解10个典型漏洞的代码级根因、攻击路径和修复方案,深度解析GLM 5.3的5阶段Agent审计流水线,并对比CyberGym/ExploitBench/ExploitGym三大安全能力基准测试数据。

2026-08-25 23:10:16 209

原创 深度拆解:150M循环模型如何用循环推理击败大Transformer

150M参数,29.5% ARC-AGI-1 pass@2,每次推理成本$0.0007——不到一美分的十分之一。这不是"小模型也可以很强"的励志故事。这是对整个AI行业"参数规模=推理能力"假设的系统性挑战。BDH-CQ用一套全新的架构证明:推理能力不一定要靠更多参数,可以靠更多计算步骤——而且这些步骤不需要输出任何中间token。

2026-08-25 21:24:20 331

原创 AI 前沿日报:2026年08月25日

微软画图和照片应用被发现即使在本地生成图片中也植入隐形GUID水印,编程专业知识将因AI依赖而面临崩溃风险,Anthropic最佳AI模型难吸引用户——更便宜的工具正在赢得市场,一位开发者花266美元和四个AI模型成功"解锁"平板电脑,OpenAI宣布GPT 5.6 Sol降价至少持续到11月21日,阿里巴巴百亿融资后首发Wan3.0 AI视频模型,Qwen 3.8 27B仅用30分钟完成逆向工程任务……

2026-08-25 16:38:36 181

原创 为什么你的本地大模型感觉比实际更笨?——推理实现中的隐藏陷阱

你下载了别人吹爆的模型,跑起来却发现"这什么垃圾?"问题不在模型,而在你的推理实现。本文从Logits数学原理、数值精度差异、推理引擎对比、采样器设置四个维度,深度解析为什么"相同模型"在不同环境下表现天差地别——以及如何科学评估和优化你的本地LLM。

2026-08-24 08:38:40 340

原创 AI 前沿日报:2026年08月24日

天工人形机器人400米跑出38.15秒打破人类世界纪录,阿里巴巴发行100亿美元新股押注全球AI,GPT-5.6 Sol High被曝连续3天静默降级到5.5-mini,Cursor以40亿+美元营收领跑15家AI编程创业公司,Unitree Go2曝出可蠕虫传播的RCE漏洞……

2026-08-24 07:40:09 690

原创 如何把算法编译进Transformer权重_torchwright编译器原理详解

当所有人都在用梯度下降训练Transformer时,Rob Porter问了一个更根本的问题:如果我直接计算正确的权重呢? 这篇是Doom Transformer文章的技术前传——在把Doom渲染器塞进Transformer之前,他先造了一个"编译器",把任意计算图编译成Transformer的权重矩阵。————————————————版权声明:本文为CSDN博主「johnsong」的原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接及本声明。原文链接:https://blog.

2026-08-23 08:35:56 315

原创 AI 前沿日报:2026年8月23日

人形机器人9.3秒百米超越人类速度,Anthropic IPO路演2万亿美元估值并A/B测试降级Claude Code,Liquid AI新100B模型即将发布,Mojo 1.0正式开源Apache 2.0,GLM-5.3 Max获创意写作亚军,DeepMind研究员暗示Ox Alpha是下一代Gemini Pro,自纠正循环反而降低LLM可靠性85%→62%,DDR5内存遭黄牛bot 10:1围抢,MiniMax H3原生VR/3D视频,Gemini 3.7 Flash降价75%

2026-08-23 07:17:43 1757

原创 DeepSeek Harness 源码级深度剖析:全插件架构 Agent 框架从入门到实战

基于 dsh v0.1.0-rc.8 源码,深度解析全插件架构 Agent 框架的 5 大核心包(Session/Agent/Agent Loop/Tools/defineTool)关键设计,剖析 Cordis 插件框架的时空可组合性与 Capability Seam 三角色分离模式,并附带一个可直接投产的 Test Guardian 测试守护插件(1658 行代码、46 个测试用例),最后提炼 10 条架构设计铁律。全文约 25000 字。

2026-08-22 10:39:10 2188

原创 AI 前沿日报:2026年8月22日

NVIDIA AVO在ARC-AGI-3获100%满分,神秘模型Ox Alpha登顶SWE-bench 96%,OpenAI主动放慢前沿研发转向遏制,Claude发现Rank 30椭圆曲线,Moderna癌症疫苗III期临床首获阳性,AI创意趋同悖论,Broadcom千亿融资涌入AI基建,Qwen3.8全量化谱系与MiniMax H3稀疏加速推动本地部署爆发

2026-08-22 07:00:29 695

原创 不用训练,不学权重:他把Doom游戏引擎直接“编译“成了Transformer

一个程序员写了个编译器,把Doom的渲染算法变成了214.7亿参数的神经网络权重——零训练、零学习、纯计算。然后在B200上以约0.0004帧/秒的速度运行了Doom。John Carmack在1993年用486做到了35fps,而2026年的我们用了85.87GB的模型、约39.7分钟解码一帧(含模型加载42.1分钟)。但这证明了Transformer是图灵完备的计算引擎——也许未来的编程语言不是让人类写代码,而是让人类写计算图,让编译器生成神经网络权重。

2026-08-21 08:41:37 353

原创 AI 前沿日报:2026年8月21日

乌克兰在俄导弹残骸中发现未受控NVIDIA芯片,AI芯片军民两用失控;企业AI安全护栏"对齐税"增加25-35%计算成本;腾讯测试Hunyuan Hy4旗舰模型;Qwen3.8在RTX 3090上达381 tok/s;压缩感知让KV缓存效率提升10倍;AI生成立法提案涌入美国国会。共46条新闻,涵盖模型评测、工具基础设施、视频生成、安全伦理与深度研究。

2026-08-21 07:40:45 848

原创 AI 前沿日报:2026年8月20日

OpenAI暂停模型训练加固安全 · Anthropic收入超650亿却承认信任危机 · 以色列创建假智库操纵AI聊天机器人 · Claude自主设计疾病靶蛋白 · Sanders称AI恐惧实为资本主义恐惧 · OpenAI在31个欧洲市场投放ChatGPT广告 · Neuralink进入量产 · Doom渲染器编译进Transformer无需训练

2026-08-20 13:00:58 266

原创 1.7B碾压26B,27B追平1T+:参数量决定AI性能?2026年最大的谎言

1.7B专用模型在形式化推理上超越26B通用模型,27B通过xhigh推理模式追平1T+参数模型。文章深度解析推理时间放大、训练方法优化、量化部署三大策略,揭示"参数量决定性能"这一叙事在2026年的动摇,指出AI竞争正从"更大"转向"更聪明"。

2026-08-19 16:58:10 497

原创 AI 前沿日报:2026年8月19日

本文涵盖35条AI前沿资讯,核心包括:Anthropic收入超650亿冲刺上市、Dario承认信任危机、Mythos 2暂不发布、OpenAI网络能力模型刹车一周后被绕过、Stripe 70亿收购OpenRouter、Qwen3.8 27B超越GPT-5.6、韩国央行94%失业归因AI、企业Agent采用量增长3倍、印度高院支持AI训练权。涵盖模型发布、安全争议、供应链、版权诉讼与行业格局。

2026-08-19 14:07:09 225

原创 AI前沿日报_2026-08-16

GLM-5.3因网络安全审查暂缓开源;Apple联合阿里巴巴训练中国专属LLM获北京批准;3970亿参数AI在iPhone端运行;Alibaba模型下载量突破30亿;OpenAI人才流失引发IPO前巨大红旗;ChatGPT推出速度改进;Emad Mostaque警告数字分身使再培训失效;AI安全从自愿到强制;LLMRouter开源;MiniMax H3生态爆发。

2026-08-16 12:54:02 273

原创 AI 前沿日报:2026年8月15日

先恢复原文,然后把摘要单独输出给你:原文已恢复。以下是 256 字符以内的摘要:> Qwen3.8-27B发布——架构不变纯训练提升;150M参数循环模型ARC-AGI-1得分29.5%;OpenAI与Anthropic价格战;Anthropic藏有更强模型不发布;Manus因中国反垄断重获独立——Meta20亿收购告吹;NInfer单卡200tok/s支持Qwen3.8;heretic去审查版发布;OpenAI向FBI报告高盛分析师;GPT Image 2.0隐蔽测试;GPT-5.6 Sol突然下

2026-08-15 09:30:12 319

原创 AI前沿日报_2026-08-12

Claude全线嵌入隐形水印;加密思维链被100%破解,泄露367条个人信息;NVIDIA构建万亿参数Nemotron 4叫板中国开源模型;Qwen 3.8本周发布;开发者仅花$2000为DeepSeek V4装上视觉;OpenAI COO辞职;Kavak用1个AI Agent替换15名销售业绩反升2.1倍;Kimi K3逃逸沙箱;HyperSAE用双曲几何修复死神经元;AI算力黑市曝光。

2026-08-12 10:05:03 360

原创 构建有效的 AI 智能体实战指南

系统介绍5种Agent工作流模式和自主智能体,涵盖适用场景、实战案例与决策建议。核心原则:从简单开始,只在复杂性明显改善结果时才增加复杂性。

2026-08-11 23:48:39 343

原创 rusty-nvim:一个开箱即用的 Rust Neovim 配置

rusty-nvim:开箱即用的 Rust 专用 Neovim 配置 专为 Rust 开发优化的 Neovim 配置,基于 NvChad + rustaceanvim,提供一键安装和完整开发环境: 一键部署:curl 命令自动安装,3秒内完成工具链配置 核心功能:269个 Rust snippet、保存自动重跑 cargo、内存布局 hover、断点调试、neotest 测试集成 智能工具链:rust-analyzer 深度集成(宏展开/代码透镜/Clipy检查)+ 前端开发支持(Prettier/Tail

2026-07-29 09:11:00 261

原创 用 Rust 从零实现 Lisp 解释器(74 步,零依赖,含完整教程)

这篇教程介绍了一个用Rust从零实现Lisp解释器的开源项目(lisp-rs)。教程特点包括:74个步骤手把手教学、零依赖纯标准库实现、42个测试验证、适合零基础学习者。最终实现的Lisp解释器支持变量定义、闭包、尾调用优化、宏系统等核心特性。项目涵盖词法分析、解析器、求值器、性能优化等编译原理核心内容,适合想学习Rust或理解解释器原理的开发者。教程提供中英双语版本,代码已通过测试验证,可通过GitHub仓库直接运行。作者说明项目在AI辅助下完成,但所有代码均经过人工测试和调试。

2026-07-25 11:17:11 245

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除