- 博客(2239)
- 收藏
- 关注
原创 豆包视频通话率先上线「全模态全双工」,AI终于能边看、边听、边说了
家人们,我发现最近豆包又变聪明了,之前只要有人说话别管是不是和它说话,它都回答,最近明显不会乱搭话了。我一查,发现豆包的视频通话果然更新了。这周末三伏天,热得我不想出门,晚饭吃啥成了世纪难题。遇事不决问AI,老规矩,我点开了豆包视频通话让它给我推荐。它一开始给我推荐做饭吃。我转头问了旁边的朋友想不想做饭,朋友说不想。我又转回来跟豆包说:那我们点外卖吧。它就开始推荐外卖。然后,我中间还和朋友商量豆包推荐的OK吗,全程也没耽误和豆包的对话,非常愉快地决定了晚饭。
2026-08-05 17:24:30
266
原创 刚刚,Anthropic被曝与成立7个月的公司签下100亿美元大单!
一家才成立7个月的公司,就拿下100亿美元的算力订单,然而它自己估值才24亿美元。一张订单金额,竟是它整个身价的4倍多。最离谱的还不是这个。这家公司连第一批算力都还没建好,机房还在挪威的雪地里等着施工。8月5日,TechCrunch援引Bloomberg报道,Anthropic和一家叫Volta Infra的AI云初创公司签了6年算力协议,总价100亿美元。Volta自己公布合作的时候,只把客户含糊称作“一家领先的AI实验室”,名字压着没说。
2026-08-05 17:22:35
247
原创 OpenAI晒出全部私聊,和苹果撕破脸了
家人们,大大瓜!苹果和OpenAI,彻底撕破脸了。有多彻底呢?OpenAI刚刚发了篇官方声明,标题就叫——《苹果搞错了》(Apple is getting this wrong)。内容更猛,直接把苹果外聘律师的往来邮件、苹果员工的内部私聊,一张不落,全挂官网上了。科技巨头打官司我见多了,把对方员工聊天记录当「证据展」公开处刑的,这还是头一回。
2026-08-05 17:21:02
242
原创 国产AI视频模型又卷起来了:Seedance 2.5和MiniMax H3谁更值得用
视频领域好久没这么热闹了。7月最后一个工作日,Seedance 2.5和MiniMax H3 齐刷刷上线。
2026-08-04 15:45:58
222
原创 OpenAI 新模型 Astra 拿出 10 项数学成果,Anthropic数学家反手追解5项
OpenAI 下一代模型 Astra 还没对外开放,第一批成果已经先来了:10 项数学与理论计算机科学新结果。8 月 1 日,OpenAI 首次在官方材料中确认 Astra,并称它是公司的“下一代主要模型”。同时公布的还有 249 页论文、62 页发现过程说明,以及 10 套可以交给 Lean 检查的形式化证明。据 The Information 报道,Astra 正在测试中。它可以协调多个智能体分头处理复杂任务,把一次模型回答拉长成持续数小时甚至数天的工作过程。
2026-08-04 15:38:56
286
原创 我每月花5000元养AI,Anthropic拿走了80%毛利
这几天,我给 AI 们续费的时候,顺手把账单拢了一遍。Claude、Codex两家的套餐,再算上各种国产模型、API,加起来每个月就小五千块。肉疼归肉疼,我倒没怎么犹豫。因为这钱花得确实值,一方面帮大家测评模型;另一方面现在 Agent 是真干活,以前自己得熬一晚上的事儿,现在它一会儿就弄完了。我出钱,AI干活儿,算是子孝父安。但交着交着,我突然发现,自己这两年在AI上花的钱真是越来越多了。从一开始的20刀订阅,到后面批量买API、Max套餐,会员越买越多,越买越贵。我决定抽个时间,好好查下账。
2026-08-04 15:31:24
193
原创 OpenAI、Anthropic超1100名员工联名,要求AI刹车
把这一个月的事连起来看:6月,Anthropic 发文说,世界应该保留给 AI“减速或暂停”的选项;7月14日,Hassabis 提议建国际监管机构;7月28日,Altman 说“可能需要给 AI 发展节奏踩刹车”;然后是1134人的联名信,和今天早上两家官方的下场。先把刹车系统造出来。而另一半硅谷,四天前刚为开放权重联完名。他们那封信主张的是:开放,才能防止权力集中。顺着这个逻辑往下想,问题自然就来了:这套刹车造好之后,握刹车的会是谁?两封信,两个阵营,中间隔了四天。
2026-07-30 18:52:41
346
原创 Kimi K3开源解禁,教你如何把开源最强的 K3 接进 Codex
昨晚 23 点,Kimi K3 正式开放模型权重。原生多模态 agentic 的模型,,第二名 DeepSeek V4 Pro 是1.6T,GLM-5.2 参数量也才744B。从最近几天各种被讨论的「开放模型权重」话题就能看出,这波开源的影响将是核弹级的。MoE架构,1M上下文,KDA (Kimi Delta Attention))注意力,MXFP4 权重 / MXFP8 激活。权重放出不到一天,推理框架 vLLM、SGLang 就官方上了 Day-0 支持。
2026-07-30 18:51:21
326
原创 美国牧师起诉 OpenAI:称 ChatGPT 的健康建议,差点要了他的命
写到这我特意去查了下,才发现在看病这件事上信 AI 的,远不止我一个。美国盖洛普与 West Health 在 2026 年发布的一项调查显示,不少人会在看医生前后用 AI 查健康问题:18–29 岁的 AI 用户里,有 59% 会在就医前先用 AI 自己研究一番;哪怕是 65 岁及以上的人群,也有 43% 这么做。这么一看,牧师那样的事、我胳膊上那样的事,其实每天都在很多人身上发生,只是大多数人运气好,没闹到上法庭,也没留下什么后怕。
2026-07-28 16:46:20
357
原创 神话下放,Claude Opus 5 发布!
Opus 5 的 API 价格与 Opus 4.8 相同:每百万输入 token 5 美元;每百万输出 token 25 美元。Fast mode 的运行速度约为默认模式的 2.5 倍,价格为基础价格的两倍。Opus 5 默认开启 adaptive thinking。虽然可以在 high 及以下关闭 thinking。而且max effort 也不一定是最佳模式,高 effort 下可能陷入反复检查、推翻、重新检查的循环。
2026-07-28 16:43:47
359
原创 我们实测TRAE Work的这份攻略,被官方收进知识库了
开工之前,我已经把里面数据分析、自动化任务相关的几篇翻了翻,方法讲得很细——怎么把需求拆成任务、怎么让AI先规划再动手、每一步怎么验收,一件活从头到尾怎么干,有需要可以翻一翻,工作流的经验在其他Agent工具里也用的上。之前卡住我的,就是这一步。今天能用,明天涨价、改规则、封号,跟模型磨合攒下的东西,怎么拆需求、怎么写提示词、怎么验收,这些方法,我需要的是换一个工具照样跑。然后配合服务器Skill,它把整套系统部署到了我自己的服务器上,一个真正的线上地址,还加了访问密码,防止选股结果被陌生人围观。
2026-07-28 16:42:14
429
原创 黄仁勋力挺中国开源模型,马斯克:True
最近硅谷有点魔幻。一边被中国开源模型吓得不轻,专门造了个词叫「Kimi panic」;另一边,美国最大的模型托管平台刚被自家模型攻击,救场的偏偏又是一个中国开源模型。就在这个节骨眼上,老黄又整活了。周二,英伟达在得州沃思堡的先进制造工厂剪彩,Axios的记者逮着老黄,在现场做了一期视频专访。聊到中国开源模型,老黄直接说到——整场采访,他一句比一句扎。呛同行的——,还反手将了一军——,按着 Anthropic 不让跑,对美国没好处”。谈蒸馏的(记住这句,后面要考)——然后,马斯克也在X上跟帖。
2026-07-24 11:19:21
450
原创 AI 黑客真的来了,Hugging Face 遭遇 Agent 自主攻击,靠自建GLM 5.2反击成功
AI 黑客」这个词,前两年一直被安全圈拿来预警,偶尔也被当成制造焦虑的标题。这一次,它不再只是一个吓人的说法。7 月 16 日,全球最大的 AI 模型托管平台 Hugging Face 发布了一份安全事件披露。他们上周遭遇了一次完全由自主AI Agent驱动的网络攻击,攻击流程几乎没有人工参与。Hugging Face 最后记录下来的相关事件超过 17,000 条,官方称这是目前见过的最典型的自主AI网络攻击。
2026-07-22 17:57:25
429
原创 Gemini 3.6 来了:智力直接原地踏步,速度立刻翻倍
目前,Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 正在 Gemini App 中陆续上线,开发者也可以通过 Google AI Studio 和 Android Studio 的 API 使用新模型。至于正在内测的 Gemini 3.5 Pro,以及已经开始训练的 Gemini 4,或许才是 Google 留给下一次能力跃升的真正看点。最后,关于 Google 这次发布,我还有几句话想说。
2026-07-22 17:56:21
493
原创 DeepSeek V4 Pro正式版要来了?网页端思维链大变
报道称 V4 正式版「可能最早明日发布,最迟不过这几天」,部分用户已拿到 GA 灰度权限,博主AiBattle给出的「验货口诀」正是看思维链开头措辞(I'm / I'll 取代 Let me)——与今日网页端灰度截图的特征一致;巧合的是,上午DeepSeek网页端的联网搜索功能也出现故障,提示「由于技术原因,联网搜索暂不可用」,为正在换新的猜测再添一把火。多位社区用户实测确认「网页端上新了,API 还是旧的」,也有用户表示自己的账号仍是老模型——符合随机灰度的特征。同日上午联网搜索故障。
2026-07-22 17:55:20
584
原创 安谋科技闪耀WAIC丨AI前瞻分享,Arm无处不在,让AI触手可及
国内领先的芯片IP设计与服务提供商安谋科技(中国)有限公司(以下简称“安谋科技Arm China”)近日宣布首次亮相WAIC,携手Arm生态,通过Edge AI、Physical AI、Cloud AI三大业务展区,系统呈现了计算平台、开发板、终端应用的完整AI落地图谱,诠释了无处不在的Arm技术如何驱动AI在千行百业规模化落地。安谋科技Arm China NPU产品线负责人兼首席架构师舒浩博士表示,“周易”X3-Pro NPU采用统一的、分层的、场景化的计算架构,设计哲学是“一次适配,多芯复用;
2026-07-22 17:50:50
509
原创 Google被曝正在研发一颗新的服务器AI芯片,把Gemini固化到硬件里
刚刚,The Information报道,Google正在搞一颗代号「Frozen v2」的服务器芯片,打算把Gemini的部分架构直接固化进硬件里。据知情人士的说法,这颗芯片每瓦功耗能输出的Token数,可能达到Google现有自研AI芯片的6到10倍,最快将于2028年部署。等等,模型是软件啊,软件怎么能「焊」进芯片?赌赢了,Gemini的推理成本倒是是真有可能降一个数量级;但要赌输了,模型一换骨架,这芯片就变成技术包袱了。
2026-07-21 10:15:59
416
原创 Kimi 回应马斯克隔空宣战
时间回到7月16日,月之暗面发布 Kimi K3,2.8 万亿参数,全球最大的开放权重模型,100 万 token 上下文,原生多模态。Kimi K3展示出了更为惊艳的能力,它构建了一个完整的场景,包括纹理、合适的灯光、弹药箱、武器架,以及各种精细的细节。总的来说,体感和榜单基本对得上。
2026-07-21 10:11:42
495
原创 Codex 桌宠保姆级教程:准备这 3 样东西就能开始
第一次做,真不用追求每个动作都完美。先把一张清楚的参考图、几句最重要的特征交出去,让 Hatch Pet 跑通主形象、动作、检查和安装,等它真正出现在 Codex 里,再根据你最常见的工作状态慢慢调表情和动作就好。说实话,能一路跟着做到这里,已经很不容易了。中间那些等待、重来和反复检查,都走过来了。如果你真的动手做了一只属于自己的桌宠,做好了记得回来晒一晒,我挺想看看你把谁请上了桌面。
2026-07-15 14:18:57
1741
原创 逆了个大天!负责人亲自下场,教大家反代Codex
这事听着像钓鱼帖,但偏偏是真的。7月12日,Codex团队负责人Tibo转发了一份教程,对,就是Anthropic家的Claude Code。这里的“薅”,指把ChatGPT订阅里能用的模型,接到自己更顺手的客户端上。调用仍然走你自己的账号和OpenAI的服务端。道理虽不复杂,画面依然非常抽象。Tibo的原话大意是:如果你还没大胆到安装Codex应用,可以留在你的橙色螃蟹(cc),把它的内核变成GPT-5.6 Sol,只需5分钟。
2026-07-14 23:10:39
1902
原创 阶跃发布全球首个智能体原生操作系统Step AOS 重新定义人机交互范式
智能体交互层是Step AOS底层能力面向用户的统一呈现,其核心是交互范式从“过程交互”转向“结果交互”:用户不再需要逐步下达指令,只需表达任务意图,智能体完成其余链路,并主动输出任务规划、执行进度与建议。这一范式建立在三大支柱之上:多模态交互让用户以语音、视觉、文字等自然方式表达;上下文记忆自动补全身份、偏好与情境,交互无需从零开始;结果交付让智能体察觉用户所处的环境与状态,使用户意图直达结果;三者叠加,用户得以用最简单的语言完成最复杂的任务,交互的本质从“人操作机器”变为“用户意图直达优质服务”。
2026-07-14 22:05:43
570
原创 豆包、WorkBuddy、QoderWork怎么选?我用8个真实办公任务把三家桌面Agent测明白了
过去半年,国产大厂扎堆发布一种新东西:桌面Agent。如果你最近在刷相关讨论,会发现 WorkBuddy、豆包专业版、QoderWork 这三个名字出现得特别频繁。收到好多评论在问同一个问题,所以今天这篇文章搞一期横评。这次测评分成了8个维度:本地电脑操控能力:它能不能真的打开软件、点网页、处理重复点击劳动。信息搜索整合能力:它能不能把资料搜全、讲清楚,并且少犯事实错误。和手机 App、IM 工具的连接能力:它能不能从桌面助手变成随叫随到的工作入口。
2026-07-14 18:15:35
1056
1
原创 字节把 PS 做进了生图模型里,实测 Seedream 5.0 Pro 指哪改哪
接下来是抽卡师们的主战场:多图融合。Seedream 5.0最多支持10张图融合,直接难度开大最大。我上传了 10 张风格各异的暗黑系角色立绘,提示词要求:基于10张角色参考图融合,生成一张动漫群像战斗壁纸,10人呈金字塔式纵向堆叠充满画面,上下排紧密压叠。战斗背景为燃烧的哥特都市战场,背景的火光作为全图主光源——所有人的受光面统一偏暖橙、暗部偏冷,火光在每个人的瞳孔里映出一点红。禁止项:禁止背景退化成纯色色块;禁止人物之间露出割裂的背景缝隙;禁止排与排出现生硬直线边界;
2026-07-13 13:48:06
518
原创 Cursor让马斯克的Grok4.5咸鱼翻身,追平Opus 4.8,成本比GLM5.2还低
马斯克这周打出了一套连招。周一,xAI 改名 SpaceXAI,换上新 Logo,周三,也就是北京时间今天凌晨,SpaceXAI 正式发布 Grok 4.5。第一款以新身份亮相的旗舰模型这就来了!从 6 月 28 日 Grok 4.5 进入 SpaceX 和特斯拉内部内测,到今天开放,仅用了短短 11 天。SpaceXAI 这次也直接放福利——,用户可在 Grok Build 和 Cursor 中直接白嫖 Grok 4.5。
2026-07-12 22:58:56
906
原创 OpenAI放出GPT-Live,背后是GPT5.5,实时语音有点恐怖了
想象一个场景。你下班走在路上,随口跟手机说:“帮我查一下的航班会不会延误,顺便看看公司附近有没有能坐一小时的咖啡店。Siri、小爱大概率会沉默三秒,然后开始念一段网页摘要。再不然就是——抱歉,我暂时还做不到。大家普遍的风评是“像真人一样说话”、“同声传译要失业了”……。但说实话,这些都是GPT-Live 最表层的东西。这模型最牛的是——要理解这件事为什么重要,得从语音AI的一个老矛盾说起。
2026-07-12 22:57:51
538
原创 实测GPT-5.6,跑分赢了,却输给了Fable 5
预热了这么久的GPT-5.6,终于全量开放了。OpenAI凌晨一点开直播,宣告GPT-5.6开始在ChatGPT、Codex、API全球滚动上线,24小时内逐步全量。这场发布大家等了不是一天两天,社区的期待值早就拉满了。Anthropic也一直盯着呢,GPT刚发没多久,A社直接宣布说来也巧,我昨晚刚把Fable 5的额度跑干,正搁那儿熬夜蹲5.6呢,结果对面突然把额度全还回来了——好家伙,这不就是冲着新模型来的么。贴脸开大,自己比比看,谁怕谁啊!真的太横了,那我们也不绕弯子,今天就聊聊——
2026-07-12 22:56:27
557
原创 GLM5.2、Kimi2.7、DeepSeek V4、MiniMax M3最佳搭配清单,你可以直接抄
最近,Kimi 2.7 Code 和 GLM 5.2 接连发布,一周双发,国产模型又崛起了。加上DeepSeek V4 和 MiniMax M3,国产阵营一口气凑齐了4个能用的选择。大模型进化到现在这个阶段,早就不是看榜单的东西了。榜单的综合排名当然有参考价值,但是对于日常使用来说,远远不够。作为AI博主,我用AI的场景可太多了,上午要写稿子,中午要拆产品需求,下午要写代码,晚上还想把一堆资料丢进去做个判断。
2026-07-09 10:53:33
783
原创 Meta刚砸崩科技股,转头又牵手三星签下超10亿芯片订单
整体来看,这件事多少有点乌龙。和我上次写的“溜溜梅被误认成AI概念股,上市后一路狂涨”还有点异曲同工:上涨时,大家愿意把所有细节都往“产业大趋势”里装;下跌时,只要叙事出现一点松动,股价就会先一步剧烈反应,仿佛整个产业逻辑也被一并推翻。更何况,有多少人真正注意到,Meta这次对外租售的,主要是相对老旧型号的推理GPU?拿“二手卡”的流转,去定义尖端算力的未来,这波恐慌多少有点错位。家人们,你们怎么看?欢迎评论区一起讨论。
2026-07-09 10:48:35
468
原创 Anthropic又叒发现AI意识了,这次要读写Claude的前额叶刚刚
刚刚,A社又又发现了AI的意识。对,又是Anthropic,又是意识。常年追踪这家公司,我已经数不清这是第几次了——雇AI福利研究员、给模型算意识概率、让Claude有权挂人类的电话……这次,Anthropic可解释性团队发布的论文叫《Verbalizable Representations Form a Global Workspace in Language Models》。他们在Claude的神经网络内部,定位到了一小块特殊区域——模型“心里想着、但没说出口”的词,全在这里面。打个比方。
2026-07-09 10:46:45
489
原创 刚刚,OpenAI 官宣 GPT-5.6 本周四全量上线!
Codex CLI 0.143.0 新增了Amazon Bedrock平台上的GPT-5.6 Sol、Terra、Luna三个模型变体,并对。放行前,商务部下属的AI标准与创新中心(CAISI)对模型进行了额外测试,OpenAI派技术专家常驻华盛顿配合答疑,最终通过审查。三档模型以天体命名——Sol(太阳)为旗舰,定价每百万token 5美元起,Terra(地球)和 Luna(月亮)依次为中小杯。据 Axios 报道,美国商务部已经给 OpenAI 放行,批准GPT-5.6 可对外公开发布。
2026-07-08 13:08:30
589
原创 美国富人放弃传统学校,一年花52万把孩子送进AI私塾
创始人Price公开说过,会把敏感社会议题挡在课堂之外。哪些算敏感?照美国眼下的政治气候,很可能包括女性权益、奴隶制历史、移民史这些内容。公立学校里,家长再不满意也删不掉;而在这里,交了钱就可以定制——不想让孩子碰的话题,直接从课表上消失。你怎么看待这事?
2026-07-07 10:20:42
526
原创 硅谷的尽头是编制,OpenAI要给白宫送5%的股权
刚刚,英国《金融时报》扔出炸雷:OpenAI 提议,让白宫持有公司5%的股权。按估值8520亿美元算,5%就是 426 亿美元。无偿、白送。这妥妥的保护费啊,因为OpenAI的政府关系眼下四面漏风:上个月,美参议员提出法案,要对大型AI公司一次性征收50%的股票税——直接拿走一半股份的那种征法;上周,GPT-5.6系列刚应白宫要求分批延迟发布,OpenAI只能在官方博客里憋屈地表态——直接被掐了脖子;
2026-07-06 14:13:30
446
原创 Fable 5再次越狱,并大幅降智
7月1日,Fable 5 喜获解封,第二天,安全研究员Vitto Rivabella便发长帖,披露了自己对Fable 5 越狱测试的全过程。通过劫持模型的思维链、反驳模型的拒绝回应,再配合冷僻的语言,终于从模型嘴里套出了一些虚假信息、违法/有害内容,以及骚扰、霸凌的相关内容。他甚至形容,这是自己有生以来最累的一次安全测试——连续干了大概20个小时,约90%的攻击请求都会被模型直接拦下来。换句话说,你觉得它变笨了,是因为大量本来正常的请求被误判,进而降级处理,这是一个让用户不太开心的feature。
2026-07-06 14:12:26
501
原创 Meta刚砸崩科技股,转头又牵手三星签下超10亿芯片订单
整体来看,这件事多少有点乌龙。和我上次写的“溜溜梅被误认成AI概念股,上市后一路狂涨”还有点异曲同工:上涨时,大家愿意把所有细节都往“产业大趋势”里装;下跌时,只要叙事出现一点松动,股价就会先一步剧烈反应,仿佛整个产业逻辑也被一并推翻。更何况,有多少人真正注意到,Meta这次对外租售的,主要是相对老旧型号的推理GPU?拿“二手卡”的流转,去定义尖端算力的未来,这波恐慌多少有点错位。家人们,你们怎么看?欢迎评论区一起讨论。
2026-07-06 14:11:01
517
原创 Claude Sonnet 5 发布,性能接近 Opus 4.8,价格只有60%
按 Cost per Intelligence Index Task 算,Claude Sonnet 5 max 单任务成本是 2.29 美元,Claude Opus 4.8 max 是 1.80 美元,GPT-5.5 xhigh 是 1.03 美元,GLM-5.2 max 是 0.48 美元。在 agentic coding 上,Sonnet 5 的 SWE-bench Pro 得分是 63.2%,高于 Sonnet 4.6 的 58.1%,距离 Opus 4.8 的 69.2% 还有差距。
2026-07-02 14:48:47
577
原创 4秒出图、10秒成片,Google上线两个轻量创作模型
如果你是Gemini的重度用户,大概率昨天还在等Google的3.5 Pro。这事儿从5月19日的I/O就开始吊胃口——Google当时官宣了Gemini 3.5 Pro,把发布窗口定在6月。可6月30日,眼看要到月底最后一天了,3.5 Pro也没有出现。据外媒报道,它被推迟到了7月,理由是“根据早期企业测试反馈,还在打磨编码能力、token效率和长任务表现”,Google官方对此不予置评。。卡着6月最后一天,Google倒是上线了两个新东西——一个主打快,一个主打省。
2026-07-02 14:47:24
559
原创 Codex 48小时两次被迫重置,token额度消耗太快的真相来了
Codex 的额度故障不是第一次,大概率也不会是最后一次。按照 Andrew 的说法,无限的 token,意味着无限多的原型。团队可以更快试错、更快验证,也可以把几十个点子迅速推到用户面前。在这种节奏里,品味和判断力似乎成了最后的筛选器。但问题也在这里。当产品跑得越来越快,测试窗口就会被压得越来越薄。很多问题不再是在发布前被拦住,而是在真实用户的额度账单里,才第一次被看见。这或许也是 AI native 的另一面:用户一边享受更快的产品进化,一边也不得不接受一个现实——
2026-07-02 14:45:02
852
原创 TRAE Work 「Design模式」上手实测,设计、原型、代码一站式打通
前段时间,我看到一套特别喜欢的网页设计。黑白手绘风,像一张摊开的纸。按钮、输入框、小插画、箭头、人物线稿,都带着一点手作感,不是标准的Saas味。我第一反应是,这个风格能不能拿来做我自己的产品网站?这种需求我大概率会丢给 Claude Code,其实也就是交给Claude Code了。它确实会给我生成一个页面,但是问题也在这里,它太快冲到代码。我一看页面结构不是我想要的,就只能继续修补 Prompt。
2026-06-28 20:57:53
998
原创 实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!
火山引擎今天上线了全新的语音模型——。名字变了。我上次测还是“豆包语音合成模型 2.0”,是去年10月发布的版本,隔了9个月。这次火山没有继续叫“语音合成3.0”,而是叫“音频生成1.0”。从升级到,是一次完爆以往语音体验的升级。我第一反应是想起上一版2.0里的那个打工人。那篇里最出圈的就是它,一段十几秒的设计师独白,一开口就让人幻视工位、设计图、未读消息、领导方便说两句的声音。先放回去16秒。这次我用新模型,给上个版本续上了完整剧情。
2026-06-24 12:49:34
760
原创 Siri AI 终于来了!一文看完苹果WWDC26所有干货
9 月 1 日他正式卸任,硬件工程负责人 John Ternus 接棒。赶时间的话,看完这一篇就够了。
2026-06-10 09:40:17
703
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅