大模型日报 2024-08-19

大模型日报

2024-08-19

大模型资讯

大模型产品

大模型论文

  1. RED-CT: 边缘分类器的系统设计方法
  • 摘要: 本研究提出利用LLM标注数据训练边缘分类器的方法,通过系统干预措施提升分类性能,适用于多种行业应用。
  1. 大语言模型能理解符号图形程序吗?
  • 摘要: 本文评估大语言模型对符号图形程序的理解能力,提出了基准测试,并通过符号指令微调提升模型表现。
  1. ScalingFilter: 无参照数据质量评估方法
  • 摘要: 提出ScalingFilter方法,通过两个语言模型困惑度差异评估数据质量,避免参照数据引入偏差,提升下游任务表现。
  1. 大语言模型在交通工程中的能力评估
  • 摘要: 本文评估了GPT-4、Claude 3.5等大语言模型在解决交通工程问题中的准确性、一致性和推理能力,揭示其优缺点。
  1. 基于层次嵌入的在线日志解析方法HELP
  • 摘要: HELP是一种在线语义日志解析器,利用LLM和层次嵌入模块实现高效日志分组和解析,显著提升准确率。
  1. ShareLM:开放人机对话数据集及插件
  • 摘要: ShareLM集合和插件旨在收集并开放人机对话数据,提供用户评价和隐私保护功能,促进模型开发和研究。
  1. 基于语言模型的仿人机器人自主行为规划
  • 摘要: 提出一种新型语言模型框架,使机器人在给定文本指令下自主规划行为并纠正任务执行中的失败,验证了其在仿人机器人任务中的有效性。
  1. BAM: 高效参数再利用提升专家混合模型
  • 摘要: 本文提出BAM方法,通过充分利用密集模型的FFN和注意力参数,提升专家混合模型的性能和效率。
  1. DaRec: 大语言模型与协同模型的解耦对齐框架
  • 摘要: 本文提出一种新颖的解耦对齐框架,通过投影层和表示正则化将大语言模型和协同模型的表示解耦为特定和共享组件,提升推荐任务性能。
  1. 隐蔽偏见:隐性与显性观点对比研究
  • 摘要: 研究隐性语言对大模型偏见放大的影响,发现大模型更偏向显性观点,需引入不确定性标记以提升可靠性。

大模型开源项目

  1. Fabric:增强人类的开源AI框架
  • 摘要: Fabric是一个用Go语言编写的开源框架,通过AI增强人类能力,提供模块化框架和众包AI提示解决问题。
  1. 微软模块化RAG系统
  • 摘要: 微软推出基于图的模块化检索增强生成(RAG)系统,使用Python编写,提升信息检索与生成能力。
  1. 轻量级深度学习库tinygrad
  • 摘要: tinygrad是一个用Python编写的轻量级深度学习库,结合了PyTorch和micrograd的优点,适合喜欢简洁和高效的开发者。
  1. SWE-agent:自动修复GitHub问题
  • 摘要: SWE-agent使用GPT-4或其他语言模型,自动修复GitHub问题。它在SWE-bench评估集中解决了12.47%的Bug,仅需1分钟。

本文由 mdnice 多平台发布

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值