百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 热门文章 > 正文

[0531] AI 也有偏爱??探索大语言模型的数字偏好 | xz-utils 5.6.2 发布

bigegpt 2024-09-02 16:16 7 浏览


AI 也有偏爱?探索大型语言模型的数字偏好

这是一个有趣的实验:

  • OpenAI GPT-3.5 Turbo 最喜欢 47
  • Claude 3 Haiku 最喜欢 42
  • Google Gemini 1.0 Pro 最喜欢 72

主要发现:

1.LLM 的选择与人类的随机数选择有相似之处:

  • 避免个位数
  • 偏爱 以7结尾 的数字
  • 很少选择重复数字

2.LLM 和人类都表现出对 某些数字的偏好

  • LLM 倾向于选择42、47、72、73等数字。
  • 人类也倾向于选择以 7 结尾的数字,认为它们更“随机”。

3.LLM 和人类都避免选择某些类型的数字。

  • LLM 很少选择个位数、以0或5结尾的数字、重复数字。
  • 人类也倾向于避免这些类型的数字,认为它们 “不够随机”。

具体例子:

  • 以7结尾的数字:LLM 和人类都认为以7结尾的数字(如37、47、77)更“随机”。
  • 个位数:LLM 和人类都倾向于避免选择个位数,认为它们过于简单
  • 重复数字:LLM 和人类都倾向于避免选择重复数字(如11、33、88),认为它们过于规律

可能的原因:

  • 文化影响:某些数字在文化中具有特殊含义,例如 42 在《银河系漫游指南》中代表着生命的意义。
  • 认知偏差:人类和LLM都可能受到认知偏差的影响,例如认为以7结尾的数字更“随机”。

结论:

LLM 在选择随机数时表现出的模式表明,它们可能在一定程度上学习了人类的数字偏好。这为我们研究LLM 的内部机制和认知能力提供了有趣的视角。

关于这个实验的介绍,以及分析,请查看:

https://gramener.com/llmrandom/



xz-utils 后门事件之后,首个主要版本 5.6.2 发布

xz-utils 5.6.2 版本于 2024-05-29 发布,本次更新主要包括以下内容:

重要安全更新

  • 移除后门程序 (CVE-2024-3094): 此版本移除了此前版本中发现的后门程序,强烈建议所有用户升级到此版本。

其他更新:

1. liblzma:

  • 修复了 lzma_index_decoder()lzma_index_buffer_decode() 函数在参数无效时,输出指针未初始化的问题。
  • 修复了 lzma_str_to_filters() 函数输出指针未初始化的问题。
  • 修复了函数指针类型不符合 C 标准的问题。
  • 移除了 GNU 间接函数 (IFUNC) 支持,以降低代码复杂度。
  • 针对 ARM64 架构的 FreeBSD 系统,添加了 CRC32 指令集支持的错误检查。
  • 修复了使用 NVIDIA HPC SDK 构建的问题。

2.xz:

  • 修复了 --block-list 参数解析过程中,空指针算术运算导致的 C 标准符合性问题。
  • 修复了 GNU groff 处理 man 页面时出现的警告信息。

3.xzdec: 增加了对 Linux Landlock ABI 版本 4 的支持。

4.Autotools 构建系统:

  • 现在可以使用 --enable-symbol-versions 选项覆盖默认的符号版本控制方案。
  • 增加了新的配置选项 --enable-doxygen,用于启用使用 Doxygen 生成和安装 liblzma API 文档。

5.CMake 构建系统:

  • 修复了 Linux Landlock 支持检测的代码问题。
  • 在非 glibc Linux 系统上禁用符号版本控制,以与 Autotools 构建行为保持一致。
  • 现在可以通过设置 SYMBOL_VERSIONING 变量为 "OFF""generic""linux" 来覆盖默认的符号版本控制方案。
  • 增加了对所有测试用例的支持。
  • 将测试相关的 CMake 代码分离到 tests/tests.cmake 文件中。
  • 增加了 ENABLE_DOXYGEN 选项,用于启用使用 Doxygen 生成和安装 liblzma API 文档。

6.文档:

  • 从软件包中移除了 Doxygen 生成的 liblzma API 文档,现在可以通过配置选项或 CMake 选项来选择是否生成和安装 API 文档。
  • 移除了 API 文档中使用的 XZ logo。
  • 从源代码包中移除了 PDF 格式的 man 页面,但仍然可以在构建时使用 make pdf 命令生成 PDF 格式的文档。
  • 更新了项目主页的 URL 地址。
  • 更新了维护者信息。

7.测试:

  • tests/files/README 文件中,解释了如何重新创建 ARM64 架构的测试文件。
  • 移除了两个使用 x86 和 SPARC 架构目标文件作为输入文件的测试用例。
  • 改进了一些测试用例。

数据支撑:

  • 此版本包含自上一个版本以来的 209 个提交。
  • 此版本发布说明由 Lasse Collin (Larhzu) 发布,并使用其 GPG 密钥进行了签名验证。
  • 此版本发布说明的 GitHub 页面获得了 35 个用户的反馈,其中包括 10 个点赞、25 个庆祝、9 个爱心和 6 个火箭表情。

总结:

本次更新移除了此前版本中发现的后门程序,并进行了一些 bug 修复和改进,建议所有用户升级到此版本。

以上文章采用 Gemini Pro 1.5 生成摘要,命令如下:

x jina r 'https://github.com/tukaani-project/xz/releases/tag/v5.6.2' |  \
  @gemini -t 0 --model gemini-1.5-pro-latest '主要针对 2024-05-29 xz-utils 5.6.2 发布,以大纲方式生成一份摘要,列举更多的数据支撑,用中文'


更多内容请查阅 : blog-240531


关注官方微信公众号:oh my x

获取开源软件和 x–cmd 的最新用法

独家资讯

相关推荐

LangChain4j如何自定义文档转换器实现数据清洗?

LangChain4j提供了3种RAG(Retrieval-AugmentedGeneration,检索增强生成)实现,我们通常在原生或高级的RAG实现中,要对数据进行清洗,也就是将外接...

Java 8 Stream API 详解(java stream.)

Java8StreamAPI详解一、概述在Java8中,StreamAPI是一个重要的新特性。它为处理集合(如List、Set等)中的元素提供了一种高效且富有表现力的方式。Str...

Java修炼终极指南:185 使用 Stream 过滤嵌套集合

这是面试中的一个经典问题,通常从一个模型开始,如下所示(我们假设集合是一个List):publicclassAuthor{privatefinalStringname;pri...

java8的stream使用小示例(java stream())

据JetBrains发布的2021年开发者生态系统调查,Java8在java使用的版本中仍然是当前最流行的版本。72%的专业开发人员使用Java8作为其在java开发中主要编程语言版本。现...

Node.js Stream - 实战篇(node.js in action)

本文转自“美团点评技术团队”http://tech.meituan.com/stream-in-action.html背景前面两篇(基础篇和进阶篇)主要介绍流的基本用法和原理,本篇从应用的角度,介...

Java Stream:集合处理的api(java 集合操作)

JavaStream流:高效集合处理的函数式编程利器一、什么是JavaStream?Java8引入的StreamAPI是一套用于处理集合数据的流式编程接口,通过函数式风格(无副作用的...

去除 List 中的重复元素,你知道几种实现方法?

去除List中重复元素,这在实际编程或面试中经常遇到,每个人都有习惯的写法吧,这里抛砖引玉,汇总了一些实现方案,开拓思路。准备数据假设数组中有10个数据,可能有重复,需要将重复的数据从数组中去掉。pu...

Java开发者必看!Stream流式编程10个爆款技巧,让你代码优雅飞起

为什么你的Java代码总像拧巴的麻绳?掌握这10个Stream实战技巧,代码效率与优雅度将产生质的飞跃。以下案例均来自真实电商系统场景,带你感受流式编程的降维打击!一、过滤与映射组合拳(Filter...

leetcode每日一题之存在重复元素(存在重复元素 iii)

题:给定一个整数数组,判断是否存在重复元素。如果存在一值在数组中出现至少两次,函数返回true。如果数组中每个元素都不相同,则返回false。比如:输入:[1,2,3,1]输出:true...

告别for循环!揭秘Stream API如何让你的代码简洁度提升300%

一、当传统循环遇上现代需求真实场景复现:某电商平台需要处理10万条订单数据,要求:筛选出金额>500的订单提取用户ID并去重统计VIP用户数量传统实现方案://常规写法Set<Long...

Java中List去重的N种方法:从基础到优雅

Java中List去重的N种方法:从基础到优雅在日常的Java开发中,我们经常会遇到需要对List集合去重的情况。无论是为了清理重复的数据,还是为了优化算法性能,掌握多种去重方式都是一项非常实用的技能...

Java Stream流没用过?常用高频方法

概念Stream流是Java8添加的以一种链式调用的方法处理数据,主要侧重于计算。具有以下相关特点代码简洁链式调用Stream常用方法1.将数组变为当作List操作String[]strArr=...

核医学专业名词索引(M-R)(核医学重点归纳)

M吗啡(morphia)埋藏式心律转复除颤器(implantablecardioverterdefibrillator,ICD)麦角骨化醇(VD2,calciferol)脉冲堆积(pulsepi...

CodeMeter 新版发布(codesigner下载)

威步于2022年8月4日发布CodeMeter7.50及CodeMeter软件保护套装11.10,以下为新版内容。CodeMeterRuntime7.50StreamingSIMDExten...

世界上最小的五轴铣床Pocket NC(最小的五轴加工中心)

PocketNC,由MIT学生研制,还有说法是这款产品的设计者是来自美国蒙大拿州的一对极客夫妻。目前主要有两款产品:PocketNCV2-50,9000美元;PocketNCV2-10,60...