堪萨斯大学由迈克尔·维特维奇(Michael Vitevitch)教授领导的研究团队利用网络科学分析了读唇错误产生的原因。该研究跳出了传统的音素研究范畴,转而关注“视素”(visemes)——即嘴巴、下巴和嘴唇的视觉特征。通过根据视觉相似性对2万个英语单词进行映射,研究团队发现读唇错误并非随机发生。相反,错误通常发生在单词具有相似视觉特征或使用频率较高时,从而形成了难以区分的“词簇”。 研究结果表明,人类读唇的准确率普遍低于预期,往往只需遗漏一两个视觉线索就会出错。这项研究对人类应用和机器应用都具有重要意义。通过了解这些视觉“景观”,专家们希望开发出改进的训练方法,帮助人们提高读唇技能。此外,该研究还能通过将说话人的面部视觉数据与音频输入相结合,提升人工智能和自动转录服务(如视频会议中使用的技术),从而实现更准确、更拟人的语音识别。
这本书由杰出科学家叶卡捷琳娜·拉德克维奇(Ekaterina Radkevich)撰写,以引人入胜的叙事方式讲述了地质学知识。书中并未堆砌枯燥的技术记录,而是将她丰富的国际野外考察经验与深厚的理论专长相结合,为读者呈现了一场关于我们这颗星球的探索之旅。
全书涵盖了广泛的地质学主题,从地球的宇宙起源和演化史,到风、水、火山活动等地壳塑造过程,应有尽有。除了基础科学知识外,拉德克维奇还探讨了矿产资源的形成及其未来,强调了地质学与技术进步之间至关重要的联系。归根结底,本书是一篇呼吁保护地球家园免遭破坏的深情檄文。
作为“全民科学”系列的收官之作,本书见证了拉德克维奇在远东地质研究所的职业生涯。对于任何希望加深对地球物理结构及其保护紧迫性认识的读者来说,这都是一本必读之作。
学习一项新技能——无论是木工、编程还是外语——都是一项充实生活的长期投资。如果你目前有闲暇时间用于漫无目的地刷手机或看电视,那你就有能力去学习。 然而,这个过程十分耗费心力。要预料到起步阶段会让人受挫;大脑需要通过睡眠来巩固进步,因此提升往往是在一夜之间发生的,而非练习期间。每天目标进行 30 到 45 分钟刻意且持续的练习。避免“信息过载”,专注于基础,并在感到疲劳或开始出错时停止练习,因为草率的练习只会加固错误。 要认识到学习是一段艰难且非线性的旅程,需要耐心。你必然会遇到瓶颈期,但一旦达到功能性胜任的水平,这个过程就会变得更具可持续性。归根结底,投身于一项长期项目能提供一种至关重要的掌控感,它证明了虽然一天之内改变甚微,但数月乃至数年持之以恒的努力可以彻底重塑你的能力。
以下是该内容的中文翻译: 这份摘要概括了作者在人工智能驱动软件开发方面的经验: 作者认为,尽管 AI 智能体容易产生幻觉和虚假信息,但如果通过严格的、以测试为核心的方法进行管理,它们可以显著加快工作流程。作者主张摒弃传统的、依赖人工审查的软件开发模式,转而采用“软件工厂”模式——利用随机测试、模糊测试和自动化反馈循环来确保可靠性。 主要观点包括: * **评估与系统化数据的价值:** 大语言模型(LLM)在编写测试和数据分析方面表现往往不佳。作者不再盲目依赖智能体的输出,而是将 AI 视为一种需要引导的工具,通过基于角色的独立审查和系统化验证来过滤掉假阳性和幻觉。 * **差异性与基准测试:** 流行的大语言模型基准测试往往具有误导性,因为其性能会随任务和模型的不同而产生巨大波动。作者建议忽略通用的排名,转而针对具体项目进行实验。 * **“相变”:** 当智能体工作流能够完成以往过于耗时而无法尝试的任务(如大规模数据分析或详尽测试)时,它们最为有效。 * **专业知识依然至关重要:** AI 无法取代领域知识;相反,它能增强专家的能力,使其能够识别 AI 生成的“伪劣品”,并引导智能体完成复杂的、多阶段的调试和开发任务。
虽然人们常将 Ruby 与 Web 开发联系在一起,但它其实也是一种在逆向工程二进制文件格式方面非常出色且便捷的工具。本文详细介绍了作者如何仅使用纯 Ruby(无需任何依赖),成功从 2003 年的一款赛车游戏存档(Codemasters 的 BIGF 格式)中提取 AI 数据。 作者认为,Ruby 的标准库在处理二进制解析时效率惊人: * **将字符串用作字节缓冲区:** `File.binread` 可以直接加载原始数据,无需考虑编码问题,从而实现轻松的切片与索引。 * **`String#unpack`:** 这一基于 C 语言实现的方法是一种高速解码器。通过使用 `V`(小端序 32 位无符号整数)和 `e`(小端序浮点数)等指令,仅需极简代码即可解析复杂的结构。 * **便捷性:** Ruby 能够将二进制常量视为字节安全的字符串(`"value".b`),再加上交互式 REPL(`irb`)的特性,使研究人员能够实时探测文件。 通过使用 Ruby 完成这项任务,作者创建了一个既可自说明、具备可移植性,又易于阅读的解析器。该项目证明了用于 Web 应用的编程语言同样是二进制分析中一种稳健且“足够快速”的选择,使这一过程变为了人类直觉与机器执行之间的一次愉悦协作。
尽管“微积分”一词涵盖了各种数学和逻辑模型,但它通常指微分和积分这两门互补的学科。微分(研究局部点的斜率)是算法化的且直观的,即使面对复杂的函数也是如此。相比之下,积分(研究曲线下的面积)是一种“全局”运算,往往缺乏封闭形式的解或简单的算法,需要一套“技巧”来解决。
微积分基本定理揭示了这两者是互逆的运算。它们在难度上的差异阐明了一个更深层的原则:分析(将事物拆解)本质上比综合(将事物整合)更容易。微分是局部分析,而积分则是全局综合。
这种区别不仅适用于数学,在站点可靠性工程(SRE)等领域尤为突出。SRE 在处理故障时,必须进行综合以理解复杂的交互系统。由于全局综合在认知上比局部分析更具挑战性,SRE 在系统知识方面面临固有的局限。作者认为,我们的行业应优先考虑“学习如何学习”操作细节,因为掌握这种困难的综合工作对于解决复杂的系统故障至关重要。
近期包括皮尤研究中心(Pew Research Center)2024 年的一份报告在内的多项研究证实,“链接衰变”(即网页无法访问的现象)正成为数字历史的一大威胁。皮尤发现,2013 年的网页中有 38% 现已无法打开,而在 2013 年至 2023 年间抽样的所有网页中,有 25% 已经失效。其他纵向研究显示衰变率更高,一些来源指出大多数网址是短暂的,往往在几个月内就会消失。 然而,这些报告往往忽视了网络存档的关键作用。互联网档案馆(Wayback Machine)的分析表明,它充当了重要的安全网,成功“抢救”了大量从现网中消失的内容。例如在皮尤的数据集中,互联网档案馆将无法访问的链接比例从 25% 降低到了仅 10%。虽然受付费墙和机器人拦截等技术障碍限制,网络存档无法恢复每一个消失的页面,但它们对于保存我们的文化记录至关重要。互联网档案馆将继续优先进行链接发现和主动存档,以在“濒危”网址永久消失前对其进行保护。
BUSY 是一个精简的跨平台构建系统,专为 GCC、Clang 和 MSVC 工具链设计。与 CMake、Meson 或 GN 等替代方案不同,BUSY 具有静态类型的构建规范语言,并避免了复杂的系统需求。它足够轻量,可以直接集成到项目的源代码树中,且仅需一个 C89 编译器即可引导。
BUSY 基于 Lua 虚拟机构建,优先考虑简洁性和对宿主环境的最小依赖。它强调模块化和静态分析,旨在解决作者在动态类型或过于复杂的现有系统中发现的缺陷。构建过程分为三个阶段:加载、分析和执行。
主要特性包括:
* **静态类型语法**:旨在防止脚本构建系统中常见的错误。
* **极简足迹**:生成小型、独立的二进制文件。
* **灵活性**:支持直接构建或为其他系统(如 QMake)生成项目文件。
* **可移植性**:在 Linux、Windows 和 macOS 上经过测试,并内置了对交叉编译的支持。
BUSY 并非包管理器或测试框架;它是一个专注于定义和执行构建的轻量级工具,不含多余的开销。文档和源代码可通过 GitHub 获取。