标签
本推文介绍了Cloudflare提供的多种开发功能,包括对象存储R2、后端API Worker、AI网关AI Gateway、容器、缓存KV、数据库D1和PostgreSQL连接HyperDrive等,强调其价格便宜、功能丰富且免费额度充足。
本文对比了在大服务器上现代PostgreSQL(版本15-19)和MySQL 8.4的写入密集型sysbench性能,发现InnoDB通常在写入吞吐量方面优于PostgreSQL,且变化较小。
中国开源了 Zvec,这是一种进程内向量数据库,无需服务器即可在应用内部运行,支持毫秒级搜索数十亿向量,并已在阿里巴巴规模下经受了实战考验。
一款免费的开源工具,可在浏览器本地将 SQL CREATE TABLE 语句转换为交互式实体关系图,支持多种 SQL 方言。
本研究探索了在任意SQLite查询中,确定每个结果列的源表和源列的方法,通过使用SQLite内部列元数据API(通过Python的apsw库或ctypes桥接访问),并应用于Datasette等工具。
Oracle 的 AI 数据库现在包含了用于基于嵌入的图像搜索的向量存储功能,展示了创新特性,使其成为一个统一的数据存储解决方案。
Soma-SQL提出了一种自主方法,利用合成查询日志和歧义驱动的执行探测,解决自然语言到SQL翻译中的多源歧义问题,在执行准确率上比最先进的基线平均提升13%。
PgDog 是一个开源代理,使 Postgres 实现水平扩展,已从 Basis Set、YC 等机构获得 550 万美元融资。该工具已在生产环境中每秒处理超过 200 万次查询。
ICE否认拥有抗议者数据库,但一封致国会的信显示,该机构收集参与抗议活动者的信息,包括未被逮捕者,而人们担忧美国公民受到监视。
GitHub 上有一个精心收集的数据工程师面试题库 data-engineering-interview-questions,收录了超过 2000 道题,覆盖数据库、大数据框架、云平台、数据可视化等核心方向。
PostgreSQL 文档介绍了属性图(Property Graphs),这是一种 SQL/PGQ 特性,允许使用图模式匹配语法查询关系数据,并将其定义为基于表的只读视图。
介绍了UniQL,这是一个经过人工验证的可执行基准测试,用于跨方言文本到SQL评估,解决了像Spider和BIRD等现有基准测试中缺乏方言多样性的问题。
Erxi 在贡献了包括 meta KV 写入保护、flush 原因传播以及 CSV COPY 修复等多项改进后,被欢迎成为 GreptimeDB 的新提交者。
本文对项目管理工具 Linear 如何实现快速性能进行了技术剖析,通过使用浏览器端数据库(IndexedDB)、本地优先变更和同步引擎,消除了用户交互中的网络延迟。
本文解释了如何利用延续传递风格(CPS)来融合数据库操作符,避免中间结果物化并提升性能,作为向量化和编译的替代方案。作者通过一个数值列表操作的简化示例进行说明,并描述了其灵感来源于一篇短文。
微软开源了pg_durable,这是一个PostgreSQL扩展,支持长时间运行的SQL函数的持久化执行,具有自动检查点和容错恢复功能。
PostgreSQL 19 通过新的 contrib 模块 pg_plan_advice 和 pg_stash_advice 引入了查询提示功能,结束了长期以来的社区争论,并为 DBA 提供了应对优化器边缘情况的应急方案。