metadata

标签

Cards List
#metadata

如何为您的博客文章获取DOI

Lobsters Hottest · 昨天 缓存

本文提供了一份指南,介绍如何为博客文章获取数字对象标识符(DOI),以提高其在学术研究中的可引用性,讨论了方法、好处和潜在问题。

0 人收藏 0 人点赞
#metadata

构建网页代理让我意识到多少上下文被浪费在不良 URL 上。你是如何过滤爬取的?

Reddit r/AI_Agents · 2026-08-24

作者讨论了网页代理在爬取不良 URL 时上下文窗口浪费的问题,并询问如何使用元数据来过滤爬取以提高效率。

0 人收藏 0 人点赞
#metadata

我们总把AI模型称为"开放",但整个生态系统却依赖于某一家公司的服务器。在座各位,难道不觉得这有点矛盾吗?

Reddit r/ArtificialInteligence · 2026-08-18

作者讨论了过度依赖单一公司服务器进行AI模型分发与元数据存储的问题,指出了开源AI生态中的中心化风险,并呼吁社区共同探讨应对策略。

0 人收藏 0 人点赞
#metadata

@tom_doerr: 使用 Paperlib 整理研究文献库并提取论文元数据。https://github.com/Future-Scholars/paperli…

X AI KOLs Timeline · 2026-08-10 缓存

Paperlib 是一款开源学术论文管理工具,可帮助研究人员整理文献库、抓取论文元数据,并提供基于 LLM 的摘要生成与语义搜索扩展。

0 人收藏 0 人点赞
#metadata

@DanKornas: 需要一个轻量级的公开参考,用于 LLM 模型架构元数据,而无需部署整个网站实现…

X AI KOLs Timeline · 2026-08-10 缓存

DanKornas 重点介绍了 LLM Architecture Gallery 仓库,该仓库通过 models.yml 为画廊卡片发布每个模型的元数据,作为轻量级的公共数据导出。

0 人收藏 0 人点赞
#metadata

@Greptime:什么是可观测性本体?你的AIOps工具一直说“扩容”,真正原因是一个每周备份任务消耗了……

X AI KOLs Following · 2026-07-22 缓存

GreptimeDB引入了一个语义层,保留了通常会在摄取时丢弃的OTLP元数据(仪器类型、单位、时间性),使AIOps工具和LLM代理能够理解系统拓扑,而无需从列名猜测。

0 人收藏 0 人点赞
#metadata

AgentFAIR:面向地理空间数据集FAIR原则评估的多智能体协作框架

arXiv cs.AI · 2026-07-20 缓存

AgentFAIR是一个多智能体框架,利用LLM评估器和批评者来评估地理空间数据集的FAIR合规性,在专家研究中实现了89%的子原则一致性和Fleiss κ=0.71,每个数据集成本为0.054美元。

0 人收藏 0 人点赞
#metadata

使用LLM陪审团构建食品元数据

Hacker News Top · 2026-07-14

一种使用LLMs作为评审团来构建或验证食品元数据的方法,提高了数据质量和一致性。

0 人收藏 0 人点赞
#metadata

@github: 借助 GitHub Issue Fields,你可以向问题添加结构化、类型化的元数据(如优先级、工作量、日期和自定义值)……

X AI KOLs Timeline · 2026-07-12 缓存

GitHub Issue Fields 现已全面上市,允许用户向跨仓库的问题添加优先级、工作量、日期等结构化元数据。

0 人收藏 0 人点赞
#metadata

揭示AI生成图像的元数据

Reddit r/artificial · 2026-07-08

文章讨论了如何利用元数据来揭示图像是否为AI生成,并重点介绍了一种检测合成内容的方法。

0 人收藏 0 人点赞
#metadata

IonSense-QKG:面向锂离子电池数据集发现的量子就绪元数据框架

arXiv cs.LG · 2026-07-03 缓存

本文介绍了IonSense-QKG,这是一个元数据框架,通过添加量子就绪字段和加权量子就绪分数来丰富公开的锂离子电池数据集,以便对数据集进行排序,用于近期的混合量子-经典机器学习。

0 人收藏 0 人点赞
#metadata

真正推动Genie进步的关键因素

Reddit r/AI_Agents · 2026-07-01

关于为销售/管道数据搭建Genie AI自然语言查询工具的实用技巧,强调精心策划的示例SQL和元数据比自由文本指令更有效。

0 人收藏 0 人点赞
#metadata

@dSebastien: 我在 Obsidian 中运行超过20,000条笔记的实时仪表盘。没有电子表格,没有手动更新。我更改一条笔记的一个属…

X AI KOLs Timeline · 2026-06-26 缓存

一篇博文,展示了如何使用 Obsidian Bases,将超过20,000条笔记的仓库视为数据库,并利用一致的元数据,创建实时、自动更新的仪表盘。

0 人收藏 0 人点赞
#metadata

大型语言模型中地理条件作用的意外影响

arXiv cs.CL · 2026-06-17 缓存

本文识别并分析了LLM中的“位置泄漏”现象,即地理条件作用导致模型即使在与位置无关的提示中也过度依赖位置元数据,揭示了超出内容的结构性条件作用效应。

0 人收藏 0 人点赞
#metadata

你最终使用 OC 完成了哪些炫酷的非编程项目/任务?

Reddit r/openclaw · 2026-06-16

一位用户分享了他们如何利用 Codex 和 DeepSeek Flash 自动整理大型 ROM 合集,包括获取封面艺术、资源文件和元数据,并将其存储到 RomM 中。

0 人收藏 0 人点赞
#metadata

将SQLite结果列映射回其源 `表.列`

Simon Willison's Blog · 2026-06-13 缓存

本研究探索了在任意SQLite查询中,确定每个结果列的源表和源列的方法,通过使用SQLite内部列元数据API(通过Python的apsw库或ctypes桥接访问),并应用于Datasette等工具。

0 人收藏 0 人点赞
#metadata

@vintcessun: RAG喂太多文档,检索质量反而从75%掉到40%?向量搜索被大量无关内容稀释,真实部署中命中率暴跌。 问题根源:异构文档混在一起检索,噪声淹没了信号。多智能体编排看似智能,实际引入精度-忠实度悖论——配置稍差就两头不讨好。 论文提出的MA…

X AI KOLs Timeline · 2026-06-13 缓存

This paper identifies 'vector search dilution' in RAG systems when scaling to large heterogeneous document collections, where accuracy dropped from 75% to 40% in a real-world deployment. The proposed MASDR-RAG method uses domain scoping via organizational metadata before retrieval, improving P@10 from 0.77 to 0.86 with low cost and easy deployment.

0 人收藏 0 人点赞
#metadata

@mixedbreadai: 新功能:Metadata explorer 为文件添加元数据可在搜索时实现过滤。现在,您可以浏览元数据字段和值…

X AI KOLs Following · 2026-06-10 缓存

mixedbread.ai 推出了 Metadata explorer 功能,允许用户浏览其存储中的元数据字段和值,从而在搜索时实现更精细的过滤。

0 人收藏 0 人点赞
#metadata

Exif 详解

Hacker News Top · 2026-06-09 缓存

一份详细的技术指南,解释 Exif 元数据结构、它如何存储在 JPEG 及其他图像格式中,以及针对处理图像像素数据的开发者的实用注意事项。

0 人收藏 0 人点赞
#metadata

为什么.NET中的自定义属性让我噩梦连连

Lobsters Hottest · 2026-05-31 缓存

一位开发者吐槽.NET自定义属性在二进制元数据层面的糟糕设计,解释了它们的存储方式以及为何会引发问题。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈