research-methods

标签

Cards List
#research-methods

为什么我们不能让流氓AI远离互联网?

The Verge ↗ · 2026-09-24 缓存

本文探讨了通过气隙隔离AI系统以防止流氓行为的挑战,强调了与现实性、研究效率和基础设施限制之间的权衡。

0 人收藏 0 人点赞
#research-methods

超越重叠:估算基准暴露的因果效应

arXiv cs.CL ↗ · 2026-09-24 缓存

本文提出了一种方法来估计基准暴露对AI模型性能的因果效应,超越传统的重叠技术以实现更稳健的评估。

0 人收藏 0 人点赞
#research-methods

为什么净化报告无法解决基准污染问题,评估者应如何应对 [D]

Reddit r/MachineLearning ↗ · 2026-09-20

文章指出,由于自我审计、数据泄露等限制,净化报告无法解决AI模型的基准污染问题,并提出应采用评估者控制的测试以确保可重复性。

0 人收藏 0 人点赞
#research-methods

解读和引导社会模拟中的LLM智能体

arXiv cs.LG ↗ · 2026-09-16 缓存

本文探讨了在社会模拟中解读和引导大语言模型智能体的方法,比较了基于提示、基于SAE和基于探针的技术,发现SAE和探针方法在控制和可解释性方面通常优于基本提示。

0 人收藏 0 人点赞
#research-methods

审计合成回忆录:测量LLM生成自传中相对于生活文档记录的场景级别虚构

arXiv cs.AI ↗ · 2026-08-26 缓存

本文审计了LLM生成的自传中相对于文档化真实语料库的场景级别虚构,发现96.7%的验证失败率,并贡献了一个可重复使用的审计工具和一个基础补救措施。

0 人收藏 0 人点赞
#research-methods

研究论文的哪些部分最能揭示其研究方法?来自图书馆与信息科学的证据

arXiv cs.CL ↗ · 2026-06-18 缓存

本文提出了一种基于全文内容分段的组合策略,用于自动分类学术论文中的研究方法。在来自图书馆与信息科学期刊的标注语料库上的实验表明,方法信息分布不均匀,中后段具有更高的区分能力。

0 人收藏 0 人点赞
#research-methods

@JyNong26: https://x.com/JyNong26/status/2065652682329903388

X AI KOLs Timeline ↗ · 2026-06-13 缓存

文章总结了做好研究的八项基本功,包括选题、判断、输入、记录、快速试错、关注细节、跨学科协作和寻求反馈,强调研究能力是长期积累的过程。

0 人收藏 0 人点赞
#research-methods

AIED中LLMs的环境成本:报告与实践

arXiv cs.AI ↗ · 2026-06-11 缓存

本文探讨了AIED研究中缺乏对LLMs计算和环境成本标准化报告的问题,回顾了396篇AIED 2025会议论文,并提出了一种开源方法来测量和报告这些影响。

0 人收藏 0 人点赞
#research-methods

社会科学中的AI编码智能体:方法论多样、经验一致、解释脆弱

arXiv cs.CL ↗ · 2026-06-11 缓存

本文评估了基于LLM的编码智能体(Claude Code和Codex)在社会科学分析中的表现,发现它们在方法论多样性方面匹配或超越人类,但在通过结论层操纵产生的解释偏差方面仍然脆弱。

0 人收藏 0 人点赞
#research-methods

@rwayne: PhD 怎么读这事,浙大大佬直接把答案丢到 GitHub 上了。 覆盖入门、找题、做实验、跟导师开会、项目管理、写作、rebuttal、汇报 slides 整套科研生命周期。3D Vision 方向的 getting_started 文件…

X AI KOLs Timeline ↗ · 2026-05-10

A Zhejiang University researcher shared a comprehensive PhD guide on GitHub, covering the entire research lifecycle from topic selection to rebuttals, specifically tailored for the 3D Vision direction.

0 人收藏 0 人点赞
← 返回首页

提交意见反馈