行业动态
Hacker News
重要度: 9
MIT发布禁止AI使用的开源许可,引发争议。
行业动态
Hacker News
重要度: 8
一个讽刺AI夸大宣传的幽默指数。
行业动态
Hacker News
重要度: 8
讨论纽约市AI招聘审计法规的影响。
行业动态
Hacker News
重要度: 7
探讨AI进步速度是否呈指数增长。
行业动态
Hacker News
重要度: 7
稳健业务比AI炒作更持久的原因。
行业动态
Hacker News
重要度: 6
用户讨论当前AI算法的痛点。
行业动态
Hacker News
重要度: 5
推荐学习AI的阅读资料。
行业动态
Hacker News
重要度: 4
谷歌提供Common Lisp和机器学习实习岗位。
行业动态
Hacker News
重要度: 3
一家初创公司通过卖书筹集资金。
行业动态
Hacker News
重要度: 2
一篇关于AI未来天才的夸张博客。
行业动态
Hacker News
重要度: 1
一个生物信息学相关帖子。
行业动态
Hacker News
重要度: 1
讨论NLP、AI、ML、机器人是趋势还是未来。
学术论文
ArXiv
重要度: 9
提出RA-RFT框架,通过检索增强强化微调教模型类比推理,在数学基准上显著提升。
👨🔬 Zilin Xiao, Qi Ma, Chun-cheng Jason Chen, Xintao Chen, Avinash Atreya, Hanjie Chen, Vicente Ordonez
学术论文
ArXiv
重要度: 8
提出SpatialClaw框架,以代码为动作接口,在20个空间推理基准上平均准确率59.9%,领先近期方法11.2点。
👨🔬 Seokju Cho, Ryo Hachiuma, Abhishek Badki, Hang Su, Byung-Kwan Lee, Chan Hee Song, Sifei Liu, Subhashree Radhakrishnan, Seungryong Kim, Yu-Chiang Frank Wang, Min-Hung Chen
学术论文
ArXiv
重要度: 8
强调环境工程是自主科学发现瓶颈,EurekAgent在多项任务上取得新SOTA,以不到11美元发现26圆填充结果。
👨🔬 Amy Xin, Jiening Siow, Junjie Wang, Zijun Yao, Fanjin Zhang, Jian Song, Lei Hou, Juanzi Li
学术论文
ArXiv
重要度: 8
构建端到端知识编排管道Agents-K1,处理246万篇论文生成科学知识图谱,在多跳推理上表现优异。
👨🔬 Zongsheng Cao, Bihao Zhan, Jinxin Shi, Jiong Wang, Fangchen Yu, Zhijie Zhong, Zijie Guo, Tianshuo Peng, Zhuo Liu, Yi Xie, Xiang Zhuang, Yue Fan, Runmin Ma, Shiyang Feng, Xiangchao Yan, Anran Liu, Peng Ye, Wenlong Zhang, Shufei Zhang, Chunfeng Song, Fenghua Ling, Jie Zhou, Liang He, Bo Zhang, Lei Bai
学术论文
ArXiv
重要度: 8
引入FORGE基准,显示单页污染可使生成推荐被骗率高达27%,推理反而加剧漏洞。
👨🔬 Minghao Luo, Liang Chen
学术论文
ArXiv
重要度: 7
LLM可自动化社会科学可重复性评估,在76项研究中效应量恢复率41%,定性结论一致率96%。
👨🔬 Tobias Holtdirk, Pietro Marcolongo, Anna Steinberg Schulten, Felix Henninger, Stefan Rose, Sarah Ball, Bolei Ma, Frauke Kreuter, Markus Weinmann, Stefan Feuerriegel
学术论文
ArXiv
重要度: 7
提出Mana框架,通过动画化灵巧操作实现零样本sim-to-real迁移,支持多种关节工具。
👨🔬 Zhao-Heng Yin, Guanya Shi, Pieter Abbeel, C. Karen Liu
学术论文
ArXiv
重要度: 7
提出AAA标准化代理评估框架,通过AgentBeats实现覆盖、实用性和保真度的大规模验证。
👨🔬 Xiaoyuan Liu, Jianhong Tu, Yuqi Chen, Siyuan Xie, Sihan Ren, Tianneng Shi, Gal Gantar, Evan Sandoval, Donghyun Lee, Daniel Miao, Peter J. Gilbert, Nick Hynes, Mauro Staver, Warren He, David Marn, Andrew Low, Xi Zhang, Elron Bandel, Michal Shmueli-Scheuer, Siva Reddy, Alexandre Drouin, Alexandre Lacoste, Ramayya Krishnan, Elham Tabassi, Yu Su, Victor Barres, Chenguang Wang, Wenbo Guo, Dawn Song
学术论文
ArXiv
重要度: 6
提出任务可交换性条件,保证合成数据推断的有效性,在民意调查和AI评估中验证。
👨🔬 Lezhi Tan, Tijana Zrnic
学术论文
ArXiv
重要度: 5
重新解释盾牌合成为设计时防御性分析工具,提供拓扑级安全指标。
👨🔬 Achraf Hsain, Sultan Almuhammadi
学术论文
ArXiv
重要度: 5
提出认知殖民概念,分析AI系统对个体认知和集体知识实践的隐性影响。
👨🔬 Marianna Bergamaschi Ganapini, Massimo Chiriatti, Enrico Panai, Giuseppe Riva
学术论文
ArXiv
重要度: 4
构建斯洛伐克语首个全面文本嵌入基准,开发高效本地部署模型,性能接近商用API。
👨🔬 Marek Šuppa, Andrej Ridzik, Daniel Hládek, Natália Kňažeková, Viktória Ondrejová