行业动态
Hacker News
重要度: 8
讨论如何识别AI领域中的伪科学和不实言论。
行业动态
Hacker News
重要度: 8
探讨AI进展是否呈指数级增长。
行业动态
Hacker News
重要度: 7
关注纽约市关于AI就业决策的法律。
行业动态
Hacker News
重要度: 6
讨论MIT许可协议中关于AI使用的限制。
行业动态
Hacker News
重要度: 6
询问当前AI算法使用中的痛点。
行业动态
Hacker News
重要度: 6
分析传统企业为何比AI炒作更持久。
行业动态
Hacker News
重要度: 5
介绍Yourobot创始人Chris Clark及其AI愿景。
行业动态
Hacker News
重要度: 5
询问学习AI的推荐阅读材料。
行业动态
Hacker News
重要度: 4
展示通过售书筹集资金的创业公司。
行业动态
Hacker News
重要度: 3
谷歌提供Common Lisp与机器学习实习机会。
行业动态
Hacker News
重要度: 3
探讨NLP、AI、ML和机器人是趋势还是更深层变革。
行业动态
Hacker News
重要度: 2
关于生物信息学家的职位或讨论。
学术论文
ArXiv
重要度: 9
提出WikiSkill框架,通过持久知识库协同进化智能体技能,在多个基准上优于现有方法,并发现技能进化与模型规模互补。
👨🔬 Liyan Tang, Cyrus Rashtchian, Chun-Sung Ferng, Andrew Tomkins, Da-Cheng Juan, Tu Vu
学术论文
ArXiv
重要度: 8
提出多粒度数据选择方法SWE-Prime,仅用10%轨迹子集训练即可超越全量数据,在SWE-Bench上性能提升显著。
👨🔬 Dewu Zheng, Ruizhe Ye, Yanlin Wang, Yang Ye, Hongyu Zhang, Ensheng Shi, Xilin Liu, Yuchi Ma, Jianxing Yu, Zibin Zheng
学术论文
ArXiv
重要度: 8
提出RedEvoAgent,通过经验驱动的技能进化实现自动红队攻击,提升越狱攻击效率和可解释性。
👨🔬 Junjie Zhang, Hui Liu, Kecheng Chen, Xianbo Mo, Changsheng Chen, Haoliang Li
学术论文
ArXiv
重要度: 8
提出CLAP框架,实现跨实体视频世界模型,零样本部署到真实任务,性能优于单实体模型。
👨🔬 Kechen Liu, Ola Shorinwa
学术论文
ArXiv
重要度: 8
提出LeVJEPA,无需启发式设计即可高效预训练视频编码器,计算成本降低5-20倍,性能相当或更优。
👨🔬 Lukas Kuhn, Lucas Maes, Giuseppe Serra, Quentin Le Lidec, Yann LeCun, Randall Balestriero, Florian Buettner
学术论文
ArXiv
重要度: 7
引入MCR-Bench基准,模拟真实多轮代码审查,发现主流LLM在缺陷跟踪上随轮次增加性能下降。
👨🔬 Dewu Zheng, Yanlin Wang, Xiwen Wang, Kefeng Duan, Hongyu Zhang, Xilin Liu, Yuchi Ma, Zibin Zheng
学术论文
ArXiv
重要度: 7
提出人设-执行分离架构模式,使LLM代理的人设自由演化而执行可审计,在受监管环境中应用。
👨🔬 Yisen Xi
学术论文
ArXiv
重要度: 7
开发连续脓毒症严重程度指数,无需逐小时标注,通过死亡排名信号学习,跨机构验证有效。
👨🔬 Kevin Zhu, Ryan Zhang, Baraa Abed, Tilendra Choudhary, Malvern Madondo, Mehak Arora, Yixuan Yang, Alasdair Gent, Aditya Nagori, Omer T. Inan, Krista L. Haines, Patrick Georgoff, Suresh M. Agarwal, Vijay Krishnamoorthy, Tetsu Ohnuma, Mihai V. Podgoreanu, Michael R. Pinsky, Gilles Clermont, Craig M. Coopersmith, Craig S. Jabaley, Rishikesan Kamaleswaran
学术论文
ArXiv
重要度: 7
提出CAST框架,基于SAE抑制伪影特征,提升临床语言模型的可审计性和鲁棒性。
👨🔬 Jin Mu, Guanhua Chen
学术论文
ArXiv
重要度: 6
提出MAELLE模型,基于电子占据的离散流匹配进行化学反应预测,在分布外场景下保持稳健性能。
👨🔬 Nguyen Xuan-Vu, Octavian Susanu, Daniel Armstrong, Philippe Schwaller
学术论文
ArXiv
重要度: 6
评估AI模型安全扫描器的覆盖率与失败恢复能力,发现现有工具在决策可用性上存在显著差异。
👨🔬 Qianlong Lan, Vinothini Pandurangan, Anuj Kaul, Indranil Sanyal
学术论文
ArXiv
重要度: 6
研究LLM如何组织道德知识,发现道德方向在表示空间中共享正成分,且与语料统计相关。
👨🔬 Orion Reblitz-Richardson