行业动态
Hacker News
重要度: 8
枯燥业务比AI炒作周期更持久,强调务实价值。
行业动态
Hacker News
重要度: 7
MIT推出非AI许可证,限制AI使用代码。
行业动态
Hacker News
重要度: 6
关注纽约地方法律144对AI招聘的影响。
行业动态
Hacker News
重要度: 6
讨论AI进步速度是否呈指数级增长。
行业动态
Hacker News
重要度: 5
AI疯子指数,识别过度炒作言论。
行业动态
Hacker News
重要度: 5
询问AI入门学习书籍推荐。
行业动态
Hacker News
重要度: 4
探讨当前AI算法使用中的痛点。
行业动态
Hacker News
重要度: 4
NLP/AI/ML是趋势还是更深层变革?
行业动态
Hacker News
重要度: 3
初创公司通过卖书融资。
行业动态
Hacker News
重要度: 2
炒作AI天才,机器自学习上帝算法。
行业动态
Hacker News
重要度: 2
谷歌招聘Common Lisp机器学习实习生。
行业动态
Hacker News
重要度: 1
生物信息学职位招聘。
学术论文
ArXiv
重要度: 9
提出VERITAS框架,利用视觉验证器在推理时引导机器人策略,无需额外训练即可提升性能,并支持自改进。
👨🔬 Mingtong Zhang, Dhruv Shah
学术论文
ArXiv
重要度: 9
提出循环世界模型LoopWM,通过参数共享的Transformer块迭代优化状态,实现100倍参数效率,建立迭代深度作为新扩展轴。
👨🔬 Hongyuan Adam Lu, Z. L. Victor Wei, Qun Zhang, Jinrui Zeng, Bowen Cao, Lingwei Meng, Mocheng Li, Zezhong Wang, Haonan Yin, Naifu Xue, Minyu Chen, Cenyuan Zhang, Zefan Zhang, Hao Wei, Jiawei Zhou, Haoran Xu, Hao Yang, Ronglai Zuo, Tongda Xu, Yonghao Li, Jian Chen, Hebin Wang, Zeyu Gao, Yang Li, Wei Zhao, Qimin Zhong, Siqi Liu, Yumeng Zhang, Leyan Cui, Zhangyu Wang, Wai Lam
学术论文
ArXiv
重要度: 8
提出基于不动点收敛的循环Transformer模型FPRM,自适应调整计算深度,在Sudoku等推理任务上有效。
👨🔬 Sajad Movahedi, Vera Milovanović, Shlomo Libo Feigin, Alexander Theus, Thomas Hofmann, Valentina Boeva, T. Konstantin Rusch, Antonio Orvieto
学术论文
ArXiv
重要度: 8
对Anthropic前沿模型进行红队测试,发现尽管防御增强,但自适应攻击仍能成功产生有害输出,揭示安全漏洞。
👨🔬 Nicola Franco
学术论文
ArXiv
重要度: 8
引入后向Kolmogorov方程提升扩散策略的鲁棒性,在PushT和制造线上取得性能提升和死锁减少。
👨🔬 Lekan Molu
学术论文
ArXiv
重要度: 7
提出自演进零样本导航框架,通过记忆提取和预反思机制,提升成功率达10.1%。
👨🔬 Qi Chai, Wenhao Shen, Nanjie Yao, Yue Xia, Kaiyong Zhao, Jie Ma, Guosheng Lin, Hao Wang
学术论文
ArXiv
重要度: 7
构建可扩展的健康代理评估框架,使用原子化布尔量规,专家对齐度优于基线,并提升模型性能。
👨🔬 Weizhi Zhang, Zechen Li, Hamid Palangi, Ben Graef, A. Ali Heydari, Simon A. Lee, Salman Rahman, Ray Luo, Zeinab Esmaeilpour, Erik Schenck, Chloe Zhang, Yamin Li, Menglian Zhou, Philip S. Yu, Daniel McDuff, Lindsey Sunden, Mark Malhotra, Shwetak Patel, Ahmed A. Metwally
学术论文
ArXiv
重要度: 7
重建SEC文件为布局忠实的多Markdown数据集,提供152B token的公开快照和两个金融基准。
👨🔬 Nick Bettencourt, Xiaowei Ding, Kay Giesecke
学术论文
ArXiv
重要度: 6
利用GitHub issue构建可扩展的可重复性审计框架,评估LLM代理识别真实复现问题的能力。
👨🔬 Shanda Li, Qiuhong Anna Wei, Jingwu Tang, Valerie Chen, Nihar B Shah, Tim Dettmers, Yiming Yang, Ameet Talwalkar
学术论文
ArXiv
重要度: 6
提出模仿学习方法预测网络攻击者策略,辅助神经符号防御代理,在模拟中实现高预测精度。
👨🔬 Ankita Samaddar, Sandeep Neema, Daniel Balasubramanian, Xenofon Koutsoukos
学术论文
ArXiv
重要度: 6
提出DRFLOW基准和代理,用于评估从异构源预测个性化工作流,现有方法仍有较大改进空间。
👨🔬 Md Tawkat Islam Khondaker, Raymond Li, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan, Issam H. Laradji
学术论文
ArXiv
重要度: 5
构建LLM驱动的非法捕捞事件数据库系统,支持信息抽取、去重和趋势分析。
👨🔬 Henry Bodwell, Hong Yang, John C. Simeone, Kelvin Gorospe, Bella Sullivan, Lana Huang, Jessica Gephart, Sandy Aylesworth, Molly Masterton, Naren Ramakrishnan