行业动态
Hacker News
重要度: 9
探讨传统行业为何能比AI炒作更持久,强调稳健商业模式的韧性。
行业动态
Hacker News
重要度: 8
讨论AI进步速度是否呈指数级增长,引发对技术发展节奏的思考。
行业动态
Hacker News
重要度: 7
关注纽约市地方法144对AI使用的影响,反映对AI监管的担忧。
行业动态
Hacker News
重要度: 7
询问当前AI算法使用的痛点,关注实际应用中的挑战。
行业动态
Hacker News
重要度: 6
提出AI领域伪科学指数,帮助识别不靠谱的AI言论。
行业动态
Hacker News
重要度: 6
MIT发布非AI许可证,限制AI使用开源代码,引发关于AI与开源的讨论。
行业动态
Hacker News
重要度: 5
文章宣称将出现AI领域的比尔·盖茨或爱因斯坦,炒作AI超级智能。
行业动态
Hacker News
重要度: 4
询问推荐学习AI的书籍,反映人们希望系统学习AI知识的需求。
行业动态
Hacker News
重要度: 4
探讨NLP、AI等是短暂趋势还是长期价值,引发对技术本质的思考。
行业动态
Hacker News
重要度: 3
一家创业公司通过卖书融资,展示非传统融资方式,反映AI创业的多元化。
行业动态
Hacker News
重要度: 3
谷歌提供Common Lisp与机器学习实习机会,关注AI与函数式编程结合。
行业动态
Hacker News
重要度: 2
生物信息学家职位信息,显示AI在生物领域的应用。
学术论文
ArXiv
重要度: 9
提出AutoDesign框架,通过元优化器递归改进模型-工具系统,在学术海报生成任务上超越商业系统。
👨🔬 Yaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, Xiaotong Li
学术论文
ArXiv
重要度: 9
提出全模态AI科学家OmniScientist,可直接从原始多模态数据完成科研全流程,在36个真实数据集上验证。
👨🔬 Bobo Li, Hao Fei, Tianjie Ju, Mong-Li Lee, Wynne Hsu
学术论文
ArXiv
重要度: 9
首个仓库级联合实现与证明合成基准,当前最强智能体仅解决27/43实例,显示AI在形式化验证方面仍有不足。
👨🔬 Zhe Ye, Hantao Lou, Yuechun Sun, Peiyang Song, Zhengxu Yan, Timothe Kasriel, Qingyang Zhang, Kaiyu Yang, Soonho Kong, Jingxuan He, Dawn Song
学术论文
ArXiv
重要度: 8
提出合成人格预训练方法,从零开始注入对齐人格,提升指令遵循和越狱鲁棒性,减少道德困境中的错误。
👨🔬 Julian Minder, Viktor Moskvoretskii, Raghav Singhal, Difan Jiao, Andy Arditi, Shaobo Cui, Yiderigun Borjigin, Kartik Bali, Stefan Krsteski, Harsh Raj, Huu Nguyen, Jannik Brinkmann, Ashton Anderson, Roland Aydin, Robert West
学术论文
ArXiv
重要度: 8
揭示LLM编码智能体在命令生成与执行路径间的失败,提出QuoteBench基准,强调报告配置细节的重要性。
👨🔬 Shangao Li, Yao Zhang, Volker Tresp, Yuanyuan Yang
学术论文
ArXiv
重要度: 7
构建受控预训练语料库LITTLELEARNER,模拟小学知识范围,用于研究知识获取和能力边界。
👨🔬 Fanfei Li, Jana Zeller, Manuel Prada-Corral, Thaddäus Wiedemer, Prasanna Mayilvahanan, Ryan Cotterell, Wieland Brendel
学术论文
ArXiv
重要度: 7
提出人类对齐的人形运动跟踪基准HumanTracker和指标HumanScore,更好预测人类偏好并揭示接触稳定性问题。
👨🔬 Dairu Liu, Zekun Qi, Jiayu Zeng, Ruixi Yu, Yu Guan, Yintianrun Zhang, Xuchuan Chen, Sikai Liang, Zekai Li, Chenghuai Lin, Xinqiang Yu, Wenyao Zhang, He Wang, Li Yi
学术论文
ArXiv
重要度: 6
提出掩码扩散的数据几何度量UGC,推导最优调度,实现认证最优采样器,具有维度相关的改进。
👨🔬 Martin J. Wainwright
学术论文
ArXiv
重要度: 6
发布仅用合规数据训练的10亿参数模型Mimir v1,在英语和丹麦语上表现优异,开源可复现。
👨🔬 Peter Schneider-Kamp, Jacob Nielsen, Gianluca Barmina, Kenneth Enevoldsen, Lukas Galke Poech
学术论文
ArXiv
重要度: 6
改进AlayaWorld世界模型,采用流式3D点缓存渲染器,统一条件编码,增强长时程交互生成能力。
👨🔬 AlayaWorld Team, Kaipeng Zhang, Chuanhao Li, Yifan Zhan, Yongtao Ge, Yuanyang Yin, Jiaming Tan, Kang He, Liaoyuan Fan, Mingliang Zhai, Ruicong Liu, Xiaojie Xu, Xuangeng Chu, Zhen Li, Zhengyuan Lin, Zhixiang Wang, Zian Meng, Zihui Gao
学术论文
ArXiv
重要度: 5
研究LLM在知识边界外的幻觉行为,提出Gricean退让框架,但发现模型缺乏将知识边界与生成结合的机制。
👨🔬 Dananjay Srinivas, Saksham Khatwani, Maria Pacheco
学术论文
ArXiv
重要度: 5
开源多智能体临床推理框架MARC,通过角色分工和显式上下文传递提升可解释性,无需编程即可配置。
👨🔬 Saisha Shetty, Satvik Tripathi, Austin Lin, Colin Zhao, Theodore Kim, Don Enwerem, Jacinta Arnold, Shahriar Faghani, Tessa S Cook