AI论文通过同行评审了!科研Agent实测:这三类人用最香,这几个坑必须防

源自63位全网作者

13:07

内容由AI生成

精选参考来源

1. 【AI 智研体限时免费试用】不用写代码、不用查数据集,助力科研人高效产出

2. Nature丨迈向人工智能研究的端到端自动化

3. 智源研究院:迈向递归自改进深度研究Agent 深度研究(Deep research)要求 Agent 找到同时满足多个约束条件的答案。发现这样的答案成本很高,而验证候选答案往往可以拆解为多个可处理的、按约束逐项检查的过程。这种“发现与验证”之间的不对称性说明,研究型 Agent 不应只是一味延长搜索,而应当通过验证中间结果、并利用部分验证过的状态来指导后续改进,从而递归式地改进当前答案。 在这项工作中,北京智源人工智能研究院(BAAI)团队提出了 AREX,一个递归自我改进(RSI)深度研究 Agent 系列。 AREX 在内层研究循环与外层自我改进循环之间交替运行:内层循环收集证据并构建初步答案,外层循环按约束逐项审查答案、识别尚未解决的论断,并发起针对性的后续研究。 为在长程任务中维持 RSI 能力,AREX 学习了一个自主的上下文更新工具,将不断增长的交互历史压缩为一个紧凑的改进状态,其中保留已验证的证据与尚未解决的约束,且不依赖外部模型。 他们通过 agentic 中期训练与长程强化学习,在经过验证的合成任务与高质量轨迹上训练 AREX。为缓解长程学习中奖励稀疏的问题,训练过程着重强调获得关键决定性证据或纠正错误研究方向的关键步骤。 他们实例化了一个 4B 稠密模型与一个 122B-A10B 的 MoE 模型。在 BrowseComp、WideSearch、DeepSearchQA、Humanity's Last Exam(HLE)等推理与工具使用基准上,AREX 超越了同规模基线模型,并在与激活参数量大大超过自身的模型对比中依然保持竞争力。 #AIChannel #ai #大模型 #LLM #智能体 #agent #AGI #学习 #北京智源人工智能研究院 #带你一起读论文

4. 科学家会失业吗?——看看一位AI科学家的工作效率

5. ChatGPT、豆包、千问、PaperDeep,谁才是真正的“论文王者”?

6. 导师和评委真的能一眼看出来你的毕业论文是AI写的吗?

7. 领跑!30B模型登顶OpenAI科研榜单,UniPat AI冲上开源科研最前线

8. AREX:真正强的 Agent,是会自我怀疑的那个

9. 前后耗时六个月,从零自研research Agent科研智能体 实测产出多篇完整文稿:本科term paper、数模竞赛报告、硕士dissertation、期刊manuscript均可一站式生成。 智能体定向服务本科生与硕士研究生,核心打造学术全流程automated pipeline,打通课程作业、数模竞赛、硕士学位论文完整链路,仅输入课题topic,就能闭环产出全套研究内容。开发过程中深有体会:AI是科研写作顶尖auxiliary assistant。 内置60+专业skills模块,开发难点是约束AI按流程执行任务,前期频繁出现执行偏差,反复调优后现已完善,可分层递进完成本科论文、数模、硕论全系列学术任务。 #AI Agent #vibecoding #数学建模 #本科论文 #硕士dissertation

10. 硕博熬论文 3 天查文献、作图改稿到崩溃?这套 AI 科研全流程课直接提速 80%! | NQI视界

11. 我用书生·端砚做科研,3天完成1周的实验,这个坑别踩

12. 有可能让AI自己做科研吗?

13. 怎么看待当下学生用AI写论文这件事?

14. AI实现全流程自主科研,首篇AI生成论文通过同行评审

15. AI科研智能体技能库scientific-agent-skills:一套面向AI Agent的科研工作流技能集合,将你的AI转变为能够执行多领域复杂多步骤科学工作流程的研究助手。138项即用型技能(涵盖100 多个科学和金融数据库、70多个优化的Python包技能、覆盖主要科学领域)

16. AI 科研必备技能,从选题到发表一站搞定

17. 重磅上新|科研智能三件套正式发布,一站式赋能全流程科研创新

18. AI Agent六大核心模块

19. 智源大会连发八项AI成果 范式转换正在发生

20. 2026智源大会核心成果梳理:世界模型落地AI正式迈入物理智能时代

21. 2026智源大会重磅落地!中国AI跳出内卷,开启物理世界落地革命

22. 智源开源AREX:AI学会自己检查作业,做研究还能中途纠错

23. 2026北京智源大会开幕 :一文读懂中国AI的现在与未来

24. Agent 不该只是搜得更久:AREX 把“验证”变成下一轮研究的起点

25. AREX: 验证驱动的递归自改进研究智能体

26. Daily Papers | 不是多搜几轮:AREX 用逐约束核查改进深度研究 Agent

27. AREX递归自我改进深度研究智能体 多榜超同规模基线 模型已开源

28. AREX: 迈向递归自我改进的DeepResearch智能体

29. 搜索更久不如学会"回头查作业":BAAI的AREX给Deep Research开的新药方

30. 搜索Agent学会自我批改,4B反杀397B

31. 多模态AI Agent架构演进与实际应用(2026完整版)

32. 多模态Agent开发实战营

33. 作者有话说|关于构建多模态Agent的方法

34. 英伟达具身智能新框架ENPIRE:8个AI Agent控制机器人自主完成科研任务

35. 多模态AIAgent自主任务执行能力综合测试

36. 阿里x南大:大模型agent迈入多模态时代

37. 哈佛物理教授疯了:我让AI写论文,结果两周干完博士一年工作!已发顶刊

38. 如何评价comma.ai创始人George Hotz断言AI编程Agent无法真正编程?

39. AI 能取代科研人员吗?

40. AI第一次科研竞赛中击败人类!Opus 4.7狂飙2930步创世界纪录

41. 全球首个自主科研Agent挑战赛!零人工干预冲击CNS成果SOTA,科研变天?

42. 华东师范大学学报刊发多篇 「AI 一作」论文,如何看待这一「社会实验」,对未来科研有哪些启发?

43. 如果写论文时大量使用AI将自己写的中文内容翻译成英文,那么会不会被认为是AI代笔?

44. AI写的论文,过了同行评审——科研这件事,正在被重新定义

45. 无人“超级科研工厂”落沪,直播AI做科研!科研OPC时代来了!

46. 深势科技携手阿里云 AgentRun,加速科研 AI Agent 全速运行

47. 理工科科研人员用AI工具推荐?

48. AI写的论文,通过顶会同行评审了

49. MOSS孙天祥新公司要让AI自己写100篇论文,还要全网直播一个月

50. AI赋能科研:从论文写作到Agent开发|中国科学院人才交流开发中心主办

51. 盘点一周AI大事(7月5日)|Fable 5回归 Claude Fable 5重新上线 Anthropic推出科研智能体「Claude Science」 ComfyUI接入智能体协议「Comfy MCP」 Meta开源UI设计系统「Astryx」 研究员开源CAD技能「CAD Skills」 Google推出数据预测模型「TabFM」 研究员开源SOTA小模型「Agents A1」35B 研究员开源SOTA AI超分模型「ASASR」 研究员开源拍照辅助模型「ShutterMuse」 研究员开源重新打光模型「Sun Direction LoRA」 UBTECH 发布情感陪伴机器人「U1」 Meta推出大脑解码模型「Brain2QWERTY v2」 #抖音前沿科技首发计划 #vibecoding大赏 #AI新星计划 #AI #AIGC

52. Superpowers 是一套基于 14 个 Skills、7 步工作流和 3 条铁律的 AI 编程 Agent 标准化开发流程,通过强制触发机制让 AI 智能体从急于写代码转变为按流程办事,从而提升 AI 编程的稳定性和可靠性。 Superpowers 是由 Jesse Vincent 创建的开

53. 以后用超算的居然不是人?ISC现场这个判断有点意思 德国汉堡ISC 2026这两天,我跟几个国内来的专家聊了聊超智融合的事。上海交大信息办主任林新华有个观点让我印象特别深:未来的超算,使用者可能根本不是人,是AI Agent。 这话乍一听有点超前,但你细想一下,现在AI for Science的研究

54. 从图灵测试到 GPT:这本 AI 全传,把医疗、就业、伦理讲透了

55. 国际关注 | DIA:欧美监管机构力推制定AI 政策国际合作

56. QECon2026 深圳站丨云原生专家团拆解 AI Agent 工程化落地的 4 个关键环节

57. 【Agent 开发范式演进:从环境工程出发,“简化”多源实时上下文】本文基于阿里云沈林在2026中国生成式AI大会的分享,指出企业级Agent落地瓶颈不在模型,而在上下文供给能力。文章从“环境工程”视角,提出信息完备性、感官管理、知识对账、变更治理、普惠门槛五大维度,探讨如何让Agent低成本、可靠

58. 592→604!AI智能体协作打破人类数学纪录:去中心化科研时代正在到来

59. 智驭未来:《人工智能科技伦理审查与服务办法(试行)》正式出台

60. CSIG科普活动-AutoResearch驱动的图形学研究成功举办

61. AI agents in research: when productivity comes at the cost of apprenticeship

62. 告别“纸上谈兵”,尚思研究院让研究者现场亲测怎样才是好的AI Agent

63. 2026 导师认可的学生 AI 论文辅助工具:平衡写作效率与学术质量

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章