TensorFlow:端到端开源机器学习平台
由 Google Brain 团队发起的端到端开源机器学习平台,提供工具、库与社区资源,供研究者开展机器学习与神经网络研究并部署应用。
由 Google Brain 团队发起的端到端开源机器学习平台,提供工具、库与社区资源,供研究者开展机器学习与神经网络研究并部署应用。
针对CI/CD下代码变更使既有测试用例失效的问题,提出基于变异的多智能体测试用例更新方法。 指出近期基于大语言模型的测试更新方法依赖执行反馈与精确匹配上下文检索,优先保证可执行性与行覆盖率。
背景:功效分析(power analysis)对定量研究的严谨性至关重要,但因专用软件门槛高而使用不足;LLM 正被快速整合进研究实践,其在统计任务上的可靠性却缺乏系统评估 —— 存在"未经检验或过于乐观地使用"的风险。 设计:评估四种广泛使用的 LLM —— ChatGPT(G
从社会语言学视角提出机器“身份”概念框架,探讨大语言模型是否具有可测量的人格及其推理风格受语料语言属性影响。 属概念性视角论文,不提供原始实验数据,也非有既定检索策略与纳入标准的系统综述,而是整合已发表发现。
为 Stable Diffusion 提供浏览器图形界面,把文生图、图生图、修复与放大等操作集中到可交互的网页中,降低使用门槛。
结论:海鞘底部体片段可再生而上部片段不能,局部信号环境差异与干细胞激活相关。 做法:以玻璃海鞘为模型,结合流式细胞术、单细胞测序、移植与命运图谱比较可再生与不可再生情境。
问题:化学文献中大量物理数据分散在非结构化文本与复杂表格里;将其转为机器可读格式是训练数据驱动化学模型的前提。但计算抽取的数据集普遍缺乏不确定性量化,导致人工抽取与整理仍不可省。 方案:一个完全自动化、带不确定性量化的抽取流水线 —— 用 LLM 直接从科学 PDF 中抽取复杂表
问题:罕见病影响约 1/10 的美国人,却在临床记录中系统性记录不足。基于 ICD 的系统无法覆盖其广度 —— Orphanet 编码中超过 50% 无直接 ICD 映射,HPO 编码中仅 2.2% 有匹配 ICD 码,导致患者群体"不可见"、诊断延迟。 难点:挖掘非结构化临床笔
研究提出并评估“检索后验证”方法,用于衡量大语言模型生成医学信息的证据支持度与幻觉。 针对AI生成医学信息缺乏源文档明确支持的问题,开展实证研究以直接评估其是否基于底层证据。
演进脉络:从 DENDRAL 专家系统、计算机辅助药物设计(CADD)、QSAR 建模,到 AlphaFold 3 生物分子复合物预测、计算机辅助合成规划(CASP)、天然产物生物勘探与自主多智能体系统。 重点进展:抗菌筛选、精准肿瘤学、植物化学表征,以及临床阶段的 AI 生成分