PromptedGenerator算子参考文档,涵盖构造函数参数、run()签名及批处理LLM生成逻辑。用于在DataFlow管道中集成单字段LLM生成任务。
用于为dbt模型和列编写业务上下文文档,提升数据可发现性。支持添加或改进schema.yml中的描述、列定义及共享文档块,强调业务含义而非实现细节。
提供基于matplotlib和seaborn的科研绘图指南,涵盖期刊规范、无障碍设计、统计标注及导出检查,确保生成出版级高质量科学图表。
用于生成临床研究决策支持系统的研究、评估及治理文档。严格限定于合成或聚合数据,禁止涉及患者诊疗。涵盖证据审查、模型评估、隐私合规及可追溯性检查,确保输出仅为研究草稿,不用于临床操作。
文档 ingestr 向 BigQuery 写入数据的实现细节,涵盖暂存表交换路径、加载方法及分区集群变更处理。用于指导 pkg/destination/bigquery/ 及相关策略的代码修改与维护。
审计 dbt 项目文档覆盖率,自动为缺失的模型和字段生成符合项目规范的 YAML 描述草稿。支持批量回填和增量同步,确保多贡献者协作下的文档一致性,且仅输出供人工审核的更改。
用于生成临床研究决策支持系统的研究、评估及治理文档。严格限定于聚合或合成数据,禁止涉及患者护理、诊断或实时操作,确保合规与可追溯性。
提供qsv性能优化指南,涵盖索引文件、统计缓存及Polars引擎加速策略。指导用户通过预建索引和缓存提升大数据处理效率,并针对大文件或复杂查询推荐Parquet格式与向量化引擎以优化内存使用和并行处理能力。
LangExtract 使用指南,介绍如何从非结构化文本中提取结构化信息。涵盖安装、API Key 配置、基础提取代码示例及高质量示例编写规范,适用于构建提取管道或调试对齐问题。
- «
- 1
- »


