常规测试文集
文集大纲加载中……
本站点使用「觅思文档专业版」构建
-
+
首页
Markdown代码块
Markdown代码块
更新一下  ```html <div class="layui-card"> <div class="layui-card-header">{% trans "高级筛选" %}</div> <div class="layui-card-body"> <div class="layui-form"> <div class="layui-form-item"> <label class="layui-form-label">{% trans "关键词" %}</label> <div class="layui-input-inline"> <input type="text" name="kw" placeholder="请输入标题" autocomplete="off" class="layui-input"> </div> <button class="pear-btn pear-btn-primary pear-btn-sm" id="search">{% trans "搜索" %}</button> </div> <div class="layui-form-item"> <label class="layui-form-label">{% trans "文集" %}</label> <div class="layui-input-inline"> <select name="pro_id" lay-verify="required" lay-filter="project" id="project"> <option value="">{% trans "按文集筛选" %}</option> <!-- 自己的文集 --> <optgroup label="自有文集" id="self-project"> {% for p in project_list %} {% if p.role == 1 %} <option value="{{ p.id }}">[私密]《{{ p.name }}》</option> {% elif p.role == 2 %} <option value="{{ p.id }}" >[指定用户]《{{ p.name }}》</option> {% elif p.role == 3 %} <option value="{{ p.id }}" >[访问码]《{{ p.name }}》</option> {% else %} <option value="{{ p.id }}" >[公开]《{{ p.name }}》</option> {% endif %} {% endfor %} </optgroup> <!-- 协作的文集 --> {% if colla_project_list.count > 0 %} <optgroup label="协作文集"> {% for p in colla_project_list %} <option value="{{ p.project.id }}">[协作]《{{ p.project.name }}》</option> {% endfor %} </optgroup> {% endif %} </select> </div> </div> <div class="layui-form-item"> <label class="layui-form-label">{% trans "文档状态" %}</label> <div class="layui-input-block"> <input type="radio" name="status" title="全部({{all_cnt}})" value="-1" lay-skin="primary" checked lay-filter="doc_status"> <input type="radio" name="status" title="草稿({{draft_doc_cnt}})" value="0" lay-skin="primary" lay-filter="doc_status"> <input type="radio" name="status" title="已发布({{published_doc_cnt}})" value="1" lay-skin="primary" lay-filter="doc_status"> <input type="radio" name="status" title="已删除({{recycle_doc_cnt}})" value="3" lay-skin="primary" lay-filter="doc_status"> </div> </div> </div> </div> </div> ```  还不错吧 ``` # coding:utf-8 # 读取文件内容 from pypdf import PdfReader from docx import Document from loguru import logger # 获取PDF文件内容 def getPDFContent(file_path): # 创建 PdfReader 对象 reader = PdfReader(file_path) text = [] # 遍历每一页并提取文本 for page in reader.pages: text.append(page.extract_text()) # 将所有页面的文本合并为一个字符串 return "\n".join(text) # 获取docx文件内容 def getDocxContent(file_path): doc = Document(file_path) text = [] for paragraph in doc.paragraphs: text.append(paragraph.text) return "\n".join(text) def getFileContent(file_path): try: suffix = file_path.split('.')[-1].lower() if suffix == 'pdf': return getPDFContent(file_path) elif suffix == 'docx': return getDocxContent(file_path) else: return '' except Exception as e: logger.error(f'获取文件{file_path}文本内容异常:{e}') ``` <div class="mrdoc-fragment" data-fragid=1>[片段]数值</div> @[frag](id=7 title=是的发生的佛挡杀佛)
项目背景.docx
(23.52KB)
呵呵哒
2026年8月15日 14:36
0 条评论
转发
收藏文档
上一篇
下一篇
手机扫码
复制链接
手机扫一扫转发分享
复制链接
分享
链接
类型
密码
更新密码
有效期
Markdown文件
Word文件
PDF文档(打印)
AI