<?xml version="1.0" encoding="gbk"?>
<rss version="2.0">
  <channel>
    <title>鸿鹄论坛 - 我在职场</title>
    <link>https://bbs.hh010.com/forum-54-1.html</link>
    <description>Latest 20 threads of 我在职场</description>
    <copyright>Copyright(C) 鸿鹄论坛</copyright>
    <generator>Discuz! Board by Comsenz Inc.</generator>
    <lastBuildDate>Sat, 03 Oct 2026 10:55:49 +0000</lastBuildDate>
    <ttl>180</ttl>
    <image>
      <url>https://bbs.hh010.com/static/image/common/logo_88_31.gif</url>
      <title>鸿鹄论坛</title>
      <link>https://bbs.hh010.com/</link>
    </image>
    <item>
      <title>大模型方向学习资料整理：Spring AI接入、开发实战、面试题200（附链接）</title>
      <link>https://bbs.hh010.com/thread-677340-1-1.html</link>
      <description><![CDATA[最近在准备大模型应用开发方向，把手上三份资料整理了一下，结构如下：

1. Spring AI + Java 接入
   有视频、课件和 code.zip 三件套，Java 后端可以直接拿源码跑通调用，不用先补 Python。

2. 大模型应用开发实战 28 讲
   提示词工程最佳实践、Python 调用大 ...]]></description>
      <category>我在职场</category>
      <author>李现乐</author>
      <pubDate>Thu, 24 Sep 2026 03:02:18 +0000</pubDate>
    </item>
    <item>
      <title>Python 项目实战：用 Flask 构建生产级 MySQL 增删改查 REST API</title>
      <link>https://bbs.hh010.com/thread-677238-1-1.html</link>
      <description><![CDATA[一、技术选型
Flask：轻量、生态成熟、路由直观，适合 API 服务与快速验证。
MySQL：事务可靠、运维工具链完善，关系型存储主流选择。
Flask-SQLAlchemy（ORM）：声明式模型替代手写 SQL，天然参数化查询防注入，模型即文档。
若以 I/O 密集为主且追求类型安全与自 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 17 Sep 2026 09:04:35 +0000</pubDate>
    </item>
    <item>
      <title>超简单：用 Python 让 Excel 飞起来：用 openpyxl 把重复报表整理交给脚本</title>
      <link>https://bbs.hh010.com/thread-677027-1-1.html</link>
      <description><![CDATA[1. 为什么我想写这一篇？做办公自动化这几年，我见过太多这样的场景：每天早上的固定流程，是把十几个业务群发来的 Excel 下载下来，手动复制、粘贴、对齐格式、核对数字，最后拼成一份日报。整件事耗时约 40 分钟，其中真正需要\&quot;思考\&quot;的环节可能只有 5 分钟，其余 35  ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 03 Sep 2026 09:01:32 +0000</pubDate>
    </item>
    <item>
      <title>子进程不退出？Python 多进程僵尸进程与资源泄漏的工程化排查</title>
      <link>https://bbs.hh010.com/thread-676872-1-1.html</link>
      <description><![CDATA[一、从一次线上事故说起：先厘清两个被混用的概念那天要跑一批网页抓取，几万条，单线程要两三个小时，我顺手用 multiprocessing.Pool 开了 8 个进程并行。本地抽样 200 条没问题，上线后主进程很快打印\&quot;完成\&quot;，可 top 里仍有进程滞留：部分是 Z（zombie），部分是 D（ ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 20 Aug 2026 09:04:37 +0000</pubDate>
    </item>
    <item>
      <title>把热榜存下来：用 SQLAlchemy + PostgreSQL 设计 A股/美股/基金榜单数据模型</title>
      <link>https://bbs.hh010.com/thread-676793-1-1.html</link>
      <description><![CDATA[引言：为什么要把热榜落库前几篇我们已经解决了「怎么抓」——用 httpx 监听百度金融 sapi/v1/ranks 接口，拿到了 A股、美股、基金三类实时热榜。但只把数据打印到控制台或存成 CSV，价值其实非常有限：
[*]无法回溯历史：热榜的精髓在于「变化」。今天涨得最猛的股票 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 13 Aug 2026 08:58:36 +0000</pubDate>
    </item>
    <item>
      <title>Python 爬虫实战：抓取汽车之家二手车成交价格与里程数据</title>
      <link>https://bbs.hh010.com/thread-676692-1-1.html</link>
      <description><![CDATA[为什么抓二手车成交数据二手车是典型的非标品：同一款车，因为上牌年份、行驶里程、所在城市、车况等级不同，价格能差出好几万。汽车之家二手车（che168.com）聚合了全国大量真实成交记录，是做残值率分析、定价模型、区域行情监控最省钱的公开数据源。我们自己要做定价 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 06 Aug 2026 08:58:15 +0000</pubDate>
    </item>
    <item>
      <title>新Tab 精准加载 + 接口实时监听：Python 智联招聘爬虫的两种武器</title>
      <link>https://bbs.hh010.com/thread-676620-1-1.html</link>
      <description><![CDATA[现代招聘平台普遍采用前后端分离架构，职位数据经由 XHR 异步下发，且核心字段分散于列表接口与详情接口。以 requests 直采静态 HTML 仅能获取渲染骨架，难以保证薪资区间、HR 活跃状态等字段的完整性与保真度。本文基于 Playwright 构建采集流水线，以「接口实时监听」 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 30 Jul 2026 08:57:07 +0000</pubDate>
    </item>
    <item>
      <title>异步爬虫里 aiohttp 超时设多少不会误杀正常请求</title>
      <link>https://bbs.hh010.com/thread-676526-1-1.html</link>
      <description><![CDATA[超时设 3 秒，跑半小时成功率从 98% 掉到 85%。目标站点 RTT 正常，代理 IP 存活，但大量请求抛 ServerTimeoutError。问题出在超时阈值与实际网络时序不匹配，把正常的处理延迟当成了网络故障。aiohttp 超时的实现机制aiohttp 的 ClientTimeout 底层依赖 asyncio 的定时 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 23 Jul 2026 09:02:36 +0000</pubDate>
    </item>
    <item>
      <title>JS 逆向天花板姿势：JSRPC 远程调用实战</title>
      <link>https://bbs.hh010.com/thread-676357-1-1.html</link>
      <description><![CDATA[JS 逆向走到深处，最终都会撞上一堵墙：核心加密逻辑被 VMP 虚拟机保护、控制流平坦化、反调试陷阱层层包裹，静态分析几乎无法还原，AST 解析也无从下手。传统\&quot;抠代码 + 补环境\&quot;策略在此彻底失效。JSRPC（JavaScript Remote Procedure Call）换了一个思路：不逆向算法本 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 09 Jul 2026 08:55:58 +0000</pubDate>
    </item>
    <item>
      <title>网络工程师求职接活</title>
      <link>https://bbs.hh010.com/thread-676346-1-1.html</link>
      <description><![CDATA[李工：13459573042（微信）
数通、存储、Linux、虚拟化
常住福建，全国均可
临时，或短期]]></description>
      <category>我在职场</category>
      <author>liyi2</author>
      <pubDate>Wed, 08 Jul 2026 12:39:57 +0000</pubDate>
    </item>
    <item>
      <title>网络工程师求职接活</title>
      <link>https://bbs.hh010.com/thread-676345-1-1.html</link>
      <description><![CDATA[李工：13459573042（微信）
数通、存储、Linux、虚拟化
常住福建，全国均可]]></description>
      <category>我在职场</category>
      <author>liyi2</author>
      <pubDate>Wed, 08 Jul 2026 12:39:20 +0000</pubDate>
    </item>
    <item>
      <title>Python 高并发抢票技术拆解：异步请求、Cookie 持久化实战</title>
      <link>https://bbs.hh010.com/thread-676278-1-1.html</link>
      <description><![CDATA[票务抢票场景本质为毫秒级高并发资源竞争。放票瞬时海量请求涌入服务端，仅低延迟、高稳定、可抗风控的客户端可抢占资源。该场景核心依赖三大技术支柱：异步并发请求、会话持久化、IP风控对抗。本文基于实战场景，精简拆解从会话维护、余票监听、并发下单到风控规避的全 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 02 Jul 2026 09:00:32 +0000</pubDate>
    </item>
    <item>
      <title>告别 Scrapy 反爬困境：无缝切换原生支持 JS 渲染的新一代爬虫框架</title>
      <link>https://bbs.hh010.com/thread-676157-1-1.html</link>
      <description><![CDATA[一、前言：传统 Scrapy 爬虫在现代网页下的致命短板Scrapy 作为 Python 生态老牌同步爬虫框架，多年来是数据采集领域主流工具，凭借成熟管道、分布式扩展、中间件体系深受开发者认可。但随着互联网页面全面动态化、网站反爬体系持续升级，原生 Scrapy 的底层缺陷被无限 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 25 Jun 2026 08:53:14 +0000</pubDate>
    </item>
    <item>
      <title>知网数据实战：爬虫 + 网络分析打造论文关键词图谱</title>
      <link>https://bbs.hh010.com/thread-675979-1-1.html</link>
      <description><![CDATA[CNKI（中国知网）是国内核心学术文献数据库，文献关键词、元数据、引文等信息可有效表征领域研究脉络与热点分布。基于采集数据开展关键词共现分析，能够量化挖掘领域研究主题、主题间关联关系与知识群落结构。本文基于 Playwright 实现知网动态页面数据采集，结合亿牛云 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 11 Jun 2026 08:54:10 +0000</pubDate>
    </item>
    <item>
      <title>集反爬、JS 渲染、AI 选器于一体，3 万 Star 的 Scrapling 凭什么火爆爬虫圈</title>
      <link>https://bbs.hh010.com/thread-675841-1-1.html</link>
      <description><![CDATA[引言在Python网络爬虫工程化体系中，传统技术栈长期存在模块割裂、冗余度高、维护成本昂贵的行业痛点。常规数据采集方案高度依赖组件拼接：基于Requests实现HTTP请求、BeautifulSoup/Lxml完成静态DOM解析，针对SPA单页应用、AJAX异步加载场景需额外集成Selenium、Playwr ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 04 Jun 2026 08:54:45 +0000</pubDate>
    </item>
    <item>
      <title>Playwright 爬虫：Python 爬取 JS 渲染的 JSP 网站</title>
      <link>https://bbs.hh010.com/thread-675747-1-1.html</link>
      <description><![CDATA[在传统爬虫开发中，针对 JSP 动态网页的爬取一直是开发者面临的核心难点。JSP 作为 Java 服务端页面技术，常结合 JavaScript 实现前端数据渲染、异步请求加载、表单交互等功能。传统的 Python 爬虫库（如 Requests + BeautifulSoup）只能获取网页原始 HTML，无法执行 JS ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 28 May 2026 08:55:21 +0000</pubDate>
    </item>
    <item>
      <title>Scrapling：极简高效的 Python 智能爬虫框架</title>
      <link>https://bbs.hh010.com/thread-675667-1-1.html</link>
      <description><![CDATA[传统 Python 爬虫开发需完成依赖安装、编码处理、Cookie 配置、验证码绕过、分页逻辑编写、解析优化等繁琐流程，开发耗时长达两天；且目标网站改版后，CSS 选择器失效需重新开发，维护成本极高。Scrapling（GitHub Star 量 52k+，作者 D4Vinci）专为解决上述痛点设计， ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 21 May 2026 08:55:52 +0000</pubDate>
    </item>
    <item>
      <title>企业精准数据分析双路径对比：运营商大数据与 Python 爬虫技术选型与实践</title>
      <link>https://bbs.hh010.com/thread-675346-1-1.html</link>
      <description><![CDATA[企业精准数据分析的核心矛盾，集中体现为数据广度与数据深度的动态平衡。运营商大数据可覆盖用户全场景行为轨迹，涵盖通信、网络访问、位置等多维度信息，但在应用中受严格合规约束与数据获取成本限制；Python 爬虫能够定向采集公开场景数据，包括电商交易、社交舆论、 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 23 Apr 2026 08:53:02 +0000</pubDate>
    </item>
    <item>
      <title>Python 实现可交互滑块拼图，图形拖拽移动无卡顿</title>
      <link>https://bbs.hh010.com/thread-675256-1-1.html</link>
      <description><![CDATA[滑块拼图是Python GUI开发的经典实战案例，能直观体现图形拖拽、事件监听等核心技术。本文基于tkinter库，快速搭建可交互滑块拼图，拆解核心实现逻辑。
核心需求：将完整图片分割为打乱小块，用户拖拽拼接还原，确保拖拽无卡顿，具备基础辅助功能。本次开发结合亿牛云 ...]]></description>
      <category>我在职场</category>
      <author>suger7</author>
      <pubDate>Thu, 16 Apr 2026 08:55:27 +0000</pubDate>
    </item>
    <item>
      <title>【1500套】工作总结汇报PPT和Word，精品资料！</title>
      <link>https://bbs.hh010.com/thread-675178-1-1.html</link>
      <description><![CDATA[【1500套】工作总结汇报PPT和Word，精品资料！
链接：https://pan.quark.cn/s/7bb4eb723ffb]]></description>
      <category>我在职场</category>
      <author>h3cie888</author>
      <pubDate>Sun, 12 Apr 2026 01:27:36 +0000</pubDate>
    </item>
  </channel>
</rss>