即刻App年轻人的同好社区
下载
App内打开
奕辛
636关注2k被关注1夸夸
产品经理|网易、蚂蚁 .etc
专注于AI安全及AI应用于安全风控
✅现状永不满足,✅未来不懈追求
微信:xishui-2011
置顶
奕辛
6年前
向大家分享下我面试PM的方法:

1、请从你做过的诸多的产品中挑选一个你投入精力比较多,比较能代表你产品能力的产品,简要描述下:
几乎每个PM都会做一堆产品,但是在衡量其产品能力的时候用TA自认为最能体现TA产品能力是最为核实,为后续面试奠定一个产品场景。其次这类产品候选人往往最为熟悉,往往也是面试官能够挖掘到更多的点。

2、这款产品的定位是?衡量这款产品的成功与否的指标有哪些?你在里面的角色是:
作为一个PM清楚自己负责产品的定位及度量的数据指标是最为重要的点。但是在实际过程中很多PM都回答不上来,或者回答的是非常微观的目标。在这里能够发现PM的工作的目标感,目标感加上产品经历的时间大概能测算出一个PM的积累量。
在产品中的角色意味着其在项目推进过程中可以协调的资源量,也确定了这个产品是主导人还是执行人,背后决定PM对于该产品的思考广度和深度。

3、这款产品的需求来源有哪些?从用户需求到你的产品方案中间会经过哪些环节?推进需求落地的先后顺序的决策依据是:
以上主要是判断一个PM的需求分析,需求管理、产品方案设计的基础能力。

4、这款产品最终的数据是:
最终数据最终代表着该PM的产出,可能有人有疑问:产出受多因素决定等。但是我们脑子中的项目就是产品负责制,PM的产出就是最终交付给了用户的产出。实际过程中目标都是达成,这个不重要,重要的是目标达成的程度。

5、你在做这款产品的过程中有遇到什么问题?你是怎么解决的:
考察一个产品候选人的总结、分析、提炼的能力,在实际面试过程中,大概也就20%的PM能够很好的回答这个问题,因为面试时间很紧张,临场总结提炼往往是能够感知到的。

6、如果让你将这个产品推到重来,你觉得你会在哪些方面会做一些改变,原因是什么:
考量的是一个PM有无复盘,复盘能力,对比早期决策,是否有更好的解决方案,解决方案的依据是什么?能够判断这个PM的职业习惯及在该产品期间的成长度,这种方案的改变应该是有目标的,应该有体系的。那种微观的优化,要么原产品本来就很优秀,要么就压根没想过这个事情,而是浑浑噩噩的过来了。

7、向我推荐你最近体验到的三款很不错的产品,不错在哪里:
考察PM的产品的敏感度和前沿的追逐度,有没有经常去体验一些新出来的不错的产品,体验过程中有没有去总结人家产品的好处,好在哪里?

8、在产品的知识体系中,你觉的你在哪些产品点上能力比较强:
考察PM的自我认知能力,结合PM在前面讲的产品项目,他的工作内容、方式等等。反向印证前面过程对该PM的认知,看自己判断是否准确,是否遗漏了一些该PM的长短处,也看看PM对自己的认知能力。

9、请用三个词语形容下自己,取其中之一,列举工作的实例举证下这个形容词:
开放性问题,主要是判断其个人的性格,举例证明往往很多时候可以发现有意思的点,伴随这个问题可以小范围讨论下,舒缓前面面试的紧张氛围,在这个问题之后进行反转,看看该PM有无问题需要面试来解答的,PM也处于一个相对舒缓放松的状态下,能够完整全面提出自己的疑问。

备注:这9个问题在实际的面试过程中,可能有些环节时间比较久,有些可能比较短,有些问题会随场揉在一起问了。但是基本上会覆盖这些问题。仅供参考
32140
奕辛
4天前
嗨,瓜吃不动了...,可以从各种角度来解剖,但是爆出来,无非就是想往有利于自己的一面引导呗。
00
奕辛
4天前
杭州真的有秋天的感觉了...
00
奕辛
5天前
马上要开学了,书可以看起来了...
00
奕辛
5天前
在内容审核领域使用AI是一个很自然的过程,目标其实也很明确,就是无限度的逼近于0人审。

针对AI的运营原本预期会有基模、规则、知识等,并围绕此构建相应的AI Infra基础设施。

但在风险运营过程中,操作的更多的还是规则,知识在特定领域会作为一个理解的补充,基模训练反而是使用频率最低的。

这里面无非就是基模训练比较重,需要准备大量的样本数据,还需要做样本平衡度的评估,及训练后的评估等。

且还面临另外一个问题,就是基模达到一定水位之后,再行训练效果并不绝对有效/明显,这里面就涉及到大量的权衡和微操,需要静下心来慢慢优化,但当前大的环境其实不太允许此类操作。

在我所知道的某AI产品上,模型的评估占了算法、工程的绝大部分工作,每天的各个维度的评测甚至达到上千场。
00
奕辛
5天前
xhslink.cn

这个视频虽然有点搞笑,但其实很形象。
00
奕辛
8天前
国内顶尖高校能在一份内部材料里,把问题说得这么直白、这么坦诚,确实少见。
00
奕辛
12天前
之前的“违反社区规范(983)”是因为检索返回的原始史料里有大段古代刑罚的逐字引文,整段流经对话时触发了内容过滤。您的选题本身是正当的明清社会经济史研究,处理方式是:原始文献改由子代理消化后以学术化转述返回,写入报告时对刑罚内容做规范化概括(如“极刑”“体罚”),不再逐字转录。此后全部流程已恢复正常。

GLM,也就是你了😂,主观能动性绕过护栏~~~
00
奕辛
12天前
有趣的人还是挺多的

一个同事突然申请我这边一个系统的权限,我初步看了下,他应该不需要,就去问了下。

这老哥说我在系统上看到这个权限,强迫症犯了,焉有看到权限不申请的道理,我就都申请了...

有趣的灵魂啊~~~ 挺想认识下他的
00
奕辛
13天前
未来很多体验之上的意外,都体现在这种细节里面,而这些细节又导致产品力上的差异

小盖fun: 做 AI PM 的朋友,可以看看这个产品的反思。 一个特别明显的感受是,几乎所有移动互联网时代发展起来的产品,现在都在思考同一个问题:怎么把成熟产品进一步 AI 化。 这件事挺难的。 AI 化稍微激进一点,用户可能会疯狂吐槽。因为很多产品大家已经用了十几年,原来的交互方式和使用习惯早就形成了。你一下子改变使用方式,很多用户肯定会不适应。 但反过来,完全不做 AI 探索也不行。AI 带来的新交互和新能力,会直接影响产品未来的竞争力。 今天看起来用户还习惯原来的方式,但哪一天习惯真的发生变化了,再追可能就晚了。 前段时间我跟飞猪的朋友聊了一下他们最近在做的事情,感觉还挺有启发。 飞猪同样也是移动互联网时代发展起来的旅行产品,现在也在重新思考刚才那个课题。 他们之前的问一问也有过一段时间的热度,现在最新的 AI 叫飞猪帮帮。 具体产品我就不展开介绍了,大家感兴趣可以自己去看。 目前看这个产品形态肯定也不是终局。但我觉得他们探索过程中的思考还是很有价值。 一个成熟产品真的开始往 AI 方向优化的时候,很多以前只停留在概念里的问题,都会变成非常具体的产品和技术问题。 他们在这个过程中积累的一些经验,我觉得挺值得记录下来。 1、乍一看,飞猪是在一个成熟产品上做 AI 化,但它的底层逻辑,和今天的 Coding Agent 非常像,都是模型 + Harness + Memory。 Coding Agent 调用的工具是文件系统、终端、浏览器,旅行 Agent 调用的工具是机票报价引擎、酒店库存系统、景区数据接口等等。工具不同,架构是同一套。 我们看到的所有成规模的 Agent 产品,最后都会收敛到这个结构上来。 2、没聊之前觉得这事很简单,不就是在已有接口上接一下模型 API 嘛,聊完之后才发现远远不止于此。 他们甚至连模型都是自己在开源模型基础上微调的。因为只靠调用通用模型的 API,有很多问题没办法解决。 通用模型不能理解具体的业务逻辑,需要加很多规则做限制。 而且更麻烦的是数据安全没办法保证,没有谁愿意把自己的业务数据交给通用模型,这对用户也不负责。 所以,他们搭建了自有的训练环境和数据管线来做后训练,在开源模型的基础上训练出面向旅行场景的自有模型。这一点我完全没想到。 3、旅行产品本身有自己的表达方式和业务经验。比如一个用户跟 AI 说我周末想出去放松一下,模型如果机械地理解周末,可能会安排周六一早出发。 但对一个上班族来说,很可能想的是周五晚上下班直接走,或者周六睡个懒觉再出发。这些是这个行当里默认的经验,需要通过后训练固化到模型层面。 如果靠规则来约束,推理的时候效果就会差很多。 作为一个成熟的产品,飞猪手里本来就有大量旅行场景的数据和任务,通过后训练让模型慢慢理解这些需求,效果就会好很多。 4、他们在后训练上花了非常多功夫。 具体的做法是把真实的旅行场景建模成智能体编程的任务,让模型在真实工具调用的环境里学习。 而且因为旅行和电商不太一样,价格和库存都在快速变化,差一分钟问同一个问题正确答案可能完全不一样,所以训练环境必须是在线的、实时的。 这类模型也不需要追求智能的上限,甚至不需要做那么多轮次的推理,毕竟用户等不了那么长时间。 要不然用户着急买机票呢,还得等 50 秒的推理,谁能有这耐心。 跟上一代做移动互联网产品一样的逻辑,每慢一秒,用户就会流失一批。 5、模型是大脑,但光有大脑根本不够。真正做成产品,还需要在模型外面加一层 Harness,负责工具调用、规则约束和结果校验。 比如像刚才说的旅行场景里,机票价格和库存一直在变化,这些信息不能让模型凭记忆生成。 模型理解完用户需求之后,必须去调用真实的机票库存和交易系统,最后展示给用户之前还要做一次校验,确保价格、库存这些关键信息仍然有效。 6、所以我现在越来越觉得,很多垂直 Agent 的技术路径,其实跟 Claude Code、Codex 这类 Coding Agent 非常像。 底下是模型,上面是 Harness。真正的产品能力,很多苦活累活都在 Harness 这一层。所有的 Agent,架构应该都会趋同:模型 + Harness + Memory。 有一些规模不大的 Agent 可能模型可以直接用通用模型 API,但上层的 Harness 和记忆肯定是得自己做。 7、Agent 产品真正的苦活累活都在 Harness 这一层。模型解决的是理解和推理,但现实世界里的数据校验、异常处理、兜底逻辑,全得靠 Harness 来扛。 哪怕是规模不大的垂类 Agent,模型直接用通用的也能凑合跑起来,但 Harness 和记忆这两层一定得自己做。 8、Agent 的架构上,他们之前的思路更偏 Multi-Agent,把功能拆得非常细。 酒店一个 Agent、机票一个 Agent,每个 Agent 负责一件事,上层有一个总 Agent 负责编排和调度。 这个思路问题是 Agent 一多,上下文需要在不同 Agent 之间不停传递,容易出现信息丢失,调用链路也非常长,产品出了问题还非常难排查。 现在,他们结构精简了很多。随着模型能力快速进化,在做好 Harness 的前提下,一个 Agent 现在可以同时负责几件事。 即便是面对机票、酒店、门票这些库存性质和使用规则截然不同的品类,一个 Agent 也可以灵活调用机票查询、酒店查询、门票查询、Web Search 等工具来包办。 9、最后是 Memory。飞猪在记忆这块做了三层:长期记忆、中期记忆和短期记忆,能够把用户跨时间的行为和偏好整体关联起来。 用户喜欢住高档酒店,喜欢坐某个航空公司的航班,这些东西跟 Agent 说一次就好了,如果每次都要重复,用户就很毛躁。 我理解他们三层记忆的分工是这样的。长期记忆是用户画像和长期偏好。中期记忆解决跨会话的问题,比如这几天已经讨论过一次去日本旅行的事,下次再聊 AI 还是知道的。 短期记忆就是当前会话的信息。 这套机制和 ChatGPT 的记忆逻辑也类似。大家感兴趣的话,也可以查查。 10、另外,我想再说下对于交互的思考。几年前经常看到一种判断,有了大模型之后,LUI 也就是自然语言交互会慢慢替代 GUI。现在来看这个判断过于乐观了。 在一个成熟产品里,用户惯性非常大,而且 LUI 在很多场景里其实比较低效。包括 ChatGPT,我们看到它自己也在 LUI 里融合 GUI,说明这两种交互各有擅长的场景。 需求已经非常明确、追求精确的时候,GUI 很好用。打车就是一个典型例子,已经知道去哪了,地图上输两个字,选一个位置,弹出列表,点一下,选择车型,搞定。 如果这些步骤全部改成对话,体验反而更差,速度也会慢很多。 但碰到模糊需求或者条件非常多的时候,LUI 的优势一下子就出来了。比如想找一张机票,要求从迪拜中转,最好是过夜航班,不需要过境签,两段航班尽量是同一航司。 这种需求在 GUI 里不停地筛选,整个过程非常痛苦,但用自然语言一句话就能说清楚。 11、飞猪的做法就是把 LUI 和 GUI 融合在一起。用 LUI 来驱动 GUI,达到更丝滑的搜索和筛选效果。 到现阶段,客观地看,对于大部分产品来说,GUI 才是主体,LUI 是给用户增加一种以前没有的表达需求的方式。直接一把梭哈纯 LUI,实在是为了 AI 而 AI。 很多人觉得做 AI 原生应用就得是纯 LUI,这完全没有 get 到要点。原生不原生只是一个概念,最终还是要以满足用户需求为基础。 所有成熟产品,都得重过 AI 这一关。

00
奕辛
14天前
真正的智能应该是可适应的智能(Adaptable Intelligence),可以更快地学习新东西。衡量它的标准不是当下能力的绝对值,而是学会一个新任务的速度。
00