即刻App年轻人的同好社区
下载
App内打开
歸藏
567关注28k被关注50夸夸
产品设计师、模型设计师、 不会代码的独立开发者。
关注人工智能、LLM 、 Stable Diffusion 和设计。
歸藏
1天前
做影视后期、动画特效以及一些转场,MiniMax H3真的太牛逼了!

我在视频里标注了自己的工作流,包括素材、提示词。

基本上你把特效的图片分镜标注好,用现在的图像模型做好,或者自己把文字等特效层 P 上去,甚至只是给一些参考,它就能帮你做出非常复杂的动特效。

它的文字和 UI 细节、排版细节效果巨好。

我做的两个案例都用了九宫格图片,按理说总分辨率只有 1K 左右,但它生成出来的清晰度极高,完全没有以前那种字迹模糊看不清的状态。

支持全模态参考。而且还会开源,开源后成本会降低。

非常适合用来做广告片、产品宣传片、MV、游戏宣传和电商宣传,或者做个特效来包装自己的照片和视频。这些大家都有强烈的需求。
01:06
29
歸藏
1天前
Deepseek V4 Flash 更新到正式版了,Agent 能力大幅提升,超过了 V4 Pro 的 Preview 版本!

官方测评成绩:

Terminal Bench 2.1: 82.7
NL2Repo: 54.2
Cybergym: 76.7
DeepSWE: 54.4
Toolathlon verified: 70.3
Agent Last Exam: 25.2
Automation Bench (Public): 25.1
DSBench-FullStack: 68.7
DSBench-Hard: 59.6

目前已经在官方 API 上线,同时还支持了 Codex 的 API 格式,可以快速配置。

Mac 一键配置脚本:bash <(curl -fsSL cdn.deepseek.com)

Windows 一键配置脚本:irm cdn.deepseek.com | iex

DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。

详情:api-docs.deepseek.com/zh-cn/updates/
45
歸藏
1天前
发现了 Codex 一个非常牛逼的更新,好像没见他们宣传!

Codex 现在有专门给图像 Agent 做的 UI 模式了:

生成图片后,点击图片会单独弹出一个侧边栏预览窗口。在这里面,你可以直接对图片进行评论、擦除和调整大小。这完全是专门给 GPT Image 2.0 做的。

左上角有一个切换按钮,切换以后,聊天流里就只显示图像,不显示那些文案了。

这样你就可以专注于调整图像,快速看到聊天里生成的所有大图。

你可以多选图片,一并添加到输入框里,然后让 GPT 给你进行批量修改。

这个更新感觉要把设计 Agent 的活吃掉一大半了。

这种方式我觉得是要比现在主流的无限画布等复杂的交互逻辑,要更容易理解的。
522
歸藏
2天前
Seedance 2.5 模型已经给超创开放了内测。

1. 最高支持 30 秒:一次可以生成 30 秒长度的视频
2. 目前最高支持 720P
3. 全能参考:最多一次可以上传 50 个素材,非常离谱
34
歸藏
2天前
CodePilot 刚更新了 0.62 版本。

因为这个工具主要是我给自己做的,满足了我自己的需求,把我的一些工作流也放进了里面。

这次更新主要优化了体验:

1. 侧边栏文件树:
我希望它能有完整的文件浏览、编辑及管理能力。所以现在侧边栏文件树新增了右键菜单,支持新建、删除、添加和移动;同时,也可以把右侧文件树中的任何文件和文件夹添加到左侧的聊天框里。

2. Markdown 编辑和预览:现在预览和编辑可以在同一个页面进行。

3. 补齐了左侧和输入框的右键菜单

详情:github.com
31
歸藏
2天前
要不是 Cloud Max Fable 5 的话,我现在根本都不想订阅。

Opus 4.7、4.8 5.0 都太他妈拉胯了,越来越拉胯。

测试成绩越来越好,但是使用体验上效果越来越差:就是疯狂地不说人话、无法沟通,加上疯狂偷懒。

它就像那种大厂里面最讨厌的同事,全是说教,但是不干活。

而且你给他布置任务以后,他疯狂地通过各种方式削减自己的工作量。

一旦用在自动化循环里,你就会发现你给他 7 个需求,他说都做完了,但是每一个需求都给你砍到原有工作量的 20%,最后的结果就是每个都不能用。

很难想象 Anthropic 这个公司现在经历了什么。

就好像 Opus 4.6 是一个偶然的结果,他们根本没有掌握怎么样再训出一个比 Opus 4.6 更好的 Opus 模型。
1113
歸藏
3天前
我操,Codex 又重置了!

同时他们还说在调查体感上 GPT-5.6 Sol 的消耗速度比较快的问题。

然后在调查期间也会暂停 5 小时限额。
86
歸藏
3天前
这个能力已经在 Codepilot 上线了,我自己最近一直也在用,太爽了!

充分发挥各个模型的能力长处,而且可以帮你节省成本。

你可以在一个聊天里启用、由不同模型驱动的 subagent,利用它们自己的能力去帮你完成事情,而且也可以减少比较贵的模型的消耗。

比如这个任务,就是用 Grok 去检索 Twitter 信息,用 DeepSeek 生成文案,K3 生成网页,然后由 GLM 5.2 统筹。

这里尝试:github.com
106
歸藏
4天前
Kimi K3 已经在多家推理服务上线,大家的 API 价格神奇的保持了一致

但是一些 Token plan 已经开始打折了,比如 OpenCode Zen Cline Pass,Cursor 给的额度估计也不低
32
歸藏
5天前
Kimi K3 已经如期开源,各位估计明天就能在各大平台的 Token Plan 使用 Kimi K3 了

详情:huggingface.co
21