开发中
视频重绘流水线
将既有视频资产拆解为镜头级的可编辑生产流程,并重建为新的成片。
查看项目 →Public research notebook
Multimodal · Video · LLM Systems · Model Engineering。把 AI 能力做成可用的系统。
代表项目
能力域
查看材料、初评依据与尚缺的证据;缺少公开材料不等于没有能力。
从任务约束、模型适配到候选评估,检验模型选择。
3 项代表证据 · 证据覆盖率 60%
AI 辅助初评,待人工复核
查看能力域 →把模型带入服务:并发、资源管理、部署与恢复。
3 项代表证据 · 证据覆盖率 100%
AI 辅助初评,待人工复核
查看能力域 →连接文档、语言、语音与视觉任务。
1 项代表证据 · 证据覆盖率 50%
AI 辅助初评,待人工复核
查看能力域 →以问题、实验和修正记录学习过程。
5 项代表证据 · 证据覆盖率 80%
AI 辅助初评,待人工复核
查看能力域 →从用户约束和成功标准反推技术方案。
5 项代表证据 · 证据覆盖率 75%
AI 辅助初评,待人工复核
查看能力域 →把技术过程组织成可理解、可验证的公开材料。
6 项代表证据 · 证据覆盖率 80%
AI 辅助初评,待人工复核
查看能力域 →结合三个月、16 种语言的视频字幕翻译实践,梳理生产级 LLM 翻译从初译、校验、定向修正到人工反馈与数据回流的完整质量体系。
一个仍在持续开发的标题本地化研究项目:先生成冻结候选集,再以可复现的八维评估比较规则、LLM 与学习排序方法。
一个用两个周末完成的多模型工作流实验:让 AI 先提出候选开源方向,再通过结构化辩论收敛出真正适合开发者的行动路线。
本文分享了在部署FunASR语音识别服务时,遇到多进程下CPU线程爆炸导致内存溢出卡死的问题排查与解决方案。
记录从单卡单实例到双卡双实例与软件优化的系统对比:50 路并发下 RTF 从 0.61 降至 0.23。结果包含硬件扩容与软件调整的共同影响,不能归因于 SharedMemory 单项优化。