- 《🥇 8.3—8.9|本周 AI 论文精选》本周AI论文合集聚焦智能体工程落地的现实痛点。十篇研究基于大量实测与对照实验,厘清了模型与harness的故障划分,验证零大模型调用记忆栈的降本效果,推翻自我反思类方案的增益认知。同时还覆盖harness学习优化、提示词带来的隐性成本、技能库实际收益、长周期仿真基准、分词加速等方向。
- 《从零训练到真板运行:我们怎样把中文模型放进 ESP32》一块只有 8 MB PSRAM、16 MB Flash 的 ESP32-S3,能不能离线运行一个真正会逐词生成答案的中文模型?我们用一套从随机参数开始训练的 783 万参数模型,完成了从产品知识、训练、量化到真板运行的整条链路。

- 《一晚两场,H3 技术团队和全球开发者聊了什么?》MiniMax H3 开源的第一周,很多国内外开发社区里的开发者、创作者已经有了量化、硬件适配和工作流的丰富探索,也提出了一些关于模型机制和后续计划的问题。技术团队参加了 Reddit 社区 AMA 问答交流和 ComfyUI Live 直播,和来自不同地区的开发者、创作者聊了聊:模型架构是怎么做的?长视频能不能续写?目前还有哪些技术局限,后续的开源策略是什么。

- 《开源 4天就被“速通”?MiniMax H3这场 Reddit AMA到底聊了啥?》MiniMax H3开源4天就有人做出 4–8 步蒸馏 LoRA,Reddit AMA里大家也开始追问 2K、VAE、长视频续写、显存、LoRA 和 ComfyUI 接入这些硬问题。尽管显存、细节损失等难题仍待解决,但开源释放的社区活力,让这套视频模型的想象空间真正打开。
- 《阿里Wan3.0来了,我立马测了5大类场景,丢文档、网页居然也能生视频》阿里正式发布视频模型 Wan3.0,它把“参考素材”往前推进了一步:网页链接、Excel、Word、说明书、图片组都能直接丢进去,自动生成科普、数据汇报、产品演示和门店宣传视频。想做“文件转视频”或产品展示的人可以重点看看小歪这组测试。

- 《95分钟AI电影,把每个镜头的提示词都公开了(附电影级提示词Skill)》很多人做 AI 视频,真正卡住的往往是“镜头到底该怎么写”:人物怎么站、镜头怎么动、光从哪边来,前后画面怎么别突然跳戏。小歪拿《Hell Grind》这个开源项目做样本,把每个镜头公开的提示词、参考图、参数、11 万多条生成记录,以及官方 CINEDANCE 电影级提示词 Skill 都拆开讲清楚。照着“找相似画面→拆运镜/动作/灯光→替换成自己的内容”这条路抄作业,会比盲目堆提示词稳很多。








