Navigate to WaytoAGI Wiki →

知识库精选- 9 月 25 日

·2024-09-25·#知识库精选
知识库精选- 9 月 25 日
  • 卡梅隆加入Stability AI董事会意味着啥?》来自猫叔的文章,尽管好莱坞对 AIGC 曾持抵制态度,但卡神的加盟意味着影视行业将开始与 AIGC 合作,推动其商业化进程。这一变化可能会提升 AIGC 生成内容的质量,并改变整个影视制作生态。文章还回顾了 3DCG 技术的演变,指出未来 AIGC 与传统影视行业的结合将为创作提供更多机会。

https://assets.waytoagi.com/usercontent/Xnapper_2024_09_25_14_17_52_6850518fe3.png

  • 翻译:如何写作》这是李继刚推荐的一篇关于写作的文章:写作的目的是改变读者的思维方式,使其感受到价值。了解目标众至关重要,作者应写自己感兴趣的内容,真实表达自我。有效的写作需注重信号与噪音的平衡,信号是传达的信息,而噪音则是干扰因素。优秀的作品应具备强烈的信号和最低限度的噪音,从而与读者产生共鸣。最终,写作是为了满足自我表达的需求,而非单纯迎合他人。

    https://assets.waytoagi.com/usercontent/Xnapper_2024_09_25_11_55_07_5427f3b56f.png

  • 开发者新潮流 | 让做App像做饭一样平常,LLM即将开启「定制化应用开发」新时代》作者 南乔River,这篇文章探讨了「赤脚开发者」的概念,指的是那些在普通用户与专业开发者之间的群体。他们借助大模型(LLM)技术,能够快速、灵活地满足社区的小众需求。大模型的出现使得编程变得更加简单,用户只需用自然语言描述需求即可生成代码。这种新开发范式将推动定制化应用开发的新时代,降低技术门槛,使更多人参与到开发中。(全文翻译:自制软件和赤脚开发者

https://assets.waytoagi.com/usercontent/Xnapper_2024_09_25_09_44_13_6975f47119.png

  • 通向超人类未来的路线图 /《奇点更近》推荐序》《奇点更近》是雷・库兹韦尔的新作,探讨人类与 AI 融合的未来。书中描述了宇宙与人类发展的六个阶段,预言未来几十年内技术将迅速提升,改变人类生活。通过脑机接口等技术,人类将能提升认知能力、逆转衰老、实现数字永生。然而,这些技术也带来了潜在风险,如 AI 失控和基因编辑滥用。库兹韦尔的预见为我们描绘了一个激动人心但充满挑战的未来。

https://assets.waytoagi.com/usercontent/Xnapper_2024_09_25_09_26_14_595a2382f9.png

  • OpenAI 发布了高级语音模式!》OpenAI 近日向更多 ChatGPT 付费用户推出了 “高级语音模式”(AVM),该模式基于 GPT-4o 技术,能实现更自然的实时对话并捕捉情感。Plus 和 Team 用户将逐步获得该功能,企业版和教育版用户下周也将上线。标准语音则适用于所有用户,提供多种语音选择。AVM 还新增了自定义指令和记忆功能,提升了用户体验。欢迎大家体验后发表自己的观点。

https://assets.waytoagi.com/usercontent/Xnapper_2024_09_25_09_16_20_caba5dab6d.png


?Xiaohu.AI 日报「9 月 25 日」 ✨✨✨✨✨✨✨✨ 1⃣

? Google 发布 Gemini 更新

2⃣

⚡ OpenAI o1 API 发布可用性更新

  • 扩展至第 4 层开发人员:每分钟可发 100 个请求(两种模型)。
  • 第 5 层开发人员速率限制提升 5 倍:o1-preview 每分钟 1000 个请求,o1-mini 每分钟 5000 个请求。 ? https://x.com/imxiaohu/status/1838616602616717797

3⃣

? ChatGPT 高级语音功能推送

4⃣

? HuggingFace 推出 HuggingChat 原生 macOS 客户端

5⃣

? Iris:可穿戴设备,让你拥有“无限记忆”

6⃣

? 多邻国推出 AI 视频通话功能

7⃣

? MIMO:图像与视频人物替换及交互

8⃣

? Google DeepMind 提出 SCoRe 自我纠正强化学习方法

知识库精选
相关推荐
知识库精选-2026年8月9日
知识库精选-2026年8月9日
- 《从零训练到真板运行:我们怎样把中文模型放进 ESP32》一块只有 8 MB PSRAM、16 MB Flash 的 ESP32-S3,能不能离线运行一个真正会逐词生成答案的中文模型?我们用一套从随机参数开始训练的 783 万参数模型,完成了从产品知识、训练、量化到真板运行的整条链路。
知识库精选
知识库精选-2026年8月8日
知识库精选-2026年8月8日
- 《为什么托管式智能体会成为智能体构建的下一个重要方向》Langchain发布了Managed Deep Agents。这是构建、运行和部署生产级智能体最简单的方式。这篇文章分享了他们团队一路走到这里的过程,以及为什么会如此期待智能体构建的下一个阶段。
知识库精选
知识库精选-2026年8月7日
知识库精选-2026年8月7日
- 《看了这么多Vibe Coding,我被B站这些产品整不会了》很多人的Vibe Coding还停在“让 AI 帮我写代码、做提效工具”。B站这批作品已经玩到更生活化的方向:督学官、大狗叫模拟器、AI 小镇、弹幕创世、时空电话、AI 猫娘。想做 AI 小产品、找灵感或理解“产品内容化”的人可以打开看看。
知识库精选
知识库精选-2026年8月6日
知识库精选-2026年8月6日
- 《重磅!Wan3.0开启公测》全新一代视频生成模型Wan3.0开启公测。Wan3.0在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成30秒视频;在文本、图片、音频、视频四种基础模态之外,首次支持doc、xls、ppt、pdf、md等文档格式输入,让“万物皆可生视频”。快来体验一下!
知识库精选
知识库精选-2026年8月5日
知识库精选-2026年8月5日
- 《Higgsfield 开源了他们95分钟的AI长片《 Hell Grind》所有提示词及相关资料》这部作品制作成本为50万美元,曾在戛纳电影市场展映,并获得《华尔街日报》、Variety及BBC新闻的报道。一起来看看他们的制作流程!
知识库精选
知识库精选-2026年8月4日
知识库精选-2026年8月4日
- 《Vibe Coding 视觉词典(上篇):布局、页面结构、导航与常用组件》这篇Vibe Coding 新手视觉宝典,把网页拆成四层:布局、页面结构、导航和组件。针对 卡片、瀑布流、Bento、分屏、CSS Grid/Flexbox、Hero、Landing Page、Sticky Navbar、Drawer、Tabs、Modal、Toast、表单、Command Palette都讲了各自的适用场景,还配了对应的提示词。如果你想用AI搭个人网站、作品集、产品页,可以参考一下。
知识库精选
知识库精选-2026年8月3日
知识库精选-2026年8月3日
- 《开放通用智能,MiniMax H3 正式开源》MiniMax H3正式开源,能统一理解文本、图片、视频、音频输入等构成的多模态上下文,生成最长 15 秒、最高 2K、带原生立体声音频的视频;还支持首尾帧、参考图/视频/音频等多种模式。更关键的是,H3-Base已开放本地部署,支持SGLang、vLLM、diffusers、ComfyUI;官方还给了 768p 本地验证和 2K 完整工作流。快来部署到自己的工作流里试一试!
知识库精选
知识库精选-2026年8月2日
知识库精选-2026年8月2日
- 《一文读懂 Agent 的三层工程:Harness、Loop 与 Graph》这篇文章带你厘清Agent工程中三个常被混为一谈的结构:Harness Engineering可以理解成运行环境,负责给模型工具、记忆、权限、工作空间和可观测性;Loop Engineering负责让任务能根据证据反复检查、修正和停止;Graph Engineering则把复杂流程里的分支、并行、审批和人工关口画清楚。
知识库精选