Navigate to WaytoAGI Wiki →

知识库精选- 10 月 2 日

·2024-10-02·#知识库精选
知识库精选- 10 月 2 日
  • OpenAI 凌晨发布:Realtime 实时多模态 API,及其他》OpenAI 在 10 月 1 日发布了 Realtime 实时多模态 API 等更新。Realtime API 支持语音端到端处理,能够更准确地识别和生成语音,费用较高。视觉模型微调功能允许使用图像进行训练,适用于工业和医疗领域,微调价格较贵。

https://assets.waytoagi.com/usercontent/Xnapper_2024_10_02_09_32_12_53388e5eb6.png

  • 微软发布新版 Copilot,更强大跟系统结合更深的ChatGPT》微软近期发布了全新版本的 Copilot,进行了彻底重构,更加深入地与系统结合。新功能包括 Copilot Voice(自然语音对话)、Copilot Daily(个性化信息更新)、Copilot Vision(Edge 浏览器中的视觉助手)和 Think Deeper(高级推理解决复杂问题)。Copilot Voice 将在多个国家推出,Copilot Daily 和 Copilot Vision 也将逐步扩展。(源地址

https://assets.waytoagi.com/usercontent/Xnapper_2024_10_02_09_28_43_020b660e51.png

  • Pika 1.5发布 最新版本 Pika 1.5 引入了许多新功能,包括更出色的画面效果、更长的剪辑和各种惊艳的动作。用户可以通过 Pika 实现超越传统摄影的效果,例如爆炸、融化和膨胀等特效。此外,Pika 还提供丰富的电影镜头选项,如子弹时间、升降机镜头等,帮助用户制作更具电影感的视频。《PIKA1.5正式上线,他们走上了另一条全新的"整活"之路。

https://assets.waytoagi.com/usercontent/Xnapper_2024_10_02_09_10_55_0f7e667f71.png

  • 胡凯翔:Super Prompt 解析》本文是胡凯翔对 “Super Prompt” 的解析,探讨了提示词的结构、作用及其复杂性。内容包括思考框架的元数据、二进制编码、数学符号等,强调了通用催化剂、无限概念演化等概念的重要性。文章深入分析了提示词在 AI 模型中的应用,以及如何通过高度抽象的思维模式实现自我超越和动态目标设置。

https://assets.waytoagi.com/usercontent/Xnapper_2024_10_02_09_15_18_18a64602c1.png

知识库精选
相关推荐
知识库精选-2026年8月7日
知识库精选-2026年8月7日
- 《看了这么多Vibe Coding,我被B站这些产品整不会了》很多人的Vibe Coding还停在“让 AI 帮我写代码、做提效工具”。B站这批作品已经玩到更生活化的方向:督学官、大狗叫模拟器、AI 小镇、弹幕创世、时空电话、AI 猫娘。想做 AI 小产品、找灵感或理解“产品内容化”的人可以打开看看。
知识库精选
知识库精选-2026年8月6日
知识库精选-2026年8月6日
- 《重磅!Wan3.0开启公测》全新一代视频生成模型Wan3.0开启公测。Wan3.0在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成30秒视频;在文本、图片、音频、视频四种基础模态之外,首次支持doc、xls、ppt、pdf、md等文档格式输入,让“万物皆可生视频”。快来体验一下!
知识库精选
知识库精选-2026年8月5日
知识库精选-2026年8月5日
- 《Higgsfield 开源了他们95分钟的AI长片《 Hell Grind》所有提示词及相关资料》这部作品制作成本为50万美元,曾在戛纳电影市场展映,并获得《华尔街日报》、Variety及BBC新闻的报道。一起来看看他们的制作流程!
知识库精选
知识库精选-2026年8月4日
知识库精选-2026年8月4日
- 《Vibe Coding 视觉词典(上篇):布局、页面结构、导航与常用组件》这篇Vibe Coding 新手视觉宝典,把网页拆成四层:布局、页面结构、导航和组件。针对 卡片、瀑布流、Bento、分屏、CSS Grid/Flexbox、Hero、Landing Page、Sticky Navbar、Drawer、Tabs、Modal、Toast、表单、Command Palette都讲了各自的适用场景,还配了对应的提示词。如果你想用AI搭个人网站、作品集、产品页,可以参考一下。
知识库精选
知识库精选-2026年8月3日
知识库精选-2026年8月3日
- 《开放通用智能,MiniMax H3 正式开源》MiniMax H3正式开源,能统一理解文本、图片、视频、音频输入等构成的多模态上下文,生成最长 15 秒、最高 2K、带原生立体声音频的视频;还支持首尾帧、参考图/视频/音频等多种模式。更关键的是,H3-Base已开放本地部署,支持SGLang、vLLM、diffusers、ComfyUI;官方还给了 768p 本地验证和 2K 完整工作流。快来部署到自己的工作流里试一试!
知识库精选
知识库精选-2026年8月2日
知识库精选-2026年8月2日
- 《一文读懂 Agent 的三层工程:Harness、Loop 与 Graph》这篇文章带你厘清Agent工程中三个常被混为一谈的结构:Harness Engineering可以理解成运行环境,负责给模型工具、记忆、权限、工作空间和可观测性;Loop Engineering负责让任务能根据证据反复检查、修正和停止;Graph Engineering则把复杂流程里的分支、并行、审批和人工关口画清楚。
知识库精选
知识库精选-2026年8月1日
知识库精选-2026年8月1日
- 《阿k:烧5w积分看sd2.5、H3双雄对垒: 全面测评MiniMax H3篇 (附30+案例) 》阿K烧了5w积分,用30+案例全面测试了MiniMax H3,覆盖商用级多场景、多模态参考、原生音画生成、精准编辑、复杂复合内容生成等等。结果发现H3在UI 动效、产品广告、片头字体、拼贴动画、短剧上表现比较突出。
知识库精选
知识库精选-2026年7月31日
知识库精选-2026年7月31日
- 《活动总结|上个周末,我们和全国52城小伙伴们在博物馆玩AI》7月26日,我们和全国52个城市的小伙伴们,在博物馆过了个周末。这期AI切磋大会的主题是「博物馆奇妙日」。上午先去逛逛自己城市的博物馆,看文物、记故事、拍照片,下午回来,用 AI 把它做成一件作品,不管是网页、视频、海报,还是3D 交互都行。最终我们收到了160多件作品,并把它摆上了线上展厅,欢迎来逛👏🏻
知识库精选