Navigate to WaytoAGI Wiki →

知识库精选- 5 月 10 日

·2024-05-10·#知识库精选
知识库精选- 5 月 10 日

https://assets.waytoagi.com/usercontent/Xnapper_2024_05_10_22_21_34_bbaaa8223a.png

  • 【比赛】即梦Dreamina:未来影像计划》以“梦”为题的的AI视频挑战赛开始了,梦想家们,准备好唤醒心中沉睡的奇迹了吗?让我们携手 AI 的力量,将你的梦境转化为震撼人心的现实。在梦中,你可能正穿越至未来世界,化身为银河中的超级英雄,或在惊险的密室中探险求生…

https://assets.waytoagi.com/usercontent/4d2bffe0_7a78_4bfc_9e35_b96ea62fecd0_16d32eba0e.png

  • 2050:一次惊喜,一些相遇》作者 Atou,他参加了 2050 的通往AGI之路线下活动,与来自各地的人们相遇,参与了丰富多彩的科技和教育活动。活动中,有创意比赛、即兴戏剧、教育讨论等,让作者感受到了与人真实交流的快乐与意义。在草坪夜谈中,大家畅谈、游戏、分享,让作者深刻体会到线下社交的真实温暖。,感受到线下交流的重要性,也让他对未来充满期待。

https://assets.waytoagi.com/usercontent/Xnapper_2024_05_10_10_37_56_28e8064343.png

  • ElevenLabs 推出其自己的音乐生成模型 ElevenLabs Music。展示了早期预览版生成的歌曲,该模型可直接通过文本提示生成完整带歌词音乐。ElevenLabs声称这些歌曲都是根据单个文本提示生成的,没有任何编辑。各首歌曲风格涵盖流行摇滚、乡村、爵士、当代R&B和独立摇滚等多样化类型。

https://assets.waytoagi.com/usercontent/Xnapper_2024_05_10_10_23_34_c3e3254a96.png

  • Stability AI推出基于Discord的媒体生成和编辑工具》Stable Artisan 是一个基于Discord的媒体生成和编辑工具,由Stability AI的先进图像和视频模型支持,包括Stable Diffusion 3、Stable Video Diffusion和Stable Image Core。目前提供了多种编辑工具,如搜索和替换、删除背景、创意放大和外扩。

https://assets.waytoagi.com/usercontent/Xnapper_2024_05_10_10_09_49_e8d9551e68.png

  • 昨晚,Coze 的共学快闪活动来到了第三天,「谁是卧底」、「Dr.Know」的作者艾木老师分享了Auto-GPT 的工作原理、设计 Wokflow 的方法以及多 agent 场景下的身份识别和记忆上下文机制等等,可以在这里在线看演讲 PPT,也可以在 B 站看直播回放

https://assets.waytoagi.com/usercontent/Xnapper_2024_05_11_08_39_08_b8b96c2edb.png


?Xiaohu.AI 日报「5 月 10日」 ✨✨✨✨✨✨✨✨ 1⃣️ ?️Pocket Computer:

2⃣️ ?Stylar:最可控的AI图像与设计工具

3⃣️ ?Siri Ultra:通过快捷命令在iPhone上实现LLM对话

4⃣️ ?ChatGPT的Android客户端新版本

5⃣️ ?Gemma 2B扩展至1000万上下文窗口

6⃣️ ?SoundHound AI与Perplexity的合作

  • 将在线智能问答功能引入汽车的语音助手。
  • 可查询油价、电影演员阵容等信息。
  • 详细内容:https://xiaohu.ai/p/7737

7⃣️ ?ElevenLabs Music:推出音乐生成模型

  • 基于单个文本提示生成完整歌曲。
  • 涵盖流行摇滚、乡村、爵士等多种风格。
  • 详细内容及试听:https://xiaohu.ai/p/7687

8⃣️ ?OpenAI的Assistants API

知识库精选
相关推荐
知识库精选-2026年8月7日
知识库精选-2026年8月7日
- 《看了这么多Vibe Coding,我被B站这些产品整不会了》很多人的Vibe Coding还停在“让 AI 帮我写代码、做提效工具”。B站这批作品已经玩到更生活化的方向:督学官、大狗叫模拟器、AI 小镇、弹幕创世、时空电话、AI 猫娘。想做 AI 小产品、找灵感或理解“产品内容化”的人可以打开看看。
知识库精选
知识库精选-2026年8月6日
知识库精选-2026年8月6日
- 《重磅!Wan3.0开启公测》全新一代视频生成模型Wan3.0开启公测。Wan3.0在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成30秒视频;在文本、图片、音频、视频四种基础模态之外,首次支持doc、xls、ppt、pdf、md等文档格式输入,让“万物皆可生视频”。快来体验一下!
知识库精选
知识库精选-2026年8月5日
知识库精选-2026年8月5日
- 《Higgsfield 开源了他们95分钟的AI长片《 Hell Grind》所有提示词及相关资料》这部作品制作成本为50万美元,曾在戛纳电影市场展映,并获得《华尔街日报》、Variety及BBC新闻的报道。一起来看看他们的制作流程!
知识库精选
知识库精选-2026年8月4日
知识库精选-2026年8月4日
- 《Vibe Coding 视觉词典(上篇):布局、页面结构、导航与常用组件》这篇Vibe Coding 新手视觉宝典,把网页拆成四层:布局、页面结构、导航和组件。针对 卡片、瀑布流、Bento、分屏、CSS Grid/Flexbox、Hero、Landing Page、Sticky Navbar、Drawer、Tabs、Modal、Toast、表单、Command Palette都讲了各自的适用场景,还配了对应的提示词。如果你想用AI搭个人网站、作品集、产品页,可以参考一下。
知识库精选
知识库精选-2026年8月3日
知识库精选-2026年8月3日
- 《开放通用智能,MiniMax H3 正式开源》MiniMax H3正式开源,能统一理解文本、图片、视频、音频输入等构成的多模态上下文,生成最长 15 秒、最高 2K、带原生立体声音频的视频;还支持首尾帧、参考图/视频/音频等多种模式。更关键的是,H3-Base已开放本地部署,支持SGLang、vLLM、diffusers、ComfyUI;官方还给了 768p 本地验证和 2K 完整工作流。快来部署到自己的工作流里试一试!
知识库精选
知识库精选-2026年8月2日
知识库精选-2026年8月2日
- 《一文读懂 Agent 的三层工程:Harness、Loop 与 Graph》这篇文章带你厘清Agent工程中三个常被混为一谈的结构:Harness Engineering可以理解成运行环境,负责给模型工具、记忆、权限、工作空间和可观测性;Loop Engineering负责让任务能根据证据反复检查、修正和停止;Graph Engineering则把复杂流程里的分支、并行、审批和人工关口画清楚。
知识库精选
知识库精选-2026年8月1日
知识库精选-2026年8月1日
- 《阿k:烧5w积分看sd2.5、H3双雄对垒: 全面测评MiniMax H3篇 (附30+案例) 》阿K烧了5w积分,用30+案例全面测试了MiniMax H3,覆盖商用级多场景、多模态参考、原生音画生成、精准编辑、复杂复合内容生成等等。结果发现H3在UI 动效、产品广告、片头字体、拼贴动画、短剧上表现比较突出。
知识库精选
知识库精选-2026年7月31日
知识库精选-2026年7月31日
- 《活动总结|上个周末,我们和全国52城小伙伴们在博物馆玩AI》7月26日,我们和全国52个城市的小伙伴们,在博物馆过了个周末。这期AI切磋大会的主题是「博物馆奇妙日」。上午先去逛逛自己城市的博物馆,看文物、记故事、拍照片,下午回来,用 AI 把它做成一件作品,不管是网页、视频、海报,还是3D 交互都行。最终我们收到了160多件作品,并把它摆上了线上展厅,欢迎来逛👏🏻
知识库精选