Navigate to WaytoAGI Wiki →

知识库精选- 4 月 17 日

·2024-04-17·#知识库精选
知识库精选- 4 月 17 日

更多精彩博客:Diffuseum 播客-生成式模型研究Diffuseum 是一个对生成式图像、开源人工智能感兴趣的社区,这档播客记录关注的一线开发者的故事

https://assets.waytoagi.com/usercontent/1280_X128022_40c138e3d2.png

https://assets.waytoagi.com/usercontent/Xnapper_2024_04_17_13_50_49_6e9f5d0e9d.png

  • Agent调研--19类Agent框架对比》作者骁骑,开源的Agent应用可以说是百花齐放,文章也是挑选了热度和讨论度较高的19类Agent,基本能覆盖主流的Agent框架,每个类型都做了一个简单的summary、作为一个参考供大家学习。

https://assets.waytoagi.com/usercontent/Xnapper_2024_04_17_13_15_41_35cd81a44f.png

https://assets.waytoagi.com/usercontent/Xnapper_2024_04_17_13_12_18_b73fb8844f.png

https://assets.waytoagi.com/usercontent/Xnapper_2024_04_17_12_22_43_f295739c3c.png


?Xiaohu.AI日报「4月17日」 ✨✨✨✨✨✨✨✨ 1⃣️ ? Stable Diffusion 3 API 发布 Stability AI 宣布支持 Stable Diffusion 3 及其 Turbo 版本。 SD3 在文字到图像生成领域性能优越,特别是在字体和提示遵循方面。 Stability AI 暗示未来可能收费但未定发布日期。

https://x.com/imxiaohu/status/1780604711743402066

2⃣️ ? 波士顿动力发布全新电动Atlas机器人 停止开发液压动力版本,转向全电动。 新电动Atlas设计轻巧,动作平滑,适用于复杂狭窄空间。 特点包括180度头部旋转,自我恢复能力,紧凑转弯能力。

https://x.com/imxiaohu/status/1780599667824513480

3⃣️ ?️ FireCrawl开源爬虫工具 无需站点地图,可抓取任何网站的所有可访问子页面。 抓取内容可转换为Markdown格式,支持JavaScript动态内容。 提供易用API,简化内容爬取和转换。

https://x.com/imxiaohu/status/1780592067586269465

4⃣️ ? InstantMesh: 10秒快速生成3D模型 腾讯开发,结合多视图扩散模型和LRM。 在10秒内创建高精度3D模型。 可在线体验该技术。

https://x.com/imxiaohu/status/1780586192385483106

5⃣️ ?️ Spline推出AI 3D Generation工具 支持文本生成3D模型,一次生成4种变体。 2D图像转3D图像,混合素材生成3D变体。 生成的3D内容可集成到网站和应用中。

https://x.com/imxiaohu/status/1780496970064552132

6⃣️ ? ZeST单一图像材质迁移技术 无需先前训练,可进行单一或多重材质编辑。 快速处理,不依赖云计算或服务器。 牛津大学、Stability AI 和 MIT CSAIL共同研发。

https://x.com/imxiaohu/status/1780487355696378210

7⃣️ ? 苹果iOS 18人工智能功能 首批AI功能将完全在设备上运行,保障隐私。 苹果正在开发大语言模型 "Ajax"。 苹果可能会在6月的WWDC大会上公布更多AI计划。

https://appleinsider.com/articles/24/04/15/apples-...

8⃣️ ? Reka Core: 强大的多模态语言模型 处理文本、图像、音频和视频的能力可与GPT-4V相媲美。 提供不同规模模型以满足业务需求。 Reka AI团队成员遍布全球,采用远程优先工作模式。

https://x.com/imxiaohu/status/1780428801908134319

9⃣️ ? CTRL-F-VIDEO: 视频中搜索特定词汇 通过Chrome扩展在YouTube视频中搜索关键词。 使用Whisper模型将音频转换为文本实现搜索。

https://x.com/imxiaohu/status/1780223867782578306

知识库精选
相关推荐
知识库精选-2026年8月7日
知识库精选-2026年8月7日
- 《看了这么多Vibe Coding,我被B站这些产品整不会了》很多人的Vibe Coding还停在“让 AI 帮我写代码、做提效工具”。B站这批作品已经玩到更生活化的方向:督学官、大狗叫模拟器、AI 小镇、弹幕创世、时空电话、AI 猫娘。想做 AI 小产品、找灵感或理解“产品内容化”的人可以打开看看。
知识库精选
知识库精选-2026年8月6日
知识库精选-2026年8月6日
- 《重磅!Wan3.0开启公测》全新一代视频生成模型Wan3.0开启公测。Wan3.0在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成30秒视频;在文本、图片、音频、视频四种基础模态之外,首次支持doc、xls、ppt、pdf、md等文档格式输入,让“万物皆可生视频”。快来体验一下!
知识库精选
知识库精选-2026年8月5日
知识库精选-2026年8月5日
- 《Higgsfield 开源了他们95分钟的AI长片《 Hell Grind》所有提示词及相关资料》这部作品制作成本为50万美元,曾在戛纳电影市场展映,并获得《华尔街日报》、Variety及BBC新闻的报道。一起来看看他们的制作流程!
知识库精选
知识库精选-2026年8月4日
知识库精选-2026年8月4日
- 《Vibe Coding 视觉词典(上篇):布局、页面结构、导航与常用组件》这篇Vibe Coding 新手视觉宝典,把网页拆成四层:布局、页面结构、导航和组件。针对 卡片、瀑布流、Bento、分屏、CSS Grid/Flexbox、Hero、Landing Page、Sticky Navbar、Drawer、Tabs、Modal、Toast、表单、Command Palette都讲了各自的适用场景,还配了对应的提示词。如果你想用AI搭个人网站、作品集、产品页,可以参考一下。
知识库精选
知识库精选-2026年8月3日
知识库精选-2026年8月3日
- 《开放通用智能,MiniMax H3 正式开源》MiniMax H3正式开源,能统一理解文本、图片、视频、音频输入等构成的多模态上下文,生成最长 15 秒、最高 2K、带原生立体声音频的视频;还支持首尾帧、参考图/视频/音频等多种模式。更关键的是,H3-Base已开放本地部署,支持SGLang、vLLM、diffusers、ComfyUI;官方还给了 768p 本地验证和 2K 完整工作流。快来部署到自己的工作流里试一试!
知识库精选
知识库精选-2026年8月2日
知识库精选-2026年8月2日
- 《一文读懂 Agent 的三层工程:Harness、Loop 与 Graph》这篇文章带你厘清Agent工程中三个常被混为一谈的结构:Harness Engineering可以理解成运行环境,负责给模型工具、记忆、权限、工作空间和可观测性;Loop Engineering负责让任务能根据证据反复检查、修正和停止;Graph Engineering则把复杂流程里的分支、并行、审批和人工关口画清楚。
知识库精选
知识库精选-2026年8月1日
知识库精选-2026年8月1日
- 《阿k:烧5w积分看sd2.5、H3双雄对垒: 全面测评MiniMax H3篇 (附30+案例) 》阿K烧了5w积分,用30+案例全面测试了MiniMax H3,覆盖商用级多场景、多模态参考、原生音画生成、精准编辑、复杂复合内容生成等等。结果发现H3在UI 动效、产品广告、片头字体、拼贴动画、短剧上表现比较突出。
知识库精选
知识库精选-2026年7月31日
知识库精选-2026年7月31日
- 《活动总结|上个周末,我们和全国52城小伙伴们在博物馆玩AI》7月26日,我们和全国52个城市的小伙伴们,在博物馆过了个周末。这期AI切磋大会的主题是「博物馆奇妙日」。上午先去逛逛自己城市的博物馆,看文物、记故事、拍照片,下午回来,用 AI 把它做成一件作品,不管是网页、视频、海报,还是3D 交互都行。最终我们收到了160多件作品,并把它摆上了线上展厅,欢迎来逛👏🏻
知识库精选