在医学领域中,很少有领域比放射肿瘤学需要更高的精度或数据。 RadOnc-GPT 是一种经过微调的 LLM,使用 Meta Llama 2 构建,有可能显着改善放射治疗决策。 很少有领域比放射肿瘤学需要更高的精度或更多的数据。患者的生命取决于在这个专业领域获得正确的治疗。
分类: AI项目
一款可以将文本转换为知识图谱的工具:Prettygraph
Prettygraph 是一个基于 Python 的 Web 应用程序,由 @yoheinakajima 开发,用于演示文本到知识图生成的 新 UI 模式。该项目是一个快速破解项目,并不是要成为一个强大的框架,而是一个简单的 UI 想法,用于在生成知识图时动态突出显示文本输入。
Google推出开源视觉语言模型:PaliGemma
支持图像视频等多种视觉语言任务 包括支持图像和短视频字幕、视觉问答、图像文本理解、物体检测文件图表解读、图像分割等任务。 PaliGemma 模型包含 30 亿(3B)个参数,结合了 SigLiP 视觉编码器和 Gemma 语言模型。
DeepFacelive:可以在直播过程和视频通话时进行实时换脸的工具
DeepFaceLive 建立在 DeepFaceLab 的基础上,后者为当前领先的面部交换框架,能够产生接近电影质量的面部合成效果,提供高保真的视觉体验。
新的 SDXL Controlnet 线条模型 MistoLine
能够应对各种类型的线条艺术作品,无论是手绘草图、不同的 ControlNet 线预处理工具,还是由模型生成的轮廓,都能高精确性和稳定地处理。 一个重要特点是其泛化能力极强,无需针对不同的线预处理工具更换不同的 ControlNet 模型。
StoryDiffusion 这个字节的新项目表现很好
能够生成细节丰富、内容多样的图像和视频,同时保持角色身份和服饰的一致性。 可以帮助生成长篇漫画或者带连续剧情的视频。 与IP-Adapter和PhotoMaker等方法相比,StoryDiffusion在保持角色一致性的同时,还能更好地控制文本提示,生成与描述更匹配的图像和视频。
GPT-4 能比你更好地教机器人手做转笔技巧吗?
Eureka 弥合了高级推理(编码)和低级运动控制之间的差距。它是一种“混合梯度架构”:一个黑盒,仅推理 LLM 指示一个白盒,可学习的神经网络。外循环运行 GPT-4 来细化奖励函数(无梯度),而内循环运行强化学习来训练机器人控制器(基于梯度)。
Supertone Shift:实时语音变换器
可以将你直播说话时候的声音变声其他各种角色和性别的声音。 还能调整音调、音调动态和混响等参数,塑造个性化的声音。 也可以将你声音与任何角色的声音以任意比例混合,创造出新的声音 。
LGM:生成高质量3D模型
支持文字生成模型、图片生成模型,分辨率512x512,5秒内即可生成。 3D内容创作在质量和速度方面都取得了显着进步。尽管当前的前馈模型可以在几秒钟内生成 3D 对象,但其分辨率受到训练期间所需的密集计算的限制。在本文中,介绍了大型多视图高斯模型...
Apple 宣佈將推出全新輔助使用功能
包括「眼動追蹤」、「音樂觸覺」和「聲音捷徑」 Apple 今日宣佈將於今年稍晚推出全新輔助使用功能,包括「眼動追蹤」,一種讓身體障礙使用者只用眼睛即可控制 iPad 和 iPhone 的方式。此外,「音樂觸覺」將為聾人與聽力障礙使用者提供一種用 iPhone...
自动将你的网页内容转换为播客
Audio Native 是一个嵌入式音频播放器,可以自动为网页内容生成语音 只需插入一段简短的代码,即可插入到任何网页和内容中,自动为内容生成语音旁白。 您现在正在阅读的这一行的上方有一个播放按钮。按播放键,您可以收听由 ElevenLabs...
装备了AI瞄准步枪的机器狗
配备人工智能瞄准步枪的机器狗接受美国海军陆战队特种部队评估 正在接受审查的四足动物具有自动瞄准系统,但需要人工监督才能开火。 据战区报道,美国海军陆战队特种作战司令部 (MARSOC) 目前正在评估 Ghost Robotics 开发的新一代机器人“狗”,该机器人“狗”有可能配备国防科技公司...
关注 Copilot + PC
Copilot+ PC 是迄今为止最快、最智能的 Windows PC。凭借强大的新型芯片,能够实现令人难以置信的 40+ TOPS(每秒万亿次操作)、全天的电池寿命以及对最先进人工智能模型的访问,Copilot+ PC 将使您能够完成任何其他 PC 上无法完成的事情。通过 Recall...
Interactive3D:用户可以直接通过交互操作指导3D模型生成
它提供了一种非常灵活的方式来创造和修改3D内容。你可以添加、移除组件来对模型进行各种组合,类似乐高搭建,还可进行可变形和刚性拖动等操作。 也可以通过文本控制。 而且用户交互的实时反馈,能够即时看到你的操作如何影响最终的效果。
FAIR 的新研究:通过多标记预测更好更快的大型语言模型
Meta AI 重新介绍了一下他们的新论文,通过一次预测多个词汇来加速 LLM 的训练。 通常语言模型都是根据已知词汇预测下一个词。而这篇论文提出每次预测接下来的多个词,而不仅仅是一个词。 ...
PhysDreamer:由多所大学合作开发
PhysDreamer:由多所大学(包括麻省理工学院、斯坦福大学、哥伦比亚大学和康奈尔大学)合作开发。 真实的对象交互对于创建沉浸式虚拟体验至关重要,但合成真实的 3D 对象动态以响应新颖的交互仍然是一项重大挑战。与无条件或文本条件动力学生成不同,动作条件动力学需要感知对象的物理材料属性,并将...