changes
This commit is contained in:
@@ -10,17 +10,21 @@ use App\Containers\Dashboard\Tasks\CreatePostFromAiDataTask;
|
||||
use App\Containers\Dashboard\Tasks\ExtractTextFromDocumentTask;
|
||||
use App\Containers\Dashboard\Tasks\ExtractTextFragmentTask;
|
||||
use App\Containers\Dashboard\Tasks\FindMainNewsFileTask;
|
||||
use App\Containers\Dashboard\Tasks\UnpackArchiveTask;
|
||||
use Illuminate\Http\UploadedFile;
|
||||
use Illuminate\Support\Collection;
|
||||
use Illuminate\Support\Facades\Log;
|
||||
|
||||
class ProcessMixedFilesAction
|
||||
{
|
||||
private array $extractPathsToCleanup = [];
|
||||
|
||||
public function __construct(
|
||||
private readonly FindMainNewsFileTask $findMainNewsFileTask,
|
||||
private readonly ExtractTextFromDocumentTask $extractTextFromDocumentTask,
|
||||
private readonly CallAiServiceTask $callAiServiceTask,
|
||||
private readonly CreatePostFromAiDataTask $createPostFromAiDataTask,
|
||||
private readonly UnpackArchiveTask $unpackArchiveTask,
|
||||
) {}
|
||||
|
||||
/**
|
||||
@@ -36,6 +40,25 @@ class ProcessMixedFilesAction
|
||||
'files' => $files->map(fn($f) => $f->getClientOriginalName())->toArray(),
|
||||
]);
|
||||
|
||||
// Проверяем, есть ли архивы и нужно ли их распаковывать
|
||||
$files = $this->processArchives($files);
|
||||
|
||||
Log::info('[ProcessMixedFilesAction] Файлы после обработки архивов', [
|
||||
'files_count' => $files->count(),
|
||||
'files' => $files->map(fn($f) => $f->getClientOriginalName())->toArray(),
|
||||
]);
|
||||
|
||||
// После распаковки проверяем, что есть DOC/DOCX файл
|
||||
$hasDocOrDocx = $files->contains(function ($file) {
|
||||
$ext = strtolower($file->getClientOriginalExtension());
|
||||
return in_array($ext, ['doc', 'docx']);
|
||||
});
|
||||
|
||||
if (!$hasDocOrDocx) {
|
||||
Log::error('[ProcessMixedFilesAction] После распаковки не найден DOC/DOCX файл');
|
||||
throw new \RuntimeException('В архиве не найден DOC или DOCX файл для извлечения текста новости.');
|
||||
}
|
||||
|
||||
// Находим основной файл с текстом новости
|
||||
$mainFile = $this->findMainNewsFileTask->run($files);
|
||||
|
||||
@@ -47,10 +70,25 @@ class ProcessMixedFilesAction
|
||||
Log::info('[ProcessMixedFilesAction] Основной файл найден', [
|
||||
'file' => $mainFile->getClientOriginalName(),
|
||||
'extension' => $mainFile->getClientOriginalExtension(),
|
||||
'real_path' => $mainFile->getRealPath(),
|
||||
'exists' => file_exists($mainFile->getRealPath()),
|
||||
]);
|
||||
|
||||
// Извлекаем текст из основного файла (поддерживает и .doc, и .docx)
|
||||
$extractedText = $this->extractTextFromDocumentTask->run($mainFile);
|
||||
Log::info('[ProcessMixedFilesAction] Начало извлечения текста из документа');
|
||||
try {
|
||||
$extractedText = $this->extractTextFromDocumentTask->run($mainFile);
|
||||
Log::info('[ProcessMixedFilesAction] Текст извлечен', [
|
||||
'text_length' => strlen($extractedText ?? ''),
|
||||
'text_preview' => substr($extractedText ?? '', 0, 100),
|
||||
]);
|
||||
} catch (\Exception $e) {
|
||||
Log::error('[ProcessMixedFilesAction] Ошибка при извлечении текста', [
|
||||
'error' => $e->getMessage(),
|
||||
'file' => $mainFile->getClientOriginalName(),
|
||||
]);
|
||||
throw $e;
|
||||
}
|
||||
|
||||
Log::info('[ProcessMixedFilesAction] Результат извлечения текста', [
|
||||
'text_length' => strlen($extractedText ?? ''),
|
||||
@@ -82,6 +120,9 @@ class ProcessMixedFilesAction
|
||||
// Создаём пост
|
||||
$post = $this->createPostFromAiDataTask->run($newsData, $documentPath, $mediaPaths, $attachedFiles);
|
||||
|
||||
// Очищаем временные директории после успешной обработки
|
||||
$this->cleanupExtractPaths();
|
||||
|
||||
// Возвращаем данные для отображения
|
||||
return $this->prepareResponse($post, $newsData);
|
||||
}
|
||||
@@ -106,6 +147,74 @@ class ProcessMixedFilesAction
|
||||
];
|
||||
}
|
||||
|
||||
/**
|
||||
* Обрабатывает архивы: распаковывает, если загружены только архивы
|
||||
*/
|
||||
private function processArchives(Collection $files): Collection
|
||||
{
|
||||
$archiveExtensions = ['zip'];
|
||||
|
||||
// Убедимся, что директория для распаковки существует
|
||||
$tempPath = storage_path('app/temp');
|
||||
if (!file_exists($tempPath)) {
|
||||
mkdir($tempPath, 0755, true);
|
||||
}
|
||||
|
||||
// Разделяем файлы на архивы и остальные
|
||||
$archives = $files->filter(fn($file) =>
|
||||
in_array(strtolower($file->getClientOriginalExtension()), $archiveExtensions)
|
||||
);
|
||||
|
||||
$nonArchives = $files->filter(fn($file) =>
|
||||
!in_array(strtolower($file->getClientOriginalExtension()), $archiveExtensions)
|
||||
);
|
||||
|
||||
// Если есть только архивы (нет других файлов) — распаковываем
|
||||
if ($archives->isNotEmpty() && $nonArchives->isEmpty()) {
|
||||
Log::info('[ProcessMixedFilesAction] Обнаружены только архивы, начинаем распаковку', [
|
||||
'archives_count' => $archives->count(),
|
||||
]);
|
||||
|
||||
$unpackedFiles = collect();
|
||||
$extractPaths = [];
|
||||
|
||||
foreach ($archives as $archive) {
|
||||
try {
|
||||
$result = $this->unpackArchiveTask->run($archive);
|
||||
$extractedFiles = $result['files'];
|
||||
$extractPaths[] = $result['extract_path'];
|
||||
|
||||
$unpackedFiles = $unpackedFiles->merge($extractedFiles);
|
||||
|
||||
Log::info('[ProcessMixedFilesAction] Архив распакован', [
|
||||
'archive' => $archive->getClientOriginalName(),
|
||||
'extracted_count' => $extractedFiles->count(),
|
||||
]);
|
||||
} catch (\Exception $e) {
|
||||
Log::error('[ProcessMixedFilesAction] Ошибка при распаковке архива', [
|
||||
'archive' => $archive->getClientOriginalName(),
|
||||
'error' => $e->getMessage(),
|
||||
]);
|
||||
throw $e;
|
||||
}
|
||||
}
|
||||
|
||||
// Сохраняем пути для очистки после обработки
|
||||
$this->extractPathsToCleanup = $extractPaths;
|
||||
|
||||
return $unpackedFiles;
|
||||
}
|
||||
|
||||
// Если есть не-архивные файлы — возвращаем все файлы как есть
|
||||
// (архивы будут обработаны как обычные медиа-файлы)
|
||||
Log::info('[ProcessMixedFilesAction] Обнаружены смешанные файлы, архивы не распаковываем', [
|
||||
'archives_count' => $archives->count(),
|
||||
'non_archives_count' => $nonArchives->count(),
|
||||
]);
|
||||
|
||||
return $files;
|
||||
}
|
||||
|
||||
/**
|
||||
* Обрабатывает прикреплённые файлы (для добавления в контент)
|
||||
*/
|
||||
@@ -176,4 +285,49 @@ class ProcessMixedFilesAction
|
||||
|
||||
return round($bytes, 2) . ' ' . $units[$pow];
|
||||
}
|
||||
|
||||
/**
|
||||
* Очищает временные директории после распаковки
|
||||
*/
|
||||
private function cleanupExtractPaths(): void
|
||||
{
|
||||
foreach ($this->extractPathsToCleanup as $path) {
|
||||
if (file_exists($path)) {
|
||||
$this->cleanupDirectory($path);
|
||||
}
|
||||
}
|
||||
$this->extractPathsToCleanup = [];
|
||||
}
|
||||
|
||||
/**
|
||||
* Очищает директорию рекурсивно
|
||||
*/
|
||||
private function cleanupDirectory(string $path): void
|
||||
{
|
||||
if (!file_exists($path) || !is_dir($path)) {
|
||||
return;
|
||||
}
|
||||
|
||||
try {
|
||||
$iterator = new \RecursiveIteratorIterator(
|
||||
new \RecursiveDirectoryIterator($path, \RecursiveDirectoryIterator::SKIP_DOTS),
|
||||
\RecursiveIteratorIterator::CHILD_FIRST
|
||||
);
|
||||
|
||||
foreach ($iterator as $file) {
|
||||
if ($file->isFile()) {
|
||||
@unlink($file->getPathname());
|
||||
} elseif ($file->isDir()) {
|
||||
@rmdir($file->getPathname());
|
||||
}
|
||||
}
|
||||
|
||||
@rmdir($path);
|
||||
} catch (\Exception $e) {
|
||||
Log::warning('[ProcessMixedFilesAction] Не удалось очистить временную директорию', [
|
||||
'error' => $e->getMessage(),
|
||||
'path' => $path,
|
||||
]);
|
||||
}
|
||||
}
|
||||
}
|
||||
|
||||
Reference in New Issue
Block a user